Klang Pianissimo i terminalen.

Pianissimo är Klangs öppna taligenkänningsmodell för svenska. Den bygger på Nvidia Parakeet, är tränad på svenska och svenska dialekter och är lika träffsäker som KB Whisper Large, men ungefär 60 gånger snabbare.

Med OSTT pratar du in text i vilken app som helst med ett kortkommando, eller transkriberar direkt i terminalen. Modellen körs hos Berget AI, och ljudet lämnar aldrig Sverige. Fungerar på Linux och macOS.

Klang Pianissimo

Lika träffsäker som KB Whisper. 60 gånger snabbare.

Pianissimo är utvecklad av Klang AI och släpptes som öppen källkod i september 2026. Klang har tagit Nvidias Parakeet-modell och anpassat den för svenska och svenska dialekter. I Klangs tester på Common Voice, FLEURS och Klangs egna dialektinspelningar är Pianissimo lika träffsäker som KB Whisper Large, Kungliga bibliotekets bästa öppna svenska modell. Samtidigt går den ungefär 60 gånger snabbare: en timmes ljud tar runt en sekund.

# Logga in och välj Berget
ostt auth login

# Välj Pianissimo som standardmodell
ostt model

# Spela in och kopiera texten
ostt -m berget/klang/pianissimo -c

# Transkribera en ljudfil
ostt transcribe intervju.mp3 -m berget/klang/pianissimo

Byggd för svenska

Pianissimo är tränad på svenska och svenska dialekter, och sätter själv ut skiljetecken och stor bokstav. Modellen finns öppet på Hugging Face som KlangAI/pianissimo-sv.

Snabb även på långa inspelningar

Klang mäter omkring 3600 gånger realtid. Det betyder att ett långt möte eller en intervju är transkriberad nästan direkt efter att ljudet har laddats upp.

Ljudet stannar i Sverige

Berget är en svensk molnleverantör. Allt ljud behandlas på servrar i Sverige och Berget sparar ingenting. Ett bra val när dataskydd och GDPR är viktigt.

Hela texten när du är klar

OSTT skickar ljudet till Berget när du har slutat spela in och ger dig sedan hela texten på en gång. Du ser alltså ingen text medan du pratar.

Behöver du nyckelord?

Pianissimo tar inte emot nyckelord, promptar eller temperatur, så dina OSTT-nyckelord skickas inte med. Behöver du lära modellen namn och facktermer passar KB Whisper bättre.

Jämför utan att prata in igen

OSTT sparar alla inspelningar lokalt. Kör ostt retry -m berget/KBLab/kb-whisper-large för att transkribera samma ljud med KB Whisper och se vilken modell som passar dig bäst.

Arbetsflöde

Från tal till färdig text.

1. Spela inTryck på ditt kortkommando eller kör ostt i terminalen.
2. TranskriberaPianissimo gör om ljudet till text hos Berget i Sverige.
3. BearbetaLåt en AI-prompt eller ett eget skript putsa texten, om du vill.
4. AnvändKopiera till urklipp, spara till fil eller skicka vidare till nästa program.

Pipeline

Svensk text som går att bygga vidare på.

OSTT fungerar som vilket kommandoradsverktyg som helst. Texten skrivs till stdout, så du kan skicka den vidare till jq, sed eller dina egna skript. Med -p kör du en bearbetning direkt efter transkriberingen, till exempel för att städa upp texten eller skicka den till Claude Code.

# Transkribera ett möte och spara texten
ostt transcribe mote.mp3 -m berget/klang/pianissimo -o mote.md

# Spela in, städa upp texten och kopiera
ostt -m berget/klang/pianissimo -p clean -c

# Skicka texten vidare till ett eget skript
ostt -m berget/klang/pianissimo | mitt-skript.sh

Kom igång med Pianissimo på en minut.