Byggd för svenska
Pianissimo är tränad på svenska och svenska dialekter, och sätter själv ut skiljetecken och stor bokstav. Modellen finns öppet på Hugging Face som KlangAI/pianissimo-sv.
Pianissimo är Klangs öppna taligenkänningsmodell för svenska. Den bygger på Nvidia Parakeet, är tränad på svenska och svenska dialekter och är lika träffsäker som KB Whisper Large, men ungefär 60 gånger snabbare.
Med OSTT pratar du in text i vilken app som helst med ett kortkommando, eller transkriberar direkt i terminalen. Modellen körs hos Berget AI, och ljudet lämnar aldrig Sverige. Fungerar på Linux och macOS.
Klang Pianissimo
Pianissimo är utvecklad av Klang AI och släpptes som öppen källkod i september 2026. Klang har tagit Nvidias Parakeet-modell och anpassat den för svenska och svenska dialekter. I Klangs tester på Common Voice, FLEURS och Klangs egna dialektinspelningar är Pianissimo lika träffsäker som KB Whisper Large, Kungliga bibliotekets bästa öppna svenska modell. Samtidigt går den ungefär 60 gånger snabbare: en timmes ljud tar runt en sekund.
# Logga in och välj Berget
ostt auth login
# Välj Pianissimo som standardmodell
ostt model
# Spela in och kopiera texten
ostt -m berget/klang/pianissimo -c
# Transkribera en ljudfil
ostt transcribe intervju.mp3 -m berget/klang/pianissimoPianissimo är tränad på svenska och svenska dialekter, och sätter själv ut skiljetecken och stor bokstav. Modellen finns öppet på Hugging Face som KlangAI/pianissimo-sv.
Klang mäter omkring 3600 gånger realtid. Det betyder att ett långt möte eller en intervju är transkriberad nästan direkt efter att ljudet har laddats upp.
Berget är en svensk molnleverantör. Allt ljud behandlas på servrar i Sverige och Berget sparar ingenting. Ett bra val när dataskydd och GDPR är viktigt.
OSTT skickar ljudet till Berget när du har slutat spela in och ger dig sedan hela texten på en gång. Du ser alltså ingen text medan du pratar.
Pianissimo tar inte emot nyckelord, promptar eller temperatur, så dina OSTT-nyckelord skickas inte med. Behöver du lära modellen namn och facktermer passar KB Whisper bättre.
OSTT sparar alla inspelningar lokalt. Kör ostt retry -m berget/KBLab/kb-whisper-large för att transkribera samma ljud med KB Whisper och se vilken modell som passar dig bäst.
Arbetsflöde
ostt i terminalen.Pipeline
OSTT fungerar som vilket kommandoradsverktyg som helst. Texten skrivs till stdout, så du kan skicka den vidare till jq, sed eller dina egna skript. Med -p kör du en bearbetning direkt efter transkriberingen, till exempel för att städa upp texten eller skicka den till Claude Code.
# Transkribera ett möte och spara texten
ostt transcribe mote.mp3 -m berget/klang/pianissimo -o mote.md
# Spela in, städa upp texten och kopiera
ostt -m berget/klang/pianissimo -p clean -c
# Skicka texten vidare till ett eget skript
ostt -m berget/klang/pianissimo | mitt-skript.sh