Hoppa till innehållet
Vi presenterar Klang Pianissimo

Pianissimo.

Svensk taligenkänning i 3 600× realtid.

Klang Pianissimo bygger på NVIDIA:s Parakeet v3 och är en öppen modell finjusterad för svensk taligenkänning. Den når 4,5 % ordfelsfrekvens på Common Voice och transkriberar en timme ljud på en sekund.

Testa Pianissimo

Testa att transkribera Selma Lagerlöf eller prova modellen på ditt eget ljud.

Ansluter till modellen…

Selma Lagerlöf

Silvergruvan

0:0033:36
Eller prova med ditt ljud

Släpp en fil i ljudkortet. Upp till 90 minuter. Ljudet skickas till Klang för transkribering.

Liten modell.
Stor skillnad.

Pianissimo når en ordfelsfrekvens jämförbar med KB-Whisper large, med 64 gånger högre hastighet.

Hastighet och precision i samma bild

Snabbare åt höger. Färre ordfel uppåt.

Dra i sidled för att se hela diagrammet.

Mattias Fälts modelljämförelse. Snabbare transkribering åt höger, färre ordfel uppåt. Pianissimo flyttar Paretofronten till 2 500× realtid med ordfelsfrekvens jämförbar med KB-Whisper large.
Läs vår forskning

60 timmar ljud.
På en minut.

1 sekund

för att transkribera en timme ljud

Transkriberat ljud på en minuts bearbetning
En ruta = en timme ljud

Börja använda Pianissimo.

Pianissimo är en öppen modell, byggd för digital självständighet. Kör den på din egen infrastruktur eller använd den via vår partner Berget AI. Du väljer var ditt ljud behandlas.

Hugging Face

Kör på din egen infrastruktur.

Hämta modellvikterna, anpassa modellen och bygg vidare. Du väljer hårdvara och var ditt ljud behandlas.

Du väljer var modellen körs.

Europeisk AI behöver modeller som fler kan bygga vidare på. Med öppna vikter kan du köra Pianissimo lokalt, välja en europeisk driftleverantör och byta när dina behov förändras.

Byggt något med Pianissimo? Berätta för oss på [email protected].

Klang

AI för samtal som spelar roll.

Klang gör dina samtal sökbara och användbara - med transkriberingar, sammanfattningar och insikter. Byggt i Europa, med förtroende i kärnan.