Hopp til innholdet
Vi presenterer Klang Pianissimo

Pianissimo.

Svensk tale til tekst i 3 600× sanntid.

Klang Pianissimo bygger på NVIDIAs Parakeet v3 og er en åpen modell finjustert for svensk tale til tekst. Den oppnår en ordfeilrate på 4,5 % på Common Voice og transkriberer en time lyd på ett sekund.

Prøv Pianissimo

Prøv å transkribere Selma Lagerlöf, eller prøv modellen på din egen lyd.

Kobler til modellen…

Selma Lagerlöf

Silvergruvan

0:0033:36
Eller prøv med din egen lyd

Slipp en fil på spilleren. Opptil 90 minutter. Lyden sendes til Klang for transkribering.

Liten modell.
Stor forskjell.

Pianissimo oppnår en ordfeilrate på nivå med KB-Whisper large, med 64 ganger høyere hastighet.

Hastighet og presisjon i samme bilde

Raskere mot høyre. Færre ordfeil oppover.

Bla sidelengs for å se hele diagrammet.

Mattias Fälts modellsammenligning. Raskere transkribering mot høyre, færre ordfeil oppover. Pianissimo flytter Paretofronten til 2 500× sanntid med en ordfeilrate på nivå med KB-Whisper large.
Les om forskningen vår

60 timer lyd.
På ett minutt.

1 sekund

for å transkribere en time lyd

Transkribert lyd på ett minutts behandling
Én rute = én time lyd

Ta i bruk Pianissimo.

Pianissimo er en åpen modell, bygget for digital selvstendighet. Kjør den på din egen infrastruktur eller bruk den via partneren vår Berget AI. Du velger hvor lyden din behandles.

Hugging Face

Kjør på din egen infrastruktur.

Last ned modellvektene, tilpass modellen og bygg videre. Du velger maskinvaren og hvor lyden din behandles.

Du velger hvor modellen kjører.

Europeisk AI trenger modeller som flere kan bygge videre på. Med åpne vekter kan du kjøre Pianissimo lokalt, velge en europeisk driftsleverandør og bytte når behovene dine endrer seg.

Bygget noe med Pianissimo? Fortell oss om det på [email protected].

Klang

AI for samtaler som betyr noe.

Klang gjør samtalene dine søkbare og brukbare - med transkripsjoner, sammendrag og innsikt. Bygget i Europa, med tillit i kjernen.