Norsk tale til tekst, via API
Send en lydfil, eller strøm lyden mens den spilles inn. Du får tilbake tekst med taler og tidsstempel på hvert ord. Prosesseringen skjer på EU-endepunkter, opptak og transkript lagres i EØS, og du betaler for lyd-sekundene som faktisk ble prosessert.
Fra lyd til tekst, mens du snakker
Trykk på mikrofonen og les opp en setning. Ordene kommer inn som foreløpige treff, og justeres til endelig tekst med taleren merket.
Live transkripsjon
Norsk tale til tekst, mens du snakker.
Starter en simulert samtale …
Simulert transkripsjon. Trykk for å bruke din egen mikrofon.
Bokmål og nynorsk, prosessert i Europa
Norsk er språket vi optimaliserer for. Bokmål og nynorsk kommer tilbake med diarisering og ordtidsstempler i samme svar, og vi evaluerer på spontan tale fra møter og telefonsamtaler, i tillegg til opplest bokmål. Hele kjeden, fra lyden kommer inn til transkriptet ligger lagret, kjører i Europa.
Vi publiserer ingen benchmark-tall. Spontan tale og sterke dialekter er vanskeligere for alle modeller, og trøndersk og nordnorsk er der det oftest ryker. Vi sier det heller enn å pynte på det. Gratisnivået lar deg kjøre ditt eget lydmateriale gjennom før du bestemmer deg.
To måter inn, ett transkript-format
Last opp en fil for asynkron behandling, eller strøm lyd over WebSocket mens samtalen pågår. Kvaliteten og formatet på svaret er det samme.
Fil eller URL → jobb
Send en URL eller last opp en fil. Du får en jobb-ID og følger fremdriften over SSE eller webhook. Når jobben er ferdig, laster du ned JSON, SRT og VTT.
- Webhook, polling og SSE-fremdrift
- Lange filer deles opp server-side
- JSON, SRT og VTT ut
- Idempotency-Key på innsending
import { Telkit } from "@telkit/sdk"; const telkit = new Telkit({ apiKey: process.env.TELKIT_API_KEY }); // Submit a file or URL. Billed per audio-second.const job = await telkit.transcription.jobs.create({ audioUrl: "https://example.no/intervju.mp3", language: "no", // nb · nn · auto diarize: true, // speaker labels, included formats: ["json", "srt", "vtt"],}); // Follow progress over SSE (or wait for the signed webhook).for await (const e of telkit.transcription.jobs.stream(job.id)) { if (e.status === "completed") console.log(e.transcript.text);}WebSocket → live transkript
Mint en økt, åpne en WebSocket og send PCM-rammer. Interim-hendelser kommer mens noen snakker, endelige når setningen er ferdig. Telefonilyd på 8 kHz resamples automatisk til 16 kHz.
- Interim → endelig, med speech_final
- Diarisering per ord
- 8 kHz telefoni → 16 kHz
- Lav latens, på EU-endepunkter
import { Telkit } from "@telkit/sdk"; const telkit = new Telkit({ apiKey: process.env.TELKIT_API_KEY }); // Audio in, transcripts out, over one WebSocket.const stream = await telkit.transcription.stream({ language: "no", // streamed on EU endpoints diarize: true,}); stream.on("transcript", (e) => { // interim → final, with per-word speaker labels if (e.isFinal) console.log(e.speaker, e.text);}); // Push 16 kHz PCM frames (8 kHz telephony is auto-resampled).mic.on("data", (pcm) => stream.send(pcm));Alt du trenger rundt transkriptet
Talere, tidsstempler, undertekstfiler og to tekstvarianter ligger i samme svar, uten tilleggspris.
Diarisering inkludert
Hvem som snakker merkes ord for ord, og ordene grupperes i utsagn per taler.
Verbatim og semantisk
Ordrett variant for jus og politi. Semantisk variant kutter nøling og gjentakelser, og passer til møtereferat og undertekster. Begge finnes på bokmål og nynorsk.
Ord-tidsstempler
Start og slutt i millisekunder, med konfidens, på hvert eneste ord.
SRT og VTT
Undertekstfiler genereres rett fra transkriptet, klare til å legges på video.
Dataresidens i EØS
Tale-til-tekst kjører på EU-endepunkter. Opptak og transkript lagres i EØS hos Hetzner, og innholdet forlater aldri EØS.
Norsk først, flere språk i tillegg
Bokmål og nynorsk er det vi optimaliserer for. Samme API og samme transkript-format dekker de store europeiske og internasjonale språkene.
Du betaler for lyd-sekunder
Grunnlaget er lyd-sekundene som faktisk ble prosessert. Tiden WebSocket-en sto åpen teller ikke. Prisene er i EUR uten plattformavgift, og gratisnivået holder til å evaluere på eget materiale.
- Batch (fil / URL)
- 0,006 € / lyd-min
- Sanntid (WebSocket)
- 0,01 € / lyd-min
- Diarisering
- Inkludert
- Verbatim + semantisk
- Inkludert
Fakturert per lyd-sekund. Diarisering og begge tekstvariantene er inkludert.
Vanlige spørsmål
Språk, dialekter, dataresidens, formater og latens.
Klar til å transkribere?
Hent en API-nøkkel og send den første lydfilen. Gratisnivået krever ikke kort.