telkittelkit
telkit Transcribe

Norsk tale til tekst, via API

Send en lydfil, eller strøm lyden mens den spilles inn. Du får tilbake tekst med taler og tidsstempel på hvert ord. Prosesseringen skjer på EU-endepunkter, opptak og transkript lagres i EØS, og du betaler for lyd-sekundene som faktisk ble prosessert.

Live demo

Fra lyd til tekst, mens du snakker

Trykk på mikrofonen og les opp en setning. Ordene kommer inn som foreløpige treff, og justeres til endelig tekst med taleren merket.

Live transkripsjon

Norsk tale til tekst, mens du snakker.

Simulert

Starter en simulert samtale …

Simulert transkripsjon. Trykk for å bruke din egen mikrofon.

Norsk og dataresidens

Bokmål og nynorsk, prosessert i Europa

Norsk er språket vi optimaliserer for. Bokmål og nynorsk kommer tilbake med diarisering og ordtidsstempler i samme svar, og vi evaluerer på spontan tale fra møter og telefonsamtaler, i tillegg til opplest bokmål. Hele kjeden, fra lyden kommer inn til transkriptet ligger lagret, kjører i Europa.

Hvor dataene ligger
Region
MediaAnrop og lyd, låst til regionen
eu-central · Frankfurt
Tale-til-tekstProsessering på EU-endepunkter
EU
LagringOpptak og transkript, i EØS
EEA · Hetzner

Vi publiserer ingen benchmark-tall. Spontan tale og sterke dialekter er vanskeligere for alle modeller, og trøndersk og nordnorsk er der det oftest ryker. Vi sier det heller enn å pynte på det. Gratisnivået lar deg kjøre ditt eget lydmateriale gjennom før du bestemmer deg.

Batch og sanntid

To måter inn, ett transkript-format

Last opp en fil for asynkron behandling, eller strøm lyd over WebSocket mens samtalen pågår. Kvaliteten og formatet på svaret er det samme.

Batch

Fil eller URL → jobb

Send en URL eller last opp en fil. Du får en jobb-ID og følger fremdriften over SSE eller webhook. Når jobben er ferdig, laster du ned JSON, SRT og VTT.

  • Webhook, polling og SSE-fremdrift
  • Lange filer deles opp server-side
  • JSON, SRT og VTT ut
  • Idempotency-Key på innsending
batch.tsts
import { Telkit } from "@telkit/sdk"; const telkit = new Telkit({ apiKey: process.env.TELKIT_API_KEY }); // Submit a file or URL. Billed per audio-second.const job = await telkit.transcription.jobs.create({  audioUrl: "https://example.no/intervju.mp3",  language: "no",          // nb · nn · auto  diarize: true,           // speaker labels, included  formats: ["json", "srt", "vtt"],}); // Follow progress over SSE (or wait for the signed webhook).for await (const e of telkit.transcription.jobs.stream(job.id)) {  if (e.status === "completed") console.log(e.transcript.text);}
Sanntid

WebSocket → live transkript

Mint en økt, åpne en WebSocket og send PCM-rammer. Interim-hendelser kommer mens noen snakker, endelige når setningen er ferdig. Telefonilyd på 8 kHz resamples automatisk til 16 kHz.

  • Interim → endelig, med speech_final
  • Diarisering per ord
  • 8 kHz telefoni → 16 kHz
  • Lav latens, på EU-endepunkter
realtime.tsts
import { Telkit } from "@telkit/sdk"; const telkit = new Telkit({ apiKey: process.env.TELKIT_API_KEY }); // Audio in, transcripts out, over one WebSocket.const stream = await telkit.transcription.stream({  language: "no",          // streamed on EU endpoints  diarize: true,}); stream.on("transcript", (e) => {  // interim → final, with per-word speaker labels  if (e.isFinal) console.log(e.speaker, e.text);}); // Push 16 kHz PCM frames (8 kHz telephony is auto-resampled).mic.on("data", (pcm) => stream.send(pcm));
Funksjoner

Alt du trenger rundt transkriptet

Talere, tidsstempler, undertekstfiler og to tekstvarianter ligger i samme svar, uten tilleggspris.

Diarisering inkludert

Hvem som snakker merkes ord for ord, og ordene grupperes i utsagn per taler.

Verbatim og semantisk

Ordrett variant for jus og politi. Semantisk variant kutter nøling og gjentakelser, og passer til møtereferat og undertekster. Begge finnes på bokmål og nynorsk.

Ord-tidsstempler

Start og slutt i millisekunder, med konfidens, på hvert eneste ord.

SRT og VTT

Undertekstfiler genereres rett fra transkriptet, klare til å legges på video.

Dataresidens i EØS

Tale-til-tekst kjører på EU-endepunkter. Opptak og transkript lagres i EØS hos Hetzner, og innholdet forlater aldri EØS.

Norsk først, flere språk i tillegg

Bokmål og nynorsk er det vi optimaliserer for. Samme API og samme transkript-format dekker de store europeiske og internasjonale språkene.

Pris

Du betaler for lyd-sekunder

Grunnlaget er lyd-sekundene som faktisk ble prosessert. Tiden WebSocket-en sto åpen teller ikke. Prisene er i EUR uten plattformavgift, og gratisnivået holder til å evaluere på eget materiale.

Se full prisliste
fra0,006 €/ lyd-min
Batch (fil / URL)
0,006 € / lyd-min
Sanntid (WebSocket)
0,01 € / lyd-min
Diarisering
Inkludert
Verbatim + semantisk
Inkludert

Fakturert per lyd-sekund. Diarisering og begge tekstvariantene er inkludert.

Spørsmål

Vanlige spørsmål

Språk, dialekter, dataresidens, formater og latens.

Klar til å transkribere?

Hent en API-nøkkel og send den første lydfilen. Gratisnivået krever ikke kort.