Pereiti prie turinio
2026 m. spalio 7 d., trečiadienis
Tenesys AI News
Prenumerata

AssemblyAI

Naujausios naujienos, modeliai ir jų pokyčiai.

Naujausios naujienos

Voice AI· Svarbu· 🧪 Verta testuoti

AssemblyAI pristato Sync API: pilna transkripcija per vieną HTTP užklausą, ~134ms uždelsimas

AssemblyAI pristatė Sync API — naują transporto būdą trumpų garso įrašų transkripcijai: vienas HTTP POST užklausimas grąžina baigtą Universal-3.5 Pro transkripciją toje pačioje atsakyme, vidutiniškai per ~134ms. Tai užpildo tarpą tarp Async API (pateikti ir laukti, pridedant 5-6 sekundes uždelsimo) ir Realtime API (WebSocket, skirtas tęstinėms sesijoms), taikant dėmesį tokioms užduotims kaip diktavimas, pokalbių agento ėjimų transkripcija, IVR ir push-to-talk. Palaikomi 80ms–2min ilgio įrašai iki 40MB, su 1,59% klaidų lygiu trumpam garsui. Kaina — 0,45 USD/val., tiek pat, kiek Universal-3.5 Pro Realtime.

AssemblyAI
Voice AI· Svarbu· 🧪 Verta testuoti

AssemblyAI pristato Qwen3.5 4B LLM Gateway platformoje greitam balso transkripcijų perrašymui

AssemblyAI paleido atviro kodo Qwen3.5 4B modelio diegimą savo LLM Gateway platformoje, specialiai optimizuotą perrašyti neapdorotą kalbos-teksto išvestį į švarų, suformatuotą tekstą. Balso perrašymo užduotyse, tokiose kaip diktavimo valymas ir transkripcijos formatavimas, modelis vidutiniškai atsakė per 612ms — 1,9 karto greičiau nei GPT-4.1 — ir kainavo 94% mažiau per valandą apdoroto garso. Modelio kaina — $0.10/$0.50 už milijoną tokenų (užklausa/atsakymas), palaikomi tik max_tokens, temperature ir stream parametrai, be įrankių kvietimo (tool calling).

AssemblyAI
Voice AI· Svarbu· 🧪 Verta testuoti

AssemblyAI pristatė Universal-3.5 Pro su natūraliu kalbų perjungimu ir patobulintu kalbėtojų atskyrimu

AssemblyAI išleido Universal-3.5 Pro — naują pagrindinį asinchroninį kalbos atpažinimo (STT) modelį, kainuojantį 0,21 USD/val. Modelis natūraliai transkribuoja kalbų perjungimo (code-switching) pokalbius 18 kalbų be papildomos konfigūracijos, pristato bendrai modeliuojamą kalbėtojų atskyrimą, integruotą tiesiai į transkriptą (o ne sujungtą iš atskiros sistemos), bei palaiko kontekstinį paraginimą, leidžiantį pateikti modeliui srities žinias. Testai rodo mažesnį žodžių klaidų lygį kalbų perjungimo garso įrašuose ir didesnį cpWER tikslumą kalbėtojų atskyrime, lyginant su kelais konkurentų modeliais ir ankstesniu AssemblyAI Universal-3 Pro.

AssemblyAI
AssemblyAI — AI naujienos · TENESYS AI NEWS