OpenAI a lansat GPT‑Realtime‑2 și două noi variante vocale disponibile doar prin API.

OpenAI a lansat GPT‑Realtime‑2 și două noi variante vocale disponibile doar prin API.

14 hardware

OpenAI extinde capacitățile API-ului vocal

Compania a anunțat lansarea unor noi funcționalități pentru API-ul său, care vor permite dezvoltatorilor să creeze aplicații vocale „mai vii”: vor putea conversa cu utilizatorii, transcrie vorbirea în text și traduce discuțiile pe loc.

Modele Realtime noi
Prin interfața Realtime sunt acum disponibile trei modele:

ModelulDestinațieCaracteristici cheieGPT‑Realtime‑2Interacțiune vocală în timp realAnaliza cererilor, apelarea instrumentelor, procesarea corecțiilor și continuarea lină a dialogului. Bazat pe logica GPT‑5, permițând gestionarea unor sarcini mai complexe comparativ cu GPT‑Realtime‑1.5.GPT‑Realtime‑TranslateTraducere în timp realSuport pentru peste 70 de limbi de intrare și 13 limbi de ieșire. Menține sensul chiar și la schimbări de context, accente regionale sau terminologie specializată.GPT‑Realtime‑WhisperTranscriere vocalăModel de flux cu latență redusă care transformă audio în text aproape instantaneu.

> „Modelele noastre noi traduc audio în timp real din dialog simplu în interfețe vocale care pot funcționa cu adevărat: asculta, raționează, traduce, transcrie și ia măsuri pe măsură ce conversația evoluează”, a declarat compania.

Cost
ModelPrețGPT‑Realtime‑2$32 pentru 1 mln de tokeni audio de intrare, $0.40 pentru 1 mln de tokeni cache și $64 pentru 1 mln de tokeni audio de ieșireGPT‑Realtime‑Translate$0.034 pe minutGPT‑Realtime‑Whisper$0.017 pe minut

Cum să încerci
Dezvoltatorii pot testa noile modele pe platforma online OpenAI Playground și pot vedea imediat cum funcționează în timp real.

Comentarii (0)

Împărtășește-ți opinia — te rugăm să fii politicos și să rămâi la subiect.

Încă nu există comentarii. Lasă un comentariu și împărtășește-ți opinia!

Pentru a lăsa un comentariu, autentifică-te.

Autentifică-te pentru a comenta