OpenAI představila GPT‑Realtime‑2 a dva nové hlasové varianty, dostupné pouze prostřednictvím API
OpenAI rozšiřuje možnosti hlasového API
Společnost oznámila spuštění nových funkcí pro své API, které umožní vývojářům vytvářet „živější“ hlasové aplikace: budou moci s uživateli komunikovat, přepisovat řeč do textu a překládat rozhovory na místě.
Nové modely Realtime
Přes rozhraní Realtime jsou nyní k dispozici tři modely:
ModelÚčelKlíčové vlastnostiGPT‑Realtime‑2Hlasová interakce v reálném časeAnalýza dotazů, volání nástrojů, zpracování oprav a plynulý průběh dialogu. Postaven na logice GPT‑5, což umožňuje řešit složitější úkoly než GPT‑Realtime‑1.5.GPT‑Realtime‑TranslatePřeklad v reálném časePodporuje 70+ vstupních jazyků a 13 výstupních jazyků. Zachovává smysl i při změně kontextu, regionálních dialektů nebo specializované terminologie.GPT‑Realtime‑WhisperPřepis řečiStreamingový model s nízkou latencí, který převádí audio do textu téměř okamžitě.
> „Naše nové modely překládají audio v reálném čase z jednoduchého dialogu na hlasové rozhraní, které skutečně funguje: poslouchá, uvažuje, překladá, přepisuje a provádí akce podle vývoje rozhovoru,“ řekla společnost.
Cena
ModelCenaGPT‑Realtime‑2$32 za 1 milion vstupních audio tokenů, $0.40 za 1 milion cachovaných tokenů a $64 za 1 milion výstupních audio tokenůGPT‑Realtime‑Translate$0.034 na minutuGPT‑Realtime‑Whisper$0.017 na minutu
Jak vyzkoušet
Vývojáři mohou nové modely otestovat na online platformě OpenAI Playground a okamžitě vidět, jak fungují v reálném čase.
Komentáře (0)
Podělte se o svůj názor — prosím, buďte slušní a držte se tématu.
Přihlaste se pro komentování