OpenAI představila GPT‑Realtime‑2 a dva nové hlasové varianty, dostupné pouze prostřednictvím API

OpenAI představila GPT‑Realtime‑2 a dva nové hlasové varianty, dostupné pouze prostřednictvím API

21 hardware

OpenAI rozšiřuje možnosti hlasového API

Společnost oznámila spuštění nových funkcí pro své API, které umožní vývojářům vytvářet „živější“ hlasové aplikace: budou moci s uživateli komunikovat, přepisovat řeč do textu a překládat rozhovory na místě.

Nové modely Realtime
Přes rozhraní Realtime jsou nyní k dispozici tři modely:

ModelÚčelKlíčové vlastnostiGPT‑Realtime‑2Hlasová interakce v reálném časeAnalýza dotazů, volání nástrojů, zpracování oprav a plynulý průběh dialogu. Postaven na logice GPT‑5, což umožňuje řešit složitější úkoly než GPT‑Realtime‑1.5.GPT‑Realtime‑TranslatePřeklad v reálném časePodporuje 70+ vstupních jazyků a 13 výstupních jazyků. Zachovává smysl i při změně kontextu, regionálních dialektů nebo specializované terminologie.GPT‑Realtime‑WhisperPřepis řečiStreamingový model s nízkou latencí, který převádí audio do textu téměř okamžitě.

> „Naše nové modely překládají audio v reálném čase z jednoduchého dialogu na hlasové rozhraní, které skutečně funguje: poslouchá, uvažuje, překladá, přepisuje a provádí akce podle vývoje rozhovoru,“ řekla společnost.

Cena
ModelCenaGPT‑Realtime‑2$32 za 1 milion vstupních audio tokenů, $0.40 za 1 milion cachovaných tokenů a $64 za 1 milion výstupních audio tokenůGPT‑Realtime‑Translate$0.034 na minutuGPT‑Realtime‑Whisper$0.017 na minutu

Jak vyzkoušet
Vývojáři mohou nové modely otestovat na online platformě OpenAI Playground a okamžitě vidět, jak fungují v reálném čase.

Komentáře (0)

Podělte se o svůj názor — prosím, buďte slušní a držte se tématu.

Zatím žádné komentáře. Zanechte komentář a podělte se o svůj názor!

Chcete-li zanechat komentář, přihlaste se.

Přihlaste se pro komentování