OpenAI rozszerza Voice o wtyczki i wprowadza głos do ChatGPT Work
OpenAI dodało obsługę wtyczek do Live Voice i udostępniło funkcję Voice w ChatGPT Work.
Jak OpenAI rozszerza możliwości interakcji głosowej w swoich produktach? Firma dodała obsługę wtyczek do Live Voice oraz wprowadza funkcję Voice w ChatGPT Work, otwierając nowe scenariusze użycia dla biznesu i użytkowników indywidualnych.
Live Voice z obsługą wtyczek — co się zmieniło?
Wtyczki w Live Voice działają na wszystkich platformach: przeglądarce internetowej, iOS i Androidzie. Użytkownicy mogą wywoływać wtyczki bezpośrednio podczas rozmowy głosowej, co upraszcza przepływ pracy i eliminuje potrzebę przełączania się między aplikacjami. Jednak OpenAI nałożyło ograniczenie — zatwierdzanie akcji wymaga przeglądu na ekranie urządzenia. To oznacza, że choć inicjacja działania może być głosowa, potwierdzenie pozostaje manualnym procesem, co zwiększa bezpieczeństwo i kontrolę użytkownika.
Live Voice działa na modelach GPT-Live-1 lub GPT-Live-1 mini, które stanowią nowoczesną bazę dla rozmów real-time. Warto rozróżnić to od Advanced Voice (poprzednie doświadczenie real-time) i Standard Voice (opcja tur po turze), które oferują inne charakterystyki opóźnienia i interakcji.
Voice w ChatGPT Work — nowa funkcjonalność dla zespołów
Od 23 lipca 2026 roku Voice jest dostępne w ChatGPT Work zarówno w wersji webowej, jak i mobilnej. To rozszerzenie funkcjonalności dla użytkowników biznesowych, którzy mogą teraz prowadzić rozmowy głosowe w ramach platformy przeznaczonej dla zespołów. ChatGPT Work sam został wprowadzony 9 lipca 2026 roku, a Voice stanowi znaczące uzupełnienie jego możliwości.
Limity użycia i modele cenowe — kto ile może rozmawiać?
OpenAI ustaliło zróżnicowane limity czasu dla różnych planów subskrypcji:
| Plan | Limit czasu | Model | Koszt kredytu/minutę |
|---|---|---|---|
| Free | Ograniczony | GPT-Live-1 mini | — |
| Go | 3 godziny | GPT-Live-1 mini | — |
| Plus | 3 godziny | GPT-Live-1 | — |
| Pro (100 $/mies.) | 15 godzin | GPT-Live-1 | — |
| Pro (200 $/mies.) | Nieograniczone | GPT-Live-1 | — |
| Business Standard | 3 godziny | — | 1,25 kredytu/min |
| Business Premium | 15 godzin | — | — |
| Enterprise/Edu/Clinicians | — | — | 1,25 kredytu/min |
| Enterprise (model zużycia) | — | — | 0,05 $/min |
Dla użytkowników biznesowych Enterprise dostępny jest model oparty na rzeczywistym zużyciu: 0,05 dolara za minutę. To rozwiązanie daje większą elastyczność dla organizacji o zmiennym wolumenie rozmów głosowych.
Ograniczenia techniczne — co Live Voice nie robi
Live Voice ma wyraźne granice funkcjonalności. Nie obsługuje wideo ani udostępniania ekranu, co oznacza, że rozmowy głosowe pozostają kanałem czysto audio. Dodatkowo, Live Voice nie może wyszukiwać ani dodawać pliki z Biblioteki ChatGPT, co ogranicza możliwość bezpośredniego dostępu do przechowywanych dokumentów podczas rozmowy.
Harmonogram wprowadzenia i ewolucja modeli
Nowe funkcjonalności pojawiały się stopniowo:
- GPT-Live-1 wprowadzony 8 lipca 2026
- ChatGPT Work uruchomiony 9 lipca 2026
- Voice w Work dostępne od 23 lipca 2026
- Live Activities na iPhone’a dodane 31 sierpnia 2026
- Od 9 września 2026 Voice może używać GPT-5.6 lub GPT-6 Astra
Ta progresja pokazuje, że OpenAI konsekwentnie rozbudowuje ekosystem wokół interakcji głosowych, dodając nowe modele i funkcjonalności w krótkich odstępach czasu.
Co to oznacza dla użytkowników?
Dla użytkowników indywidualnych rozszerzenie Voice do ChatGPT Work oznacza dostęp do funkcji głosowych w środowisku przeznaczonym dla zespołów. Subskrybenci wyższych planów Pro otrzymują znacznie większe limity czasu (15 godzin lub nieograniczone), co czyni Voice praktycznym narzędziem do długotrwałych sesji pracy.
Dla organizacji biznesowych model Enterprise z ceną 0,05 dolara za minutę oferuje przejrzystość kosztów. Przy założeniu średniej rozmowy 30 minut dziennie na pracownika, koszt wyniosłby około 1,50 dolara dziennie, czyli około 30 dolarów miesięcznie na osobę — kwota, którą wiele firm może zaakceptować jako część budżetu narzędzi produktywności.
Ograniczenia (brak wideo, brak dostępu do biblioteki) sygnalizują, że OpenAI pozycjonuje Voice jako narzędzie do rozmów, a nie jako uniwersalny interfejs multimedialny. To może być zarówno zaletą (prostota, mniejsze wymagania zasobowe), jak i wadą (ograniczona funkcjonalność).
Na podstawie: Unite.AI. Tekst opracowany redakcyjnie.