Produkty

Claude Voice na Opusie i Sonnecie, z dostępem do Gmaila i Slacka w trakcie rozmowy. Anthropic goni GPT-Live, ale po swojemu

Tryb głosowy Claude'a dostał największą aktualizację od premiery: wybór modeli Opus, Sonnet i Haiku, 11 języków oraz konektory do aplikacji działające w trakcie rozmowy — czego nie oferuje ani ChatGPT, ani Grok. Wciąż brakuje mu jednak pełnego dupleksu.

Anthropic rozbudowało tryb głosowy Claude’a — to największa zmiana od jego premiery. Dotychczas rozmowy głosowe obsługiwał wyłącznie szybki, ale ograniczony model Haiku; teraz użytkownik wybiera między Opus, Sonnet i Haiku, a tryb głosowy domyślnie przejmuje model, którego ostatnio używano w czacie tekstowym (w jego najszybszej wersji). Rozmowy działają w 11 językach.

Ważniejsza od wyboru modelu jest druga nowość: Claude Voice potrafi w trakcie rozmowy sięgać po kontekst z podłączonych aplikacji — Gmaila, Slacka, a także narzędzi takich jak Canva. To funkcja, której obecnie nie ma żaden konkurent: ani ChatGPT, ani Grok Voice nie oferują dostępu do narzędzi w trakcie rozmowy głosowej. Anthropic przesuwa więc asystenta głosowego z roli gadającego czatbota do roli asystenta, który podczas rozmowy faktycznie działa na danych użytkownika.

Najpierw posłucha, pomyśli, potem odpowie

Pozostaje jedno istotne „ale“: Claude Voice działa w architekturze turowej — model wysłuchuje wypowiedzi, zatrzymuje się, by ją przetworzyć, i dopiero odpowiada. To wyraźnie mniej naturalne niż pełny dupleks GPT-Live od OpenAI, w którym model mówi i słucha równocześnie (o premierze GPT-Live pisaliśmy w zeszłym tygodniu). W jakości „rozmowy“ OpenAI wciąż prowadzi.

Anthropic gra więc inną kartą: zamiast wygrywać naturalnością dialogu, wygrywa użytecznością. Rozmowa głosowa, która potrafi sprawdzić pocztę, odczytać wątek na Slacku i podjąć działanie w zewnętrznej aplikacji, to z perspektywy pracy więcej wartości niż płynniejsza wymiana zdań. Klasyczny układ sił tej dwójki: OpenAI buduje doświadczenie dla masowego konsumenta, Anthropic — narzędzie do zadań.

Pytanie, jak szybko któryś z nich połączy obie zalety. Bo kto to zrobi pierwszy, ustawi standard asystentów głosowych na lata.

Źródło: AIToolsRecap

Komentarze

Dołącz do dyskusji

Komentarze są moderowane przed publikacją.