През последната година гласовият режим на Claude се утвърждава като основна функционалност в екосистемата на Anthropic. Компанията въвежда функцията през 2025 г., а през юли прави ключова промяна като премахва зависимостта от модела Haiku, който първоначално гарантира ниска латентност на връзката. Сега гласовият режим работи и през по-мощните модели Sonnet и Opus.
Той е достъпен както в мобилните приложения за Android и iOS, така и в уеб версията на Claude. Anthropic обаче посочва мобилните устройства като средата с най-добро изживяване, тъй като там гласовото взаимодействие е най-бързо и естествено.
Гласов режим за мобилни устройства
Активирането на гласовия режим на мобилното устройство става чрез отваряне на приложението Claude и натискането на черната икона с форма на вълна в долния десен ъгъл на интерфейса. При стартиране приложението иска достъп до микрофона, а след предоставяне на разрешение, потребителят може да започне да говори, като Claude ще отговори веднага след като изказването му приключи.
Диалогът остава активен до натискане на бутона „Спиране", което позволява продължителна и естествена комуникация. Целта на функцията е да улесни взаимодействието с асистента в ситуации, в които писането е неудобно или невъзможно.
Гласовият режим на Claude работи на принципа на „поредната" (turn-based) архитектура - асистентът изслушва цялото изказване на потребителя, след което го обработва и генерира отговор. Подходът гарантира по-точно разбиране на контекста, но създава характерна пауза преди отговора, която нарушава естествения ритъм на разговора.
ChatGPT използва различен подход - т. нар. „дуплексна" (full-duplex) архитектура, която позволява едновременна обработка на входящия аудио поток и генериране на отговор в реално време. Това дава възможност асистентът да потвърждава разбиране или да дава кратки отговори по време на изказването, както и да бъде прекъсван по средата на изречението при промяна на въпроса.
Ограничението на поредната архитектура на Claude води до специфичен проблем - системата понякога бърка кратка пауза в речта с края на изказването и започва да отговаря преждевременно. Тъй като моделът не може да „чува" и „говори" едновременно, той трябва да реши кога да спре слушането, а естествените паузи могат да доведат до преждевременно прекъсване.
За да избегне проблема, Anthropic препоръчва потребителите да адаптират начина си на комуникация - вместо сложни въпроси с няколко части наведнъж, е по-добре те да се задават последователно. Така Claude обработва всяка част поред, без риск от объркване или преждевременно прекъсване, което осигурява по-точни отговори.
Избор на модели
Потребителите на Claude могат да избират между различни модели чрез менюто в долната част на интерфейса на приложението, като всеки модел е оптимизиран за конкретни задачи. В момента са налични три основни варианта - Haiku, Sonnet и Opus.
Haiku е най-бързият модел, подходящ за ситуации с нужда от незабавен отговор - кратки въпроси и задачи с минимално време за обработка. Sonnet предлага най-доброто съотношение между скорост и качество и е ефективен за ежедневни задачи като писане на имейли, обобщаване на текстове и стандартни анализи.
Opus е най-мощният модел, предназначен за сложни задачи, изискващи задълбочено разбиране и висока точност. Той е достъпен единствено за платени акаунти и е подходящ за професионални приложения, като програмиране, научни изследвания и създаване на дълги структурирани документи.
Използване на свързани приложения
Подобно на текстовия чат, гласовият режим на Claude дава достъп до вече свързаните с асистента приложения и услуги. Потребителите могат да взаимодействат гласово с Gmail, Google Calendar, Slack и други платформи, като просто включат името на приложението в гласовата си подкана.
Например, Claude може да обобщи последните получени имейли или да информира за предстоящи събития в календара. При първо използване на дадено приложение асистентът иска разрешение за достъп, а след предоставяне на правата изпълнява свързаните задачи директно чрез гласови команди.
Промяна на гласа и езика
Гласовият режим на Claude вече поддържа 14 езика, като част от тях са налични и в регионални варианти. Изборът на език определя и наличните гласове - на английски потребителите разполагат с пет опции, докато за японски са налични само две.
Българският засега не е сред поддържаните езици за гласовия режим, което означава, че българските потребители трябва да разчитат на английски или друг наличен език за гласови команди. Anthropic продължава да разширява езиковата поддръжка на моделите си, така че добавянето на български в бъдещите актуализации е напълно възможно.
Промяната на глас и език става през страницата „Настройки", секция „Глас" в раздел „Приложение", където се избират предпочитан език и глас. Същата секция позволява и регулиране на скоростта на речта между опциите „Бавно", „Нормално" и „Бързо".
Специфична особеност е, че гласовият режим на Claude не разпознава автоматично смяната на езика в средата на изречението. Потребителите трябва предварително да заявят гласово новия език или да го променят от менюто „Настройки".
Anthropic предлага два начина за записване на гласови команди — „Свободни ръце" (Hands free) и „Натисни, за да говориш" (Push to talk). При режим „Свободни ръце" Claude слуша непрекъснато и реагира на естествените паузи в речта, като е подходящ за тиха среда. При режим „Натисни, за да говориш" потребителят задържа бутон по време на записа, което осигурява по-прецизен контрол в по-шумна обстановка.
Изборът между двата режима зависи от конкретната ситуация - дали потребителят предпочита удобството на свободните ръце, или по-голям контрол върху записа.
Нужен ли е платен акаунт за Claude Voice
Не е необходим абонамент „Pro" или „Max" за използване на Claude Voice, но Anthropic ограничава безплатните акаунти до модела Haiku и до една връзка с външно приложение или услуга. За достъп до по-мощните Sonnet или Opus, е необходим платен абонамент. А разговорите през гласовия режим се отчитат към общите лимити за използване на услугата.
С въвеждането му Claude се присъединява към други AI асистенти като ChatGPT, Google Gemini и Apple Siri, които вече предлагат подобна функционалност, разширявайки достъпността и удобството за потребителите. Очаква се с бъдещи актуализации Anthropic да разшири както езиковата поддръжка, така и възможностите за по-плавна, дуплексна комуникация, за да отговори на конкуренцията в сектора.





Коментари
Моля, регистрирайте се от TУК!
Ако вече имате регистрация, натиснете ТУК!
Няма коментари към тази новина !
Последни коментари