Le mode vocal de Claude s'étend à Opus et Sonnet sur mobile, ordinateur et web
Points clés
- •Anthropic a étendu le mode vocal de Claude pour fonctionner sur ses modèles Opus et Sonnet, alors que la fonctionnalité était auparavant restreinte au modèle Haiku.
- •Les utilisateurs peuvent passer d'un modèle à un autre en pleine conversation vocale sur les interfaces mobile, ordinateur et web de Claude.
- •Le mode vocal de Claude prend en charge onze langues et s'intègre à des services connectés, notamment Gmail, Google Calendar et Slack, pour permettre l'accomplissement de tâches à la voix.
- •Claude utilise un modèle d'interaction par tours, contrairement au GPT-Live d'OpenAI en duplex intégral, qui peut écouter et parler simultanément.
- •Anthropic est actuellement le seul fournisseur parmi Anthropic, OpenAI et Google à permettre aux utilisateurs de composer et d'enregistrer un e-mail directement depuis le mode audio.

Anthropic a étendu le mode vocal de Claude afin qu'il puisse fonctionner sur les modèles Opus et Sonnet, plus performants de l'entreprise, au lieu d'être limité à Haiku. La fonctionnalité est disponible sur l'application mobile, l'application ordinateur et le chat web de Claude, et les utilisateurs peuvent changer de modèle en pleine conversation. Comme Opus et Sonnet offrent un raisonnement plus puissant que Haiku, ce changement apporte le mode vocal à des tâches qui bénéficient d'une analyse plus approfondie.
La mise à jour élargit l'utilisation de l'interaction vocale dans Claude au-delà du modèle léger le plus rapide d'Anthropic. Selon les supports d'Anthropic sur le mode vocal de Claude consultables à l'adresse claude.com/blog/think-through-hard-problems-in-voice-mode, le mode est conçu pour des conversations parlées avec l'assistant et peut se connecter aux outils pris en charge lorsque ces intégrations sont activées.
Le mode vocal de Claude prend en charge onze langues. Il peut également fonctionner avec des services connectés tels que Gmail, Google Calendar et Slack, permettant aux utilisateurs d'accomplir des tâches à la voix, y compris composer et envoyer des e-mails. La voix est devenue un terrain de concurrence entre les fournisseurs d'IA, chacun poursuivant un modèle d'interaction différent.
Les principaux assistants vocaux d'Anthropic, d'OpenAI et de Google utilisent des modèles d'interaction différents. Le GPT-Live d'OpenAI utilise l'audio en duplex intégral, ce qui signifie qu'il peut écouter et parler en même temps. Claude utilise une approche par tours qui attend que l'utilisateur ait fini de parler avant de répondre. Le Gemini Live de Google suit un schéma similaire par tours, mais est limité aux smartphones.
En pratique, OpenAI et Google peuvent sembler plus naturels grâce à leur traitement de la parole. Les trois systèmes gèrent bien les recherches vocales. La caractéristique distinctive de Claude est son intégration d'outils : Anthropic est actuellement le seul fournisseur parmi les trois qui permet aux utilisateurs de composer et d'enregistrer un e-mail directement depuis le mode audio. Alors que ces fournisseurs continuent d'itérer, le compromis entre le naturel conversationnel et la productivité connectée aux outils reste une distinction déterminante sur le marché des assistants vocaux.