Quelques semaines après qu'OpenAI a dévoilé une nouvelle famille de modèles conversationnels et mis à jour le mode vocal de ChatGPT, son rival Anthropic riposte en rendant Claude plus convivial pour la voix avec une nouvelle mise à jour. L'entreprise a annoncé jeudi que les utilisateurs peuvent désormais choisir entre les modèles Opus, Sonnet et Haiku.

Le mode vocal de Claude, lancé l'année dernière et propulsé par le modèle Haiku, offrait des réponses rapides mais n'était pas adapté aux tâches complexes. Avec cette mise à jour, le mode vocal sélectionne le dernier modèle utilisé dans le chat textuel et utilise sa version la plus rapide par défaut.

Anthropic affirme que le nouveau mode vocal peut aider les utilisateurs dans des conversations plus longues, notamment en fournissant des retours sur leur style de communication, en discutant d'un argumentaire client ou en réfléchissant à une étude de marché produit.

De plus, le mode vocal de Claude peut interagir avec d'autres applications comme Gmail, Google Agenda, Slack, Canva et Notion. Ainsi, les utilisateurs peuvent lui demander de mettre à jour un créneau de réunion, rédiger un e-mail ou créer un document dans Notion. Notons que c'est une grande différence avec le mode vocal d'OpenAI, qui a amélioré son style conversationnel mais ne peut toujours pas utiliser différents outils pour accomplir des tâches.

Plus tôt cette année, Anthropic a ajouté la prise en charge multilingue au mode vocal de Claude en version bêta. Désormais, les utilisateurs peuvent parler dans plusieurs langues, mais doivent spécifier manuellement la langue. Actuellement, Anthropic prend en charge l'anglais, le français, l'allemand, l'hindi, l'indonésien, l'italien, le japonais, le coréen, le portugais (brésilien) et l'espagnol (Amérique latine/Espagne).

Le nouveau mode vocal est disponible pour tous les utilisateurs en version bêta sur toutes les plateformes. Cependant, les utilisateurs gratuits sont limités au modèle Haiku avec une seule application connectée.

Anthropic n'a apporté aucune modification au modèle vocal lui-même et n'a pas détaillé la pile vocale utilisée. Cela signifie que, contrairement à la version d'OpenAI, les utilisateurs ne trouveront peut-être pas d'améliorations conversationnelles comme une meilleure gestion des interruptions.