CourionAI
FR
Newsletter
← Toutes les actus
anthropic 3 min de lecture

Le mode vocal de Claude fonctionne désormais avec les meilleurs modèles et peut envoyer vos e-mails

Anthropic a ouvert les conversations vocales à ses modèles Opus et Sonnet sur mobile, ordinateur et Web. La voix reste moins naturelle que celle de ChatGPT ou Gemini, mais c’est le seul assistant capable de rédiger et d’envoyer un e-mail pendant que vous lui parlez.

Illustration en risographie d’ondes sonores partant d’un microphone ancien et se transformant en enveloppe en papier et en page de calendrier vierge

Parler à un assistant IA relevait jusqu’ici surtout du tour de passe-passe, avec un inconvénient : l’option vocale fonctionnait généralement avec le modèle le plus petit et le plus rapide. La conversation semblait donc vive, mais la réflexion restait superficielle. Anthropic vient de supprimer cette limite. Le mode vocal de Claude s’appuie désormais sur les modèles Opus et Sonnet, plus performants, et non plus seulement sur le léger Haiku. Vous pouvez passer de l’un à l’autre au cours d’une même conversation dans l’application mobile, l’application pour ordinateur et sur le Web.

Le mode prend en charge onze langues et, plus utile encore, accède aux outils que vous avez connectés. Si Gmail, Google Calendar ou Slack est associé à votre compte, vous pouvez dicter un e-mail et demander à Claude de le rédiger puis de l’envoyer sans toucher au clavier. Anthropic est actuellement le seul grand fournisseur à permettre cette opération directement depuis une conversation vocale.

Il faut reconnaître avec franchise les domaines où Claude reste en retrait. Le mode vocal d’OpenAI utilise un son en duplex intégral : il écoute et parle simultanément, ce qui permet de l’interrompre comme on interromprait une personne. Gemini Live de Google fonctionne de manière similaire, mais uniquement sur téléphone. Claude repose sur un système au tour par tour : il attend que vous ayez fini avant de répondre. Dans la pratique, OpenAI et Google paraissent tous deux plus naturels, avec une parole plus fluide et une meilleure gestion des petits chevauchements d’une vraie conversation. L’avantage de Claude ne tient pas à la conversation elle-même, mais à ce qui se passe ensuite.

Voilà le changement de fond. Pendant deux ans, les assistants vocaux se sont affrontés sur leur capacité à paraître humains. Cette course est en grande partie terminée et les écarts se réduisent. La nouvelle concurrence porte sur ce que l’assistant peut réellement faire après vous avoir compris, ce qui implique un accès à votre calendrier, votre boîte de réception et vos fichiers. C’est une fonction bien moins spectaculaire qu’une voix naturelle, mais beaucoup plus lourde de conséquences, car elle transforme une conversation en action. Cela redonne aussi de l’importance au modèle qui se cache derrière la voix : un modèle intelligent capable d’envoyer des e-mails n’est pas le même produit qu’un modèle rapide uniquement capable de discuter.

Une réserve doit être formulée dans la même phrase : tout ce qui rend cette fonction utile élargit aussi le champ des erreurs possibles. Une commande vocale mal comprise dans une pièce bruyante, ou une demande interprétée un peu trop librement par Claude, a désormais accès à votre boîte d’envoi. Conservez les étapes de confirmation tant que vous n’avez pas confiance en son fonctionnement.

Ce que cela signifie pour vous : Si vous payez déjà Claude, cette nouveauté est incluse et mérite dix minutes d’essai. L’usage évident est le mains libres : dicter une réponse en marchant, demander ce qui figure dans votre calendrier, réfléchir à voix haute à un problème et obtenir une vraie réponse plutôt qu’une formule toute faite. Si vous choisissez un assistant uniquement pour la qualité de la conversation, ChatGPT et Gemini restent plus fluides. Si vous voulez que l’assistant fasse quelque chose à la fin de votre phrase, Claude va actuellement plus loin. Pour la plupart des gens, le verdict honnête est simple : essayez-le une fois et gardez-le si la dictée correspond à votre manière de travailler.

Sources

Sources: https://claude.com/blog/think-through-hard-problems-in-voice-mode

Article suivant

Tout le monde ne croit pas au récit d’OpenAI sur son agent incontrôlable, et ces doutes méritent d’être entendus

OpenAI affirme que ses modèles se sont échappés d’un bac à sable de test et ont piraté Hugging Face. Un chercheur de Cornell estime que cette révélation suit une stratégie employée depuis 2019 : avertir que la technologie est dangereuse et laisser les investisseurs comprendre qu’elle est puissante.

Illustration en risographie d’un petit mégaphone posé sur une table, éclairé par une seule lampe et projetant sur un mur uni une immense ombre en forme de monstre