
I Tested AI on Work That Actually Matters
AI Summary
L'IA devient passionnante à mesure que les grandes entreprises rivalisent pour conquérir les consommateurs avec des produits "agentiques". Après l'arrivée de Claude Cowork et le récent lancement de Gemini Spark, ChatGPT propose désormais également son propre outil. Ce comparatif se penche sur l'utilisation quotidienne de ces trois agents IA : ChatGPT Cowork, Gemini Spark et Claude Cowork, en se basant sur des cas d'usage concrets et récurrents pour une entreprise.
La méthodologie repose sur quatre scénarios principaux : la synthèse de transcriptions de réunions en plans d'action, l'analyse de documents d'entreprise pour en extraire des informations clés, l'analyse de retours clients et l'aide à la gestion du support client, ainsi que la gestion des emails pour un résumé quotidien des actions à entreprendre. Trois outils sont comparés : ChatGPT Cowork (le moins cher, mais avec des limitations), Claude Cowork (20$/mois) et Gemini Spark (accessible aux abonnés Ultra à 100$/mois). Pour chaque test, le modèle le plus performant de chaque plateforme est utilisé.
Le premier cas d'usage, la synthèse de transcriptions de réunions, voit ChatGPT se démarquer par sa complétude et son détail. Il identifie avec précision les décisions clés, les actions à entreprendre, les blocages, les suivis par email et propose un résumé Slack. Il a même la capacité de signaler les propriétaires implicites d'actions nécessitant confirmation, offrant une grande fiabilité. Claude est plus concis, tandis que Gemini est plus direct mais moins "embelli".
Concernant l'analyse de documents d'entreprise ("Business DNA"), tous les outils répondent correctement aux questions sur le produit principal. Cependant, pour les résultats attendus par les clients et les prochaines étapes pratiques, Claude propose une approche axée sur l'intégration et l'expérience utilisateur, tandis que ChatGPT est plus granulaire et orienté action. Gemini suggère également des étapes pratiques, mais celles de Claude sont jugées plus pertinentes.
L'analyse des retours clients met en évidence la capacité de ChatGPT à transformer les feedbacks en un plan d'action clair et décisionnel. Claude excelle dans la compréhension de la psychologie des membres et propose des solutions concrètes, mais peut parfois faire des suppositions. Gemini, bien que poli, semble trop axé sur des aspects techniques et moins sur l'expérience utilisateur. Dans ce cas, ChatGPT est jugé le plus efficace pour transformer les données en actions concrètes.
Enfin, la gestion des emails via une connexion Gmail montre que Claude est le plus concis et filtre le mieux les informations pertinentes pour un résumé quotidien. ChatGPT est également performant, incluant des alertes de sécurité et de facturation, tandis que Gemini, bien qu'ayant accès à Gmail, est jugé moins performant et nécessite plus de nettoyage.
L'analyse globale, y compris une évaluation par un modèle Claude, conclut que ChatGPT est le gagnant pour le travail quotidien, se distinguant par sa fiabilité, son suivi précis des instructions et son jugement de sécurité. Claude est le second, particulièrement fort pour la communication et la narration. Gemini est jugé compétent, mais nécessite une refonte. Le coût de 100$ pour Gemini n'est pas jugé justifié pour une utilisation quotidienne.
Une brève mention est faite du lancement par OpenAI de son premier produit matériel, le Codex Micro, un appareil semblable à un Stream Deck pour des actions liées à l'IA. En conclusion, l'auteur continuera d'utiliser une combinaison de ChatGPT Cowork et Claude Cowork pour ses besoins quotidiens.