Google a présenté son nouveau modèle d’intelligence artificielle, Gemini 3, en promettant des améliorations significatives, allant de la génération de code à la réalisation de visualisations 3D interactives. Toutefois, comme souvent, il convient de rester prudent quant aux attentes générées par ces annonces.

La famille Gemini 3 a été annoncée cette semaine, avec le modèle phare Gemini 3 Pro, le premier à être mis à la disposition des utilisateurs. Celui-ci est censé offrir des améliorations notables en matière de raisonnement et de pertinence de ses réponses par rapport aux versions précédentes de Google.

Parmi les améliorations les plus attendues se trouvent Canvas, l’atelier intégré à l’application Gemini, permettant d’interagir avec le chatbot pour générer du code et visualiser les résultats. Google affirme que Gemini 3 peut traiter simultanément divers types de contenus, notamment des textes, des images et des vidéos, et qu’il est capable de répondre à des demandes plus complexes.

Pour mes premiers tests, j’ai demandé à Gemini 3 de créer une visualisation 3D comparant la taille d’une particule subatomique, d’un atome, d’une molécule d’ADN, d’un ballon de plage, de la Terre, du Soleil et de la galaxie.

Le modèle a réussi à produire une visualisation interactive, tranchant entre chaque élément de façon logique depuis la particule jusqu’à l’univers. Toutefois, la qualité des images n’a pas toujours été à la hauteur des attentes, notamment pour les modèles de l’ADN et du ballon de plage.

J’ai également testé une demande similaire concernant un aigle en voxel sur une branche d’arbre. Bien que le résultat soit satisfaisant, il était évident que certains détails, tels que les yeux de l’aigle, manquaient, et d’autres objets étaient assez rudimentaires.

Gemini 3 ne se limite pas à la modélisation ; Google teste aussi une nouvelle fonctionnalité de “générateur d’interface utilisateur” pour les abonnés Pro, permettant de présenter des réponses sous forme de page web dynamique. En demandant un itinéraire pour un voyage de trois jours à Rome, Gemini 3 a produit une page personnalisée proposant différents ajustements, comme le rythme du séjour ou les préférences culinaires.

Une des autres innovations de Gemini est Gemini Agent, une fonction permettant d’effectuer des tâches pour l’utilisateur, comme organiser la boite mail. J’ai demandé à cet assistant de trier mes courriels, et il a présenté des résultats intéressants, identifiant des emails non lus et offrant de les organiser.

Dans l’ensemble, malgré quelques problèmes techniques lors de la réalisation de tâches, les fonctionnalités de visualisation et d’interaction de Gemini 3 se révèlent prometteuses. Toutefois, pour la plupart des utilisateurs comme moi, qui recherchent notamment des réponses informatives sans la forme interactive, Gemini reste un outil intéressant mais pas indispensable au quotidien.