I/O 2025 : Google dévoile son futur IA

La conférence annuelle Google I/O, la grand-messe des développeurs et passionnés de technologie, a tenu toutes ses promesses aujourd’hui, dévoilant une feuille de route ambitieuse où l’intelligence artificielle n’est plus seulement une fonctionnalité, mais le moteur de l’innovation. De la génération de contenu à la facilitation du quotidien, en passant par des avancées fondamentales et l’intégration profonde dans le matériel, Google a positionné l’IA au centre de son écosystème, avec des annonces qui marqueront sans doute l’année technologique.

Peut-être l’annonce la plus engageante pour le grand public a été Gemini Live. Cette nouvelle fonctionnalité de l’assistant Gemini transforme l’interaction vocale avec l’IA en une conversation fluide, bidirectionnelle et incroyablement naturelle. Fini les interruptions rigides ; vous pouvez parler, couper la parole à Gemini, et il s’adaptera. Mais la véritable rupture réside dans ses capacités multimodales en temps réel : partage de la caméra et de l’écran. Imaginez pointer votre téléphone vers une plante pour en connaître le nom, montrer un plat pour obtenir une recette, ou partager votre écran pour des conseils d’organisation. Gemini Live promet de devenir un véritable copilote visuel et vocal pour le quotidien, capable même, à terme, de passer des appels en votre nom. Gemini Live est disponible sur iOS et Android, dès maintenant.

Pour les créateurs et les cinéastes, Veo 3 est l’annonce qui fait saliver. Le nouveau modèle de génération de vidéo de DeepMind ne se contente plus de créer des séquences visuelles époustouflantes ; il y intègre désormais de l’audio synchronisé. Effets sonores, bruits d’ambiance et même dialogues peuvent être générés et parfaitement calés sur l’image, marquant une étape majeure vers la création de productions audiovisuelles entièrement synthétiques et immersives. Couplé à Flow, le nouvel outil de « réalisation de films » par IA, Veo 3 promet de transformer l’industrie, en permettant aux créateurs de se concentrer sur la vision artistique tandis que l’IA gère les subtilités techniques du rendu et de la synchronisation. L’accès anticipé pour les abonnés Gemini Ultra souligne son caractère premium.

Impressionnant aussi est Imagen 4, la dernière itération du modèle de génération d’images de Google. Au-delà des améliorations habituelles en matière de réalisme et de qualité, Imagen 4 se distingue par sa capacité à intégrer du texte avec une précision étonnante dans les images générées, un véritable atout pour la création de contenu graphique, les enseignes virtuelles ou les infographies. Sa disponibilité immédiate dans Gemini, Whisk et les outils Workspace comme Slides et Docs promet de démocratiser la création visuelle assistée par IA, rendant la conception graphique de haute volée accessible à tous. Une version « rapide » annoncée pour l’avenir, dix fois plus véloce qu’Imagen 3, laisse entrevoir des workflows créatifs d’une fluidité inédite.

Au-delà des modèles spécifiques, Google a offert un aperçu fascinant de l’avenir de l’IA avec Project Astra. Il ne s’agit pas d’un simple chatbot, mais d’un véritable « agent universel » capable de raisonner, d’apprendre et de se souvenir de son environnement via les flux d’informations qu’il reçoit. La démonstration a montré un agent capable de comprendre ce qu’il voit et entend en temps réel via la caméra d’un téléphone ou de lunettes intelligentes, d’identifier des objets, de résoudre des problèmes complexes et de répondre à des questions avec un contexte visuel et auditif. Project Astra représente l’ambition de Google de créer une IA véritablement consciente de son environnement, prête à devenir un assistant omniprésent et proactif dans notre vie quotidienne.

L’engagement de Google envers l’IA embarquée sur les appareils s’est manifesté avec l’annonce de la capacité multimodale de Gemini Nano sur les téléphones Pixel. Jusqu’à présent optimisé pour les tâches textuelles en local (résumés, suggestions), Gemini Nano est désormais capable de traiter des informations audio et visuelles directement sur l’appareil. Cela signifie que des fonctionnalités IA avancées, comme la détection d’appels frauduleux complexes ou la compréhension contextuelle d’images ou de sons, pourront s’exécuter sans envoyer de données vers le cloud. C’est un pas crucial vers des assistants IA plus rapides, plus privés et plus résilients, libérés des contraintes de connectivité et de latence.

La recherche Google, pierre angulaire de l’entreprise, n’a pas été en reste. Un nouveau « AI Mode » a été annoncé pour Google Search aux États-Unis, promettant de transformer la manière dont nous obtenons des informations. Plutôt que de simplement afficher une liste de liens, ce mode permettra à l’IA de synthétiser des réponses complexes et personnalisées directement à partir de multiples sources. Cette intégration profonde de l’IA dans l’expérience de recherche vise à fournir des résumés plus intelligents, des comparaisons détaillées et des réponses directes à des questions complexes, réduisant le besoin de naviguer entre plusieurs pages web. Une évolution majeure qui pourrait redéfinir l’accès à l’information.

Dans un monde de plus en plus connecté, la communication sans frontières est essentielle. Google a franchi une étape significative en intégrant la traduction simultanée en temps réel à Google Meet. Cette fonctionnalité révolutionnaire permet aux participants de conférences vidéo de communiquer dans leur propre langue, l’IA traduisant et transcrivant instantanément les propos des autres participants. Plus qu’une simple traduction de texte, cette technologie vise à rendre les échanges multilingues aussi fluides que des conversations monolingues, ouvrant des perspectives inédites pour la collaboration internationale et la communication interculturelle dans les contextes professionnels et éducatifs.

Toutes ces avancées ne sont pas sans un coût pour les utilisateurs les plus exigeants. Google a officialisé son forfait AI Ultra, un abonnement premium à 250 $ US par mois (avec une offre de lancement pour les trois premiers mois). Ce « VIP pass » donne accès aux modèles d’IA les plus puissants (dont Gemini 2.5 Pro Deep Think et Veo 3), à des limites d’utilisation étendues pour Flow et Whisk, à un stockage cloud de 30 To, à YouTube Premium, et surtout, à un accès anticipé à des fonctionnalités révolutionnaires comme le mode Agent (Project Mariner), capable d’exécuter des tâches complexes en plusieurs étapes à travers les applications. À noter que le forfait Google AI Pro, anciennement connu sous le nom de Google AI Premium, reste disponible à 19,99 $ US par mois et offre déjà un accès substantiel à Gemini Advanced et à d’autres outils d’IA. Le forfait AI Ultra se positionne donc comme une solution pour les utilisateurs ayant des besoins extrêmes en puissance et en accès privilégié. Le forfait AI Ultra positionne clairement Google dans une stratégie de monétisation agressive de son leadership en IA, visant les professionnels et les créateurs de contenu intensifs.

À l’occasion de sa conférence I/O, Google a annoncé un partenariat avec Xreal pour lancer Project Aura, une nouvelle paire de lunettes intelligentes reposant sur Android XR. Contrairement aux casques immersifs comme le Vision Pro, Aura adopte un format plus léger, proche des lunettes de soleil, avec affichage immersif en surimpression du monde réel. Dotées de caméras, micros et d’une puce Qualcomm optimisée pour la XR, elles intègrent aussi l’IA Gemini de Google. Ce partenariat s’inscrit dans une approche similaire à celle de Wear OS : Google fournit la plateforme, Xreal le matériel. Le lancement est prévu plus tard, mais les développeurs peuvent déjà créer des applications compatibles. Un retour stratégique pour Google dans les lunettes connectées.

La Google I/O 2025 a été une démonstration de la vision de Google : une intelligence artificielle omniprésente, intuitive et transformative. De la créativité assistée à l’interaction vocale en temps réel, en passant par la production audiovisuelle révolutionnaire, les agents intelligents embarqués, une recherche web réinventée et la communication sans frontières, l’entreprise de Mountain View ne se contente pas de suivre la course à l’IA ; elle en redéfinit les règles du jeu. Reste à voir comment ces innovations impacteront concrètement nos vies et nos métiers dans les mois et années à venir.

+++
Pour ceux qui veulent une version NotebookLM de cette article :

+++

Tous les jours de la semaine, du lundi au vendredi, Bruno Guglielminetti vous propose un regard sur l’essentiel de l’actualité numérique avec 120 secondes de tech


En savoir plus sur Mon Carnet

Subscribe to get the latest posts sent to your email.

Laisser un commentaire