Toutes les nouveautés à venir pour Muse, l’agent IA de Meta | TechCrunch

Toutes les nouveautés à venir pour Muse, l'agent IA de Meta | TechCrunch

Le paysage de l’intelligence artificielle s’enrichit d’une nouveauté significative. Toutes les nouveautés à venir pour Muse, l’agent IA de Meta | TechCrunch Muse, l’agent IA personnel de Meta, n’existe que depuis quelques semaines, et le géant des réseaux sociaux ne perd pas de temps pour développer ce qui pourrait bien être son plus grand pari … Lire la suite

Z.ai lance GLM-5.3-Flash : un modèle MoE multimodal natif de 320 milliards de paramètres et 18 milliards de mots, doté d’un contexte de 1 million de tokens

Z.ai lance GLM-5.3-Flash : un modèle MoE multimodal natif de 320 milliards de paramètres et 18 milliards de mots, doté d'un contexte de 1 million de tokens

Le secteur technologique continue de livrer des avancées remarquables. Z.ai lance GLM-5.3-Flash : un modèle MoE multimodal natif de 320 milliards de paramètres et 18 milliards de mots, doté d’un contexte de 1 million de tokens Z.ai a lancé GLM-5.3-Flash, le premier modèle d’IA multimodal natif de la série GLM-5 et le modèle de codage … Lire la suite

Generalist AI lance GEN-1.5 : un modèle de base pour robots capable d’apprendre de nouvelles tâches à partir d’une seule démonstration de 3 à 12 secondes

Generalist AI lance GEN-1.5 : un modèle de base pour robots capable d'apprendre de nouvelles tâches à partir d'une seule démonstration de 3 à 12 secondes

Un pas supplémentaire vient d’être franchi dans cette révolution technologique en cours. Generalist AI lance GEN-1.5 : un modèle de base pour robots capable d’apprendre de nouvelles tâches à partir d’une seule démonstration de 3 à 12 secondes Generalist AI a lancé GEN-1.5, un modèle de base pour robots capable d’apprendre une nouvelle tâche physique … Lire la suite

Mise en œuvre d’un pipeline de génération multimodale de vidéo et d’audio MiniMax-H3 à l’aide des API ComfyUI

Mise en œuvre d'un pipeline de génération multimodale de vidéo et d'audio MiniMax-H3 à l'aide des API ComfyUI

Un pas supplémentaire vient d’être franchi dans cette révolution technologique en cours. Mise en œuvre d’un pipeline de génération multimodale de vidéo et d’audio MiniMax-H3 à l’aide des API ComfyUI Dans ce tutoriel, nous mettons en œuvre un workflow complet de génération de vidéos MiniMax-H3 en utilisant ComfyUI comme backend d’inférence sans interface graphique. Nous … Lire la suite

RAG « pixel-native » : guide pratique de l’indexation visuelle des documents

RAG « pixel-native » : guide pratique de l'indexation visuelle des documents

Une évolution notable vient d’être rendue publique dans le domaine. RAG « pixel-native » : guide pratique de l’indexation visuelle des documents Dans ce tutoriel, nous construisons de A à Z un pipeline complet de génération augmentée par la recherche, natif pour Pixel, et nous examinons comment fonctionne la recherche de documents sans recourir à … Lire la suite

PolyAI lance Dialog-RSN-1 : un modèle de dialogue natif audio qui intègre la gestion des tours de parole, la reconnaissance vocale, l’appel de fonctions et la réponse

PolyAI lance Dialog-RSN-1 : un modèle de dialogue natif audio qui intègre la gestion des tours de parole, la reconnaissance vocale, l'appel de fonctions et la réponse

Une évolution notable vient d’être rendue publique dans le domaine. PolyAI lance Dialog-RSN-1 : un modèle de dialogue natif audio qui intègre la gestion des tours de parole, la reconnaissance vocale, l’appel de fonctions et la réponse PolyAI a lancé Dialog-RSN-1, un système de dialogue qui perçoit directement le son de l’appelant au lieu de … Lire la suite

Google dévoile Gemini Robotics 2.0, qui promet une dextérité et une sécurité accrues

Google dévoile Gemini Robotics 2.0, qui promet une dextérité et une sécurité accrues

Le domaine de l’IA connaît encore aujourd’hui une évolution intéressante. Google dévoile Gemini Robotics 2.0, qui promet une dextérité et une sécurité accrues La gamme Gemini Robotics 2 comprend trois modèles, mais un seul est actuellement disponible à la vente. De plus, les robots équipés des modèles d’IA Gemini de Google sont désormais plus performants. … Lire la suite

Google dévoilement Gemini 3.6 Flash et une IA dédiée à la cybersécurité, et donne un avant-goût de Gemini 3.5 Pro et Gemini 4

Google dévoilement Gemini 3.6 Flash et une IA dédiée à la cybersécurité, et donne un avant-goût de Gemini 3.5 Pro et Gemini 4

Voici une annonce qui mérite l’attention des observateurs du secteur. Google dévoilement Gemini 3.6 Flash et une IA dédiée à la cybersécurité, et donne un avant-goût de Gemini 3.5 Pro et Gemini 4 Il existe aujourd’hui de nouveaux modèles 3.6 et 3.5, mais Google est déjà en train d’entraîner Gemini 4. En parallèle, google a … Lire la suite

Google Vids vous rend possible désormais de jouer les vedettes dans vos propres vidéos générées par l’IA | TechCrunch

Google Vids vous rend possible désormais de jouer les vedettes dans vos propres vidéos générées par l'IA | TechCrunch

Les dernières heures ont apporté leur lot d’informations dans l’écosystème IA. Google Vids vous rend possible désormais de jouer les vedettes dans vos propres vidéos générées par l’IA | TechCrunch Les services Soramay d’OpenAI ont peut-être fermé leurs portes, toutefois Google semble penser qu’il existe toujours un intérêt pour un solution permettant de jouer le … Lire la suite

Thinking Machines Lab lance Inkling : un modèle MoE multimodal à poids ouverts comportant 975 milliards de paramètres, dont 41 milliards de paramètres actifs, et dont l’effort de réflexion est contrôlable

Thinking Machines Lab lance Inkling : un modèle MoE multimodal à poids ouverts comportant 975 milliards de paramètres, dont 41 milliards de paramètres actifs, et dont l'effort de réflexion est contrôlable

Un développement récent dans le monde de l’IA attire l’attention. Thinking Machines Lab lance Inkling : un modèle MoE multimodal à poids ouverts comportant 975 milliards de paramètres, dont 41 milliards de paramètres actifs, et dont l’effort de réflexion est contrôlable Thinking Machines Lab vient de lancer Inkling, son premier système entraîné à partir de … Lire la suite