Quelqu’un a optimisé le MiniCPM5-1B d’OpenBMB sur les traces de « Claude Fable 5 » afin de produire un système de réflexion local de 657 Mo.

Quelqu'un a optimisé le MiniCPM5-1B d'OpenBMB sur les traces de « Claude Fable 5 » afin de produire un système de réflexion local de 657 Mo.

Cette semaine apporte son nouveau chapitre dans le grand livre de l’IA. Quelqu’un a optimisé le MiniCPM5-1B d’OpenBMB sur les traces de « Claude Fable 5 » afin de produire un système de réflexion local de 657 Mo. Un développeur de la communauté, GnLOLot, a publié un modèle 1B fonctionnant entièrement sur du matériel local. … Lire la suite

Le « Thinking Machines Lab » de Mira Murati présente les arguments techniques en faveur d’une IA centrée sur l’humain, reposant sur des poids de modèles personnalisables

Le « Thinking Machines Lab » de Mira Murati présente les arguments techniques en faveur d'une IA centrée sur l'humain, reposant sur des poids de modèles personnalisables

Le secteur de l’IA vient d’être le théâtre d’un développement notable. Le « Thinking Machines Lab » de Mira Murati présente les arguments techniques en faveur d’une IA centrée sur l’humain, reposant sur des poids de modèles personnalisables Thinking Machines Lab a publié un rapport visant à développer une IA qui prolonge la volonté et … Lire la suite

Interfaze lance « diffusion-gemma-asr-small », un système ASR open source basé sur la diffusion, capable de transcrire six langues grâce au décodeur à débruitage parallèle de DiffusionGemma.

Interfaze lance « diffusion-gemma-asr-small », un système ASR open source basé sur la diffusion, capable de transcrire six langues grâce au décodeur à débruitage parallèle de DiffusionGemma.

Une évolution notable vient d’être rendue publique dans le domaine. Interfaze lance « diffusion-gemma-asr-small », un système ASR open source basé sur la diffusion, capable de transcrire six langues grâce au décodeur à débruitage parallèle de DiffusionGemma. Interfaze, une jeune start-up issue du programme Y Combinator, a mis en open source un nouveau modèle de … Lire la suite

Liquid AI lance la version LFM2.5-230M avec prise en charge de llama.cpp, MLX, vLLM, SGLang et ONNX pour l’inférence sur appareil

Liquid AI lance la version LFM2.5-230M avec prise en charge de llama.cpp, MLX, vLLM, SGLang et ONNX pour l'inférence sur appareil

Les dernières heures ont apporté leur lot d’informations dans l’écosystème IA. Liquid AI lance la version LFM2.5-230M avec prise en charge de llama.cpp, MLX, vLLM, SGLang et ONNX pour l’inférence sur appareil Le plus petit modèle de Liquid AI à ce jour fonctionne à une vitesse de 213 tokens par seconde sur un Galaxy S25 … Lire la suite

Mira Murati revient prudemment sous les feux de la rampe | TechCrunch

Mira Murati revient prudemment sous les feux de la rampe | TechCrunch

L’actualité tech du jour met en lumière un développement significatif. Mira Murati revient prudemment sous les feux de la rampe | TechCrunch Mira Murati n’est pas vraiment à l’aise sur les podiums des conférences. En tant que directrice technique d’OpenAI, elle était présente, cependant elle était rarement le visage public de l’entreprise. En tant que … Lire la suite

NVIDIA AI lance Nemotron 3 Ultra : un modèle hybride Mamba-Transformer « Mixture-of-Experts » ouvert de 550 milliards de paramètres, destiné aux agents à exécution longue

NVIDIA AI lance Nemotron 3 Ultra : un modèle hybride Mamba-Transformer « Mixture-of-Experts » ouvert de 550 milliards de paramètres, destiné aux agents à exécution longue

Un nouveau jalon vient d’être franchi dans l’univers de l’intelligence artificielle. NVIDIA AI lance Nemotron 3 Ultra : un modèle hybride Mamba-Transformer « Mixture-of-Experts » ouvert de 550 milliards de paramètres, destiné aux agents à exécution longue NVIDIA a lancé Nemotron 3 Ultra, le plus grand modèle de sa gamme Nemotron 3. Il vise à … Lire la suite

Découvrez OpenJarvis : un framework axé sur le local pour les agents IA personnels embarqués, doté d’outils, d’une mémoire et de capacités d’apprentissage

Découvrez OpenJarvis : un framework axé sur le local pour les agents IA personnels embarqués, doté d'outils, d'une mémoire et de capacités d'apprentissage

Un nouveau jalon vient d’être franchi dans l’univers de l’intelligence artificielle. Découvrez OpenJarvis : un framework axé sur le local pour les agents IA personnels embarqués, doté d’outils, d’une mémoire et de capacités d’apprentissage Des chercheurs de l’université de Stanford et de Lambda Labs ont publié un article de recherche consacré à OpenJarvis, un framework … Lire la suite

Comment affiner LFM2 à l’aide de QLoRA et DPO : un didacticiel de codage complet étape par étape sur Google Colab

Comment affiner LFM2 à l'aide de QLoRA et DPO : un didacticiel de codage complet étape par étape sur Google Colab

L’industrie de l’IA poursuit sa transformation rapide avec cette nouvelle annonce. Comment affiner LFM2 à l’aide de QLoRA et DPO : un didacticiel de codage complet étape par étape sur Google Colab Dans ce didacticiel, nous affinons le système LFM2 de Liquid AI via un flux de travail open source complet. Nous commençons par charger le … Lire la suite

Les LLM croient aux fausses déclarations même après des avertissements explicites indiquant qu’elles sont fausses

Les LLM croient aux fausses déclarations même après des avertissements explicites indiquant qu'elles sont fausses

Un développement récent dans le monde de l’IA attire l’attention. Les LLM croient aux fausses déclarations même après des avertissements explicites indiquant qu’elles sont fausses Les tests de mise au point montrent « un biais… en faveur d’une représentation sûre des affirmations comme étant vraies ». Imaginez un enfant qui grandit en lisant des livres … Lire la suite

MEMO : un cadre modulaire pour former un modèle de mémoire dédié sur de nouvelles connaissances sans modifier les paramètres LLM

MEMO : un cadre modulaire pour former un modèle de mémoire dédié sur de nouvelles connaissances sans modifier les paramètres LLM

Un acteur majeur du secteur vient de faire parler de lui. MEMO : un cadre modulaire pour former un modèle de mémoire dédié sur de nouvelles connaissances sans modifier les paramètres LLM Les grands modèles de langage deviennent statiques après la pré-formation. Leurs connaissances ne s’actualisent pas à mesure que le monde change. Le recyclage d’un LLM … Lire la suite