OpenAI lance LifeSciBench, un benchmark comprenant 750 tâches qui évalue les modèles d’IA sur des projets de recherche réels en sciences de la vie à l’aide d’une grille d’évaluation rédigée par des experts

OpenAI lance LifeSciBench, un benchmark comprenant 750 tâches qui évalue les modèles d'IA sur des projets de recherche réels en sciences de la vie à l'aide d'une grille d'évaluation rédigée par des experts

L’actualité tech du jour met en lumière un développement significatif. OpenAI lance LifeSciBench, un benchmark comprenant 750 tâches qui évalue les modèles d’IA sur des projets de recherche réels en sciences de la vie à l’aide d’une grille d’évaluation rédigée par des experts La plupart des tests de référence en biologie posent des questions précises, … Lire la suite

Présentation de LifeSciBench

Présentation de LifeSciBench

Voici une annonce qui mérite l’attention des observateurs du secteur. Présentation de LifeSciBench Un référentiel rédigé et évalué par des experts, fondé sur la exploration concrète en sciences de la vie Les systèmes d’IA agentique sont de plus en plus capables d’effectuer des tâches scientifiques. Cependant, leur utilité pour les scientifiques en sciences de la … Lire la suite

Comment créer des modèles Transformers économes en mémoire avec xFormers à l’aide de séquences compactées, de GQA, d’ALiBi, de SwiGLU et de l’attention causale

Comment créer des modèles Transformers économes en mémoire avec xFormers à l'aide de séquences compactées, de GQA, d'ALiBi, de SwiGLU et de l'attention causale

Voici une information qui pourrait bien avoir un impact durable sur le secteur. Comment créer des modèles Transformers économes en mémoire avec xFormers à l’aide de séquences compactées, de GQA, d’ALiBi, de SwiGLU et de l’attention causale Dans ce tutoriel, nous mettons en œuvre xFormers : une boîte à outils pratique permettant de créer des … Lire la suite

Meta envisagerait de se retirer de l’accord de 2 milliards de dollars conclu avec Manus suite à la demande de Pékin | TechCrunch

Meta envisagerait de se retirer de l'accord de 2 milliards de dollars conclu avec Manus suite à la demande de Pékin | TechCrunch

Le secteur technologique continue de livrer des avancées remarquables. Meta envisagerait de se retirer de l’accord de 2 milliards de dollars conclu avec Manus suite à la demande de Pékin | TechCrunch Meta a entamé le démantèlement de son acquisition de Manus, d’une valeur de 2 milliards de dollars, en achevant la séparation opérationnelle avec … Lire la suite

Microsoft AI présente MAI-Transcribe-1.5 : un taux d’erreurs de reconnaissance (WER) de 2,4 % sur les éléments d’analyse artificielle, la meilleure précision FLEURS de sa catégorie et une transcription d’enregistrements audio longs jusqu’à cinq fois plus rapide

Microsoft AI présente MAI-Transcribe-1.5 : un taux d'erreurs de reconnaissance (WER) de 2,4 % sur les éléments d'analyse artificielle, la meilleure précision FLEURS de sa catégorie et une transcription d'enregistrements audio longs jusqu'à cinq fois plus rapide

Le paysage de l’intelligence artificielle s’enrichit d’une nouveauté significative. Microsoft AI présente MAI-Transcribe-1.5 : un taux d’erreurs de reconnaissance (WER) de 2,4 % sur les éléments d’analyse artificielle, la meilleure précision FLEURS de sa catégorie et une transcription d’enregistrements audio longs jusqu’à cinq fois plus rapide L’équipe Superintelligence de Microsoft a lancé MAI-Transcribe-1.5, un modèle … Lire la suite

Ces grands modèles de langage (LLM) sont les plus efficaces pour contrer la propagande russe

Ces grands modèles de langage (LLM) sont les plus efficaces pour contrer la propagande russe

Le paysage de l’intelligence artificielle s’enrichit d’une nouveauté significative. Ces grands modèles de langage (LLM) sont les plus efficaces pour contrer la propagande russe Une étude de référence du gouvernement estonien montre comment des dizaines de modèles s’attaquent aux « discours stratégiques » de la Russie. Alors que de plus en plus de personnes se … Lire la suite

Découvrez OpenJarvis : un framework axé sur le local pour les agents IA personnels embarqués, doté d’outils, d’une mémoire et de capacités d’apprentissage

Découvrez OpenJarvis : un framework axé sur le local pour les agents IA personnels embarqués, doté d'outils, d'une mémoire et de capacités d'apprentissage

Un nouveau jalon vient d’être franchi dans l’univers de l’intelligence artificielle. Découvrez OpenJarvis : un framework axé sur le local pour les agents IA personnels embarqués, doté d’outils, d’une mémoire et de capacités d’apprentissage Des chercheurs de l’université de Stanford et de Lambda Labs ont publié un article de recherche consacré à OpenJarvis, un framework … Lire la suite

Comment accélérer la formation des transformateurs à l’aide de NVIDIA Apex (FusedAdam, FusedLayerNorm) et Native torch.amp

Comment accélérer la formation des transformateurs à l'aide de NVIDIA Apex (FusedAdam, FusedLayerNorm) et Native torch.amp

Nouvelle étape franchie dans l’univers des technologies d’intelligence artificielle. Comment accélérer la formation des transformateurs à l’aide de NVIDIA Apex (FusedAdam, FusedLayerNorm) et Native torch.amp Dans ce didacticiel, nous travaillons sur une implémentation de NVIDIA Apex, en nous concentrant sur les composants qui comptent toujours dans les flux de travail de formation GPU modernes. Au … Lire la suite

MiniMax lance MiniMax M3 avec une architecture MSA prenant en charge le contexte 1M-Token, la multimodalité native et le codage agentique

MiniMax lance MiniMax M3 avec une architecture MSA prenant en charge le contexte 1M-Token, la multimodalité native et le codage agentique

Voici une information qui pourrait bien avoir un impact durable sur le secteur. MiniMax lance MiniMax M3 avec une architecture MSA prenant en charge le contexte 1M-Token, la multimodalité native et le codage agentique MiniMax a officiellement lancé MiniMaxM3 le 1er juin 2026. Le modèle introduit MSA (MiniMax Sparse Attention), une récente architecture d’attention clairsemée … Lire la suite

Mettre en place un pipeline complet d’observabilité et d’évaluation Langfuse pour le traçage, la gestion des invites, l’évaluation et les expériences

Mettre en place un pipeline complet d'observabilité et d'évaluation Langfuse pour le traçage, la gestion des invites, l'évaluation et les expériences

Les développements se succèdent à un rythme impressionnant dans l’IA. Mettre en place un pipeline complet d’observabilité et d’évaluation Langfuse pour le traçage, la gestion des invites, l’évaluation et les expériences Dans ce tutoriel, nous mettons en œuvre le pipeline Langfuse (une plateforme open source d’ingénierie des grands modèles linguistiques) pour le traçage, la gestion … Lire la suite