Les dernières heures ont apporté leur lot d’informations dans l’écosystème IA.
Liquid AI lance la version LFM2.5-230M avec prise en charge de llama.cpp, MLX, vLLM, SGLang et ONNX pour l’inférence sur appareil
Le plus petit modèle de Liquid AI à ce jour fonctionne à une vitesse de 213 tokens par seconde sur un Galaxy S25 Ultra et de 42 sur un Raspberry Pi 5.
Par ailleurs, liquid AI a lancé le modèle d’IA LFM2.5-230M, le plus petit modèle de l’entreprise à ce jour. Ce lancement vise une application spécifique : l’exécution de tâches agentiques sur des téléphones, des robots et des appareils d’automatisation. Les checkpoints de base et ceux optimisés par instructions sont disponibles en version à poids ouvert sur Hugging Face.
En parallèle, le champ d’application est volontairement restreint. Il ne s’agit pas d’un modèle de raisonnement général. Il est conçu pour l’extraction de données et l’utilisation d’outils sur du matériel en périphérie.
De plus, lFM2.5-230M est un système dédié exclusivement au texte, comptant 230 millions de paramètres. Il repose sur l’architecture LFM2. Le modèle d’IA comporte 14 couches au total. Huit d’entre elles sont des blocs de convolution LIV à double porte. Les six autres sont des blocs d’attention à requêtes groupées (GQA). Cette architecture hybride est conçue pour permettre une inférence rapide sur CPU.
Il faut souligner, la longueur du contexte est de 32 768 tokens. La taille du vocabulaire est de 65 536 mots. Les connaissances sont à jour jusqu’à la mi-2024. Le mécanisme prend en charge dix langues, dont l’anglais, le chinois, l’arabe et le japonais.
L’équipe de Liquid AI publie deux versions de référence. LFM2.5-230M-Base est le modèle pré-entraîné destiné au fin-tuning. LFM2.5-230M est la version polyvalente optimisée pour les instructions. La licence est lfm1.0.
Les analystes auront matière à débattre dans les prochaines semaines.
Sur le même sujet :
- DeepReinforce lance Ornith-1.0 : une famille de modèles de codage open source capables d’apprendre leurs propres structures d’apprentissage par renforcement
- Tutoriel CodeGen de Salesforce : générer, valider et reclasser des fonctions Python à l’aide de tests unitaires et de contrôles de sécurité
- Guide NVIDIA SkillSpector : analyse des compétences en IA pour détecter les risques de sécurité à l’aide de l’analyse statique et des rapports SARIF
Tel que rapporté par MarkTechPost : MarkTechPost