Aller au contenu principal
NeuroActu — Votre veille quotidienne sur l'intelligence artificielle
NeuroActu L'actu IA, chaque jour
Modèles LLM Local Agents IA Création IA Hardware Outils Entreprises Régulation
Catégorie · 14 articles

LLM Local

Modèles open source à exécuter sur ta machine : Llama, Mistral, Qwen, Gemma, Phi, DeepSeek… Quantification, fine-tuning, optimisations matérielles, benchmarks et outils d'inférence (llama.cpp, ollama, vLLM).

LFM2.5-DSpark promet une inférence locale 3,2x plus rapide LLM Local
21 août 2026 ·Hugging Face · 4 min

LFM2.5-DSpark promet une inférence locale 3,2x plus rapide

Hugging Face présente LFM2.5-DSpark, une variante optimisée du modèle de Mistral qui accélère jusqu’à 3,2 fois l’inférence locale.

Lire l'article
Modèles ouverts : le bilan 2026 qui redistribue les cartes LLM Local
16 août 2026 ·Hugging Face · 5 min

Modèles ouverts : le bilan 2026 qui redistribue les cartes

Hugging Face dresse le bilan de l’été 2026 pour les modèles ouverts : performances, licences, multimodalité et déploiement local.

Lire l'article
Des agents vocaux IA multilingues, ouverts et locaux LLM Local
11 août 2026 ·Hugging Face · 4 min

Des agents vocaux IA multilingues, ouverts et locaux

Hugging Face et Nvidia montrent comment déployer des agents vocaux IA multilingues à faible latence avec Magpie TTS et ses poids ouverts.

Lire l'article
Muse Glimmer : Meta lance un agent IA local et ouvert LLM Local
10 août 2026 ·Hugging Face · 4 min

Muse Glimmer : Meta lance un agent IA local et ouvert

Meta revient avec Muse Glimmer, un modèle multimodal open source capable d’agir localement, un atout clé pour des agents IA plus privés.

Lire l'article
Hugging Face déploie des agents locaux avec LFM2.5 LLM Local
5 août 2026 ·Hugging Face · 4 min

Hugging Face déploie des agents locaux avec LFM2.5

Hugging Face facilite le déploiement d’agents IA locaux avec LFM2.5-2.6B, un petit modèle pensé pour fonctionner sur des appareils variés.

Lire l'article
Kimi 3 veut défier Opus 4.8 avec un géant open chinois LLM Local
17 juillet 2026 ·TechCrunch AI · 4 min

Kimi 3 veut défier Opus 4.8 avec un géant open chinois

Moonshot préparerait Kimi 3, un modèle open chinois de 2 à 3 billions de paramètres, pensé pour rivaliser avec Claude Opus 4.8.

Lire l'article
LLM open source en local : lesquels passent sur un PC en 2026 ? LLM Local
14 juillet 2026 ·NeuroActu · 22 min

LLM open source en local : lesquels passent sur un PC en 2026 ?

Comparatif éditorial 2026 des LLM open source réellement utilisables en local sur un PC standard : RAM, VRAM, vitesse, qualité, confidentialité et compromis.

Lire l'article
GLM-5.2 veut rivaliser avec Anthropic en cybersécurité LLM Local
29 juin 2026 ·The Verge AI · 4 min

GLM-5.2 veut rivaliser avec Anthropic en cybersécurité

Z.ai dévoile GLM-5.2, un modèle open weight présenté comme capable de rivaliser avec Mythos sur certaines tâches de cybersécurité.

Lire l'article
Hugging Face simplifie le déploiement vLLM en un clic LLM Local
28 juin 2026 ·Hugging Face · 4 min

Hugging Face simplifie le déploiement vLLM en un clic

Hugging Face permet désormais de lancer un serveur vLLM en une commande via HF Jobs, un pas concret pour industrialiser les LLM open source.

Lire l'article
GLM-5.2 veut imposer l’open source sur les tâches longues LLM Local
17 juin 2026 ·Hugging Face · 4 min

GLM-5.2 veut imposer l’open source sur les tâches longues

Hugging Face présente GLM-5.2, un modèle pensé pour les tâches longues et les agents persistants, avec un positionnement open source à surveiller.

Lire l'article
DiffusionGemma : Google promet un texte 4x plus rapide LLM Local
11 juin 2026 ·Google DeepMind · 4 min

DiffusionGemma : Google promet un texte 4x plus rapide

Google DeepMind présente DiffusionGemma, une approche qui promet une génération de texte jusqu’à 4x plus rapide que les LLM classiques.

Lire l'article
Hugging Face veut des LLM quasi instantanés par diffusion LLM Local
25 mai 2026 ·Hugging Face · 4 min

Hugging Face veut des LLM quasi instantanés par diffusion

Hugging Face met en avant les modèles de langage par diffusion de Nemotron-Labs pour accélérer fortement la génération de texte et bousculer les LLM autoregressifs.

Lire l'article
Hugging Face accélère les LLM avec Nemotron-Labs LLM Local
23 mai 2026 ·Hugging Face · 4 min

Hugging Face accélère les LLM avec Nemotron-Labs

Hugging Face met en avant les modèles de langage par diffusion de Nemotron-Labs, une piste prometteuse pour accélérer fortement la génération de texte.

Lire l'article
Hugging Face veut accélérer les LLM avec la diffusion LLM Local
23 mai 2026 ·Hugging Face · 4 min

Hugging Face veut accélérer les LLM avec la diffusion

Hugging Face met en avant des modèles de langage par diffusion avec Nemotron-Labs, une piste prometteuse pour accélérer fortement la génération de texte.

Lire l'article