Aller au contenu principal
NeuroActu — Votre veille quotidienne sur l'intelligence artificielle
NeuroActu L'actu IA, chaque jour
Modèles LLM Local Agents IA Création IA Hardware Outils Entreprises Régulation
Catégorie · 9 articles

LLM Local

Modèles open source à exécuter sur ta machine : Llama, Mistral, Qwen, Gemma, Phi, DeepSeek… Quantification, fine-tuning, optimisations matérielles, benchmarks et outils d'inférence (llama.cpp, ollama, vLLM).

Kimi 3 veut défier Opus 4.8 avec un géant open chinois LLM Local
17 juillet 2026 ·TechCrunch AI · 4 min

Kimi 3 veut défier Opus 4.8 avec un géant open chinois

Moonshot préparerait Kimi 3, un modèle open chinois de 2 à 3 billions de paramètres, pensé pour rivaliser avec Claude Opus 4.8.

Lire l'article
LLM open source en local : lesquels passent sur un PC en 2026 ? LLM Local
14 juillet 2026 ·NeuroActu · 22 min

LLM open source en local : lesquels passent sur un PC en 2026 ?

Comparatif éditorial 2026 des LLM open source réellement utilisables en local sur un PC standard : RAM, VRAM, vitesse, qualité, confidentialité et compromis.

Lire l'article
GLM-5.2 veut rivaliser avec Anthropic en cybersécurité LLM Local
29 juin 2026 ·The Verge AI · 4 min

GLM-5.2 veut rivaliser avec Anthropic en cybersécurité

Z.ai dévoile GLM-5.2, un modèle open weight présenté comme capable de rivaliser avec Mythos sur certaines tâches de cybersécurité.

Lire l'article
Hugging Face simplifie le déploiement vLLM en un clic LLM Local
28 juin 2026 ·Hugging Face · 4 min

Hugging Face simplifie le déploiement vLLM en un clic

Hugging Face permet désormais de lancer un serveur vLLM en une commande via HF Jobs, un pas concret pour industrialiser les LLM open source.

Lire l'article
GLM-5.2 veut imposer l’open source sur les tâches longues LLM Local
17 juin 2026 ·Hugging Face · 4 min

GLM-5.2 veut imposer l’open source sur les tâches longues

Hugging Face présente GLM-5.2, un modèle pensé pour les tâches longues et les agents persistants, avec un positionnement open source à surveiller.

Lire l'article
DiffusionGemma : Google promet un texte 4x plus rapide LLM Local
11 juin 2026 ·Google DeepMind · 4 min

DiffusionGemma : Google promet un texte 4x plus rapide

Google DeepMind présente DiffusionGemma, une approche qui promet une génération de texte jusqu’à 4x plus rapide que les LLM classiques.

Lire l'article
Hugging Face veut des LLM quasi instantanés par diffusion LLM Local
25 mai 2026 ·Hugging Face · 4 min

Hugging Face veut des LLM quasi instantanés par diffusion

Hugging Face met en avant les modèles de langage par diffusion de Nemotron-Labs pour accélérer fortement la génération de texte et bousculer les LLM autoregressifs.

Lire l'article
Hugging Face accélère les LLM avec Nemotron-Labs LLM Local
23 mai 2026 ·Hugging Face · 4 min

Hugging Face accélère les LLM avec Nemotron-Labs

Hugging Face met en avant les modèles de langage par diffusion de Nemotron-Labs, une piste prometteuse pour accélérer fortement la génération de texte.

Lire l'article
Hugging Face veut accélérer les LLM avec la diffusion LLM Local
23 mai 2026 ·Hugging Face · 4 min

Hugging Face veut accélérer les LLM avec la diffusion

Hugging Face met en avant des modèles de langage par diffusion avec Nemotron-Labs, une piste prometteuse pour accélérer fortement la génération de texte.

Lire l'article