LLM Local
Modèles open source à exécuter sur ta machine : Llama, Mistral, Qwen, Gemma, Phi, DeepSeek… Quantification, fine-tuning, optimisations matérielles, benchmarks et outils d'inférence (llama.cpp, ollama, vLLM).
LLM Local Kimi 3 veut défier Opus 4.8 avec un géant open chinois
Moonshot préparerait Kimi 3, un modèle open chinois de 2 à 3 billions de paramètres, pensé pour rivaliser avec Claude Opus 4.8.
Lire l'article
LLM Local LLM open source en local : lesquels passent sur un PC en 2026 ?
Comparatif éditorial 2026 des LLM open source réellement utilisables en local sur un PC standard : RAM, VRAM, vitesse, qualité, confidentialité et compromis.
Lire l'article
LLM Local GLM-5.2 veut rivaliser avec Anthropic en cybersécurité
Z.ai dévoile GLM-5.2, un modèle open weight présenté comme capable de rivaliser avec Mythos sur certaines tâches de cybersécurité.
Lire l'article
LLM Local Hugging Face simplifie le déploiement vLLM en un clic
Hugging Face permet désormais de lancer un serveur vLLM en une commande via HF Jobs, un pas concret pour industrialiser les LLM open source.
Lire l'article
LLM Local GLM-5.2 veut imposer l’open source sur les tâches longues
Hugging Face présente GLM-5.2, un modèle pensé pour les tâches longues et les agents persistants, avec un positionnement open source à surveiller.
Lire l'article
LLM Local DiffusionGemma : Google promet un texte 4x plus rapide
Google DeepMind présente DiffusionGemma, une approche qui promet une génération de texte jusqu’à 4x plus rapide que les LLM classiques.
Lire l'article
LLM Local Hugging Face veut des LLM quasi instantanés par diffusion
Hugging Face met en avant les modèles de langage par diffusion de Nemotron-Labs pour accélérer fortement la génération de texte et bousculer les LLM autoregressifs.
Lire l'article
LLM Local Hugging Face accélère les LLM avec Nemotron-Labs
Hugging Face met en avant les modèles de langage par diffusion de Nemotron-Labs, une piste prometteuse pour accélérer fortement la génération de texte.
Lire l'article
LLM Local Hugging Face veut accélérer les LLM avec la diffusion
Hugging Face met en avant des modèles de langage par diffusion avec Nemotron-Labs, une piste prometteuse pour accélérer fortement la génération de texte.
Lire l'article