🚀 Modèles & Releases
- DeepSeek-V4-Flash-0731 : Nouveau modèle sparse MoE (13B actifs / 284B totaux) optimisé pour le code, le raisonnement et les workflows agents. Dispo sur Hugging Face et OpenRouter, licence MIT. (Hugging Face, OpenRouter)
- Inkling Small : Modèle multimodal MoE open-weight (12B actifs / 276B totaux) de Thinking Machines Lab, présenté comme une alternative légère et efficace. (OpenRouter)
🔬 Recherche
Aucune publication marquante aujourd’hui.
🏢 Industrie & Business
- xAI : SpaceX ne retirera pas les turbines non autorisées de son usine pour les data centers Colossus avant un an, malgré les obligations légales. Impact potentiel sur la capacité de production des modèles xAI. (TechCrunch)
🛠️ Outils & Produits
- llama.cpp b10215 : Correction de crash sur GPU Intel Windows via vérification de version de driver (fix à partir de 32.0.101.8860). Support étendu aux GPU autres que Xe2+. (GitHub)
- TensorRT-LLM v1.3.0rc23 : Version release candidate avec bugs critiques sur DeepSeek-V4-Pro (hang sur GB300 en setup disaggregated) et DeepSeek-V3-Lite (hang en BF16 + chunked prefill). À éviter en prod pour ces modèles. (GitHub)
- cline SDK v0.0.69 : Timeout étendu à 5 minutes pour les réponses Ollama (évite les échecs sur modèles lourds en cold start). Les serveurs inaccessibles échouent toujours immédiatement. (GitHub)
- pydantic-ai v2.22.0 : Ajout du mode
VALIDATEDpar défaut pour les outils Gemini sur modèles supportés. Permet de sauter des tâches MCP optionnelles viaprefer_tasks. (GitHub)
⚙️ API & Dépréciations
Aucun changement cassant ou dépréciation annoncée aujourd’hui.
⚖️ Régulation & Société
- UE : La Commission finalise ses outils pour l’application de l’AI Act, entrée en vigueur. Détails techniques non précisés. (Euractiv)
- États-Unis : Cinq raisons avancées pour une régulation imminente de l’IA, sans calendrier précis. (Forbes)
- Minnesota : Un juge rejette la demande d’xAI de bloquer l’interdiction des apps « nudify ». La loi entre en vigueur. (TechCrunch)
💡 À retenir
- TensorRT-LLM v1.3.0rc23 est instable sur DeepSeek-V4-Pro et DeepSeek-V3-Lite en environnement GB300. À éviter en production pour ces modèles.
- DeepSeek-V4-Flash-0731 offre une alternative MoE légère (13B actifs) pour le code et les agents, avec une licence MIT permissive.
- xAI retarde d’un an le retrait de turbines non autorisées, risquant des contraintes sur la capacité de production de ses modèles.