🚀 Modèles & Releases
-
DeepSeek V4 Flash 0731 : Nouveau modèle sparse MoE (13B actifs / 284B totaux) optimisé pour le coding, le reasoning et les workflows agents. Disponible sur OpenRouter avec licence MIT et support 8-bit/FP8. ( OpenRouter | Hugging Face )
-
TensorRT-LLM v1.3.0rc23 : Release candidate avec instabilités critiques sur DeepSeek-V4-Pro (hangs sur GB300 en setup disaggregé) et DeepSeek-V3-Lite (hangs en BF16 + chunked prefill). À tester avant migration en prod. ( GitHub )
-
Inkling Small : Modèle multimodal MoE (12B actifs / 276B totaux) open-weight de Thinking Machines Lab, alternative légère aux modèles lourds. ( OpenRouter )
-
Qwen3.7 Flash : Vision-language model d'Alibaba pour agents multimodaux, avec force en reconnaissance d'objets et compréhension spatiale. ( OpenRouter )
🔬 Recherche
-
Vulnérabilité fondamentale des LLMs : Une faille structurelle rend impossible la sécurisation totale contre les attaques, selon une étude présentée à l'ICML 2026. Impact direct sur les systèmes exposés en production. ( MIT Tech Review )
-
ReToken : Technique pour améliorer les modèles vision-language en retrieval, réduisant la dégradation des performances avec des contextes visuels longs. ( arXiv )
⚙️ API & Dépréciations
-
OpenAI Python v2.52.0 : Ajout de vérifications de provenance de contenu (
content provenance checks) et correction des délaisRetry-After(jusqu'à 2 minutes). Mise à jour recommandée pour les pipelines critiques. ( GitHub ) -
llama.cpp b10215 : Correction de crash sur GPU Intel Windows (driver ≥ 32.0.101.8860) via vérification de version. Intégration nécessaire si utilisation de Vulkan sur ces configurations. ( GitHub )
-
pydantic-ai v2.22.0 : Support des clients
MCPToolsetpour sauter des tâches MCP optionnelles viaprefer_tasks, et activation par défaut du modeVALIDATEDpour les outils Gemini. ( GitHub )
⚖️ Régulation & Société
-
UE AI Act : Bruxelles obtient des pouvoirs d'application renforcés. Les entreprises doivent auditer leurs pipelines pour conformité avant déploiement en Europe. ( Stratfor Worldview )
-
Enquête sur OpenAI : Des groupes de politique IA demandent une investigation fédérale sur un incident de sécurité impliquant des agents