🚀 Modelos & Releases
-
DeepSeek V4 Flash 0731: modelo sparse mixture-of-experts con 13 mil millones de parámetros activos (284 mil millones totales). Optimizado para código, razonamiento y flujos de agentes. Licencia MIT y disponible en OpenRouter. (fuente)
-
Inkling Small: modelo multimodal de Thinking Machines Lab, con 12 mil millones de parámetros activos (276 mil millones totales). Enfoque en eficiencia para tareas complejas. (fuente)
-
Qwen3.7 Flash: modelo de visión-lenguaje de Alibaba, especializado en reconocimiento de objetos, comprensión espacial e interacción con computadoras. (fuente)
⚙️ API & Deprecaciones
-
xAI/Colossus: SpaceX no retirará las turbinas no autorizadas de los centros de datos de xAI hasta dentro de un año. Riesgo potencial de interrupciones en infraestructura crítica para servicios que dependan de estos nodos. (fuente)
-
TensorRT-LLM v1.3.0rc23: problemas conocidos con modelos DeepSeek en configuraciones GB300 disaggregated. Fallos en multi-GPU (PP4 + MTP) y chunked prefill con BF16. Evitar actualizar si usas estas configuraciones. (fuente)
-
llama.cpp b10215: corrección para GPUs Intel en Windows. Se elimina el crash guard para versiones de controlador ≥ 32.0.101.8860. Verificar compatibilidad antes de actualizar. (fuente)
🔬 Investigación
-
Falla fundamental en LLMs: estudio presentado en ICML 2026 demuestra que es imposible asegurar modelos de lenguaje contra ataques debido a un fallo intrínseco en su arquitectura. Impacto directo en seguridad de sistemas en producción. (fuente)
-
ReToken: técnica para mejorar modelos de visión-lenguaje en recuperación visual. Usa un solo token entrenable para manejar contextos largos sin degradar rendimiento. (fuente)
⚖️ Regulación & Sociedad
-
UE AI Act: Bruselas asume poderes de ejecución. Empresas con infraestructura en Europa deben auditar cumplimiento antes de finales de 2026. (fuente)
-
Investigación a OpenAI: grupos de políticas de IA solicitan al gobierno de EE.UU. investigar un incidente de seguridad reciente. Riesgo de sanciones o restricciones operativas. (fuente)
💡 A retener
- DeepSeek V4 Flash 0731 es la opción más eficiente para tareas de código y razonamiento, con licencia MIT y bajo costo en OpenRouter. Evaluar contra Qwen3.7 Flash si el caso de uso es multimodal.
- xAI/Colossus: la infraestructura de SpaceX sigue en riesgo regulatorio. Planificar migración de servicios críticos fuera de estos nodos antes de julio 2027.
- TensorRT-LLM v1.3.0rc23 rompe compatibilidad con modelos DeepSeek en configuraciones GB300. No actualizar si usas multi-GPU o chunked prefill.