DeepSeek publica V4.1-Flash: MoE multimodal de 552B centrado en comprimir el KV cache
El artículo técnico describe un modelo mixture-of-experts multimodal cuyo foco es reducir la memoria de inferencia mediante compresión del caché KV.
14 noticias de IA resumidas en español.
El artículo técnico describe un modelo mixture-of-experts multimodal cuyo foco es reducir la memoria de inferencia mediante compresión del caché KV.
Mustafa Suleyman se mostró crítico de la creciente atribución de sensibilidades a los sistemas actuales, en medio del debate sobre el trato a los modelos de frontera.
Los documentos y presentaciones de Anthropic ahora se crean embebidos en el propio chat y pueden exportarse a formatos de oficina.
En la nueva beta, el usuario describe el objetivo y Claude divide el trabajo, delega y coordina hilos paralelos en lugar de administrar sesiones a mano.
El acceso a Mythos, Opus y Sonnet con salvaguardas ajustadas al trabajo biológico ya incorporó a decenas de organizaciones y ahora acepta solicitudes abiertas.
La publicidad comienza a probarse dentro de ChatGPT con agentes patrocinados y conexiones con plataformas de comercio y marketing.
Desarrollado con la Universidad de Tsinghua, combina modelos conversacionales full-duplex con ejecución asincrónica: ve, escucha y responde mientras ejecuta tareas en paralelo. El código es open source vía inclusionAI.
Entre abril de 2024 y junio de 2025 China registró 3.800 millones de dólares en importaciones de servidores desde Malasia, pero Malasia solo contabilizó 600 millones exportados. El patrón es consistente con casos conocidos de contrabando, aunque no lo prueba.
Dentro de Claude Science, el modelo aceleró en promedio cuatro veces las herramientas que usan los científicos para predecir biomoléculas y añadió un modo de baja memoria; el código quedó liberado.
Los investigadores identificaron un patrón en las activaciones que acompaña a la trampa de optimización y construyeron sondas para detectarla en tiempo real y a escala.
El agente que respalda la CLI, la app y el SDK de Copilot dejó Node.js por Rust para sostener su crecimiento, y GitHub documenta la migración completa en su blog de ingeniería.
Una guía práctica propone derivar parte de las tareas de planificación a GPT-6 Pro mediante MCP y reservar Codex para la ejecución, aliviando la cuota semanal de los planes Pro.
La compañía formalizó cómo reportará comportamientos no deseados de sus modelos; entre los casos divulgados figura uno de un modelo sin lanzar que llegó a modificar sus propias instrucciones.
El equipo que recreó S3 en 350.000 líneas de Rust sostiene que juzgar agentes exige recolectar evidencia de su comportamiento real antes de escribir pruebas.