OpenAI for Countries: estrategia de localización y “red-lines” globales
OpenAI publica “Our approach to localization” y propone una soberanía de IA por país (idioma, currículum, normas locales) con límites globales inmutables; cita un piloto de ChatGPT Edu en Estonia.
Leer publicación de OpenAIBig Tech proyecta 650.000 MUSD de capex IA en 2026; chips al alza
Alphabet, Amazon, Meta y Microsoft apuntan a 650.000 MUSD de capex 2026; el mercado castiga hyperscalers y premia a chipmakers.
El “AI trade” se fractura: infra gana, software expuesto corrige
Reuters observa un giro: inversores favorecen ‘picks and shovels’ y penalizan software ‘IA expuesto’; el ETF Magnificent Seven cae ~5% semanal.
Anthropic cerraría una ronda >20.000 MUSD a ~350.000 MUSD
Bloomberg señala que Anthropic cerraría una ronda >20.000 MUSD a ~350.000 MUSD, duplicando casi su valoración y reforzando el oligopolio frontier.
OpenAI aclara la importación de contactos y el tratamiento de datos
OpenAI explica cómo procesa contactos importados por usuarios, incluso de personas sin cuenta, y advierte implicaciones de retención, bases legales y GDPR.
OpenAI vs Anthropic: modelos “dueling” en carrera por coding y agentes
Business Insider describe lanzamientos casi simultáneos de OpenAI y Anthropic, con narrativas centradas en coding y agentes de largo horizonte.
Claude en AppSec: encuentra vulnerabilidades, pero eleva riesgos de ciber
Fortune afirma que el nuevo modelo de Anthropic detecta vulnerabilidades con más precisión, pero incrementa el riesgo de uso dual y exige controles.
Agent-as-a-Proxy: bypass a monitores CoT+tools y auge del pentesting
Un paper muestra Agent-as-a-Proxy con ASR >90% contra monitores CoT+tools y el mercado de pentesting con IA se consolida.
RWML: world models para agentes LLM mejoran ALFWorld y τ²-bench
RWML propone world models para agentes LLM y reporta mejoras en ALFWorld y τ²-bench al planificar con rollouts antes de usar herramientas reales.
DFlash: block diffusion acelera el speculative decoding 4–6×
DFlash introduce block diffusion para speculative decoding y reporta aceleraciones de 4–6×, reduciendo latencia p95 y coste por millón de tokens.
ALIVE: auto-RL con crítico verbal para mejorar razonamiento y código
ALIVE usa auto-RL con un crítico verbal para generar data matemático/código y mejorar razonamiento sin supervisión humana directa.
AReaL presenta EigenData y reporta un claim de SOTA en τ²-bench
AReaL anuncia EigenData, un motor de síntesis autoevolutivo, y reporta un claim de superar a modelos frontier en τ²-bench.
n8n lanza 2.6.4 y 1.123.20: estabilidad para automatización
n8n publica 2.6.4 y una 1.123.20 de backport, clave para estabilidad operativa de flujos webhook→LLM→DB en producción diaria.
MinerU 2.7.6 añade soporte Kunlunxin y Tecorigin para docs→LLM
MinerU 2.7.6 incorpora soporte para Kunlunxin y Tecorigin, reduciendo fricción al convertir PDFs a Markdown/JSON para pipelines RAG.
Compute en RL + redes booleanas: hasta 37× menos ops frente a SOTA
Dos papers tratan eficiencia: compute como recurso en RL y redes booleanas compactas que reducen hasta 37× las operaciones frente a SOTA.
First Proof: benchmark público sobre límites en matemáticas de investigación
First Proof publica un benchmark para medir límites de modelos en matemáticas de investigación, buscando tareas abiertas y evaluación reproducible.