OpenAI for Countries: 11 naciones impulsan adopción e infraestructura
OpenAI intensificó su programa “OpenAI for Countries” para impulsar centros de datos y el uso de IA en educación, salud y preparación ante desastres; once países ya firmaron acuerdos.
Leer en ReutersMeta entrega primeros modelos internos “Avocado” y “Mango”
Reuters informa que el nuevo laboratorio de IA de Meta ya entregó modelos internos “Avocado” y “Mango”, señalando un pipeline propio rumbo a productos.
YouTube prioriza frenar el “AI slop” y detectar deepfakes en 2026
YouTube prioriza en 2026 reducir contenido repetitivo generado por IA y detectar deepfakes, afinando sistemas para elevar calidad y confianza en la plataforma.
Jensen Huang niega burbuja: “infraestructura histórica” para IA
En Davos, Jensen Huang dice que hablar de burbuja es menor frente al mayor despliegue de infraestructura, impulsado por escasez de GPUs y demanda real.
Anthropic suma a Tino Cuéllar al Long-Term Benefit Trust
Anthropic incorpora a Mariano-Florentino “Tino” Cuéllar a su Long-Term Benefit Trust, reforzando la supervisión independiente de su misión de seguridad y beneficio público.
Codex CLI 0.88.0: device-code auth headless y fixes
Codex CLI 0.88.0 añade autenticación por device-code en entornos headless y refuerza seguridad de configuración, además de fixes para Azure y fugas de memoria.
Arize Phoenix 12.31.0: FaithfulnessEvaluator y nuevas CLI
Arize Phoenix 12.31.0 suma FaithfulnessEvaluator, depreca HallucinationEvaluator y amplía CLI para datasets y experiments, apuntalando evaluación y trazabilidad en flujos LLM.
Inworld TTS-1.5: voz realtime con 130–250 ms P90
Inworld presenta TTS-1.5 para voz en tiempo real con P90 de 130–250 ms y precio de $5–10 por millón de caracteres, buscando bajar coste y latencia.
Akamai impulsa Valkey con vector ops para AI/search
Akamai explica Valkey, rama comunitaria de Redis con licencia Apache 2.0, y destaca operaciones vectoriales rápidas para AI/search como vector store de baja latencia.
Test-Time Matching (UCR) mejora razonamiento sin reentrenar
UC Riverside propone Test-Time Matching para mejorar razonamiento sin reentrenar; SigLIP-B16 con TTM logró 89,4% en razonamiento compositivo, superando GPT-4.1.
REVEAL-CXR: benchmark multimodal en radiografías validado por radiólogos
REVEAL-CXR en arXiv introduce un benchmark con validación de 17 radiólogos para evaluar modelos multimodales en RX de tórax, con 200 casos curados.
Traducción al árabe puede ocultar contaminación de datos en benchmarks
Un paper en arXiv muestra que traducir benchmarks al árabe puede ocultar señales de contaminación de datos, y propone detección “translation-aware” para evitar falsos negativos.