OpenAI renueva ChatGPT Images y lanza GPT-Image-1.5
OpenAI actualiza la generación de imágenes en ChatGPT con un modelo “flagship”: hasta 4× más rápido y ~20% más barato en API, con mejores ediciones y texto en imagen.
Leer anuncio OpenAIOpenAI lanza FrontierScience, benchmark de razonamiento científico
Nuevo benchmark de física, química y biología con pistas Olympiad y Research, y un gold set parcialmente abierto para medir razonamiento científico experto.
Meta anuncia SAM Audio para segmentación de sonido
SAM Audio separa fuentes en mezclas audio/video mediante prompts de texto, clic visual o intervalo temporal, y se integra en la colección Segment Anything.
Google compara single-agent vs multi-agent: 180 experimentos
Un estudio controlado muestra que un solo agente rinde mejor en tareas secuenciales, mientras equipos multi-agente dominan trabajos paralelos con overhead de coordinación.
SGAI AI 2025 y QCon AI: auge de la agentic AI (16–18 dic)
Dos conferencias esta semana ponen foco en agentic AI: SGAI en Cambridge (proceedings Springer) y QCon AI en Nueva York para ingeniería de producción.
arXiv: Reasoning-Style Poisoning, ataque al “estilo” de agentes
Un paper describe Reasoning-Style Poisoning: reescrituras estilísticas que cambian el razonamiento interno sin alterar hechos, y propone un monitor runtime como defensa.
arXiv: Model-First Reasoning reduce violaciones de restricciones
Model-First Reasoning obliga al agente a construir un modelo explícito del problema antes de planificar, bajando las violaciones de restricciones y mejorando robustez.