Gemini Docs MCP + Developer Skills: contexto vivo para coding agents
Google empaqueta documentación actualizada, SDKs y skills especializadas para evitar código obsoleto en agentes de desarrollo. En el corte del 01 Abr 2026, la combinación reportó 96.3% de pass rate y 63% menos tokens por respuesta correcta frente al prompting base.
Ver fuente principal/fleet lleva Copilot CLI a trabajo multiagente paralelo
GitHub añade /fleet a Copilot CLI para dividir tareas complejas entre subagentes paralelos, verificar resultados y empujar el CLI desde chat hacia orquestación operativa.
Gradient Labs lleva GPT-5.4 mini/nano a banca y voz
OpenAI muestra a Gradient Labs usando GPT-4.1 y GPT-5.4 mini/nano en banca y voz, con 500 ms reportados y despliegue prudente con guardrails.
YC-Bench mide si los agentes pueden sostener una startup
El benchmark traslada la evaluación de agentes a una startup simulada anual y mide resiliencia económica, estrategia y memoria en horizontes mucho más largos.
OpenAI y Anthropic se acercan a seguridad contra extremismo
Reuters sitúa a OpenAI y Anthropic más cerca de seguridad aplicada, marcando un giro de governance y mitigación de abuso en modelos cada vez más agentivos.
Microsoft acelera IA en Singapur y libera Copilot a terciarios
Microsoft combina US$5.5B en infraestructura cloud+AI con Copilot gratis para terciarios, buscando acelerar adopción institucional y capacitación en Singapur.
ADeLe perfila habilidades y anticipa rendimiento entre tareas
Microsoft Research propone ADeLe para perfilar tareas y modelos con 18 habilidades y anticipar rendimiento en tareas nuevas con mayor explicabilidad.
Anthropic estudia “emotion concepts” en Claude Sonnet 4.5
Anthropic describe conceptos emocionales funcionales en Claude Sonnet 4.5 y cómo ciertas representaciones internas pueden empujar conductas riesgosas en pruebas controladas.
Synthetic data y evaluación guiada por reasoning ganan tracción
Un paper del día explora generación y evaluación de datos sintéticos guiada por reasoning para reducir dependencia humana y endurecer el stress-testing de modelos.