Noticias IA del 22/12/2025

DeepMind + DOE oficializan Genesis Mission y despliegan “AI Co-scientist”

DeepMind oficializa con el Departamento de Energía de EE. UU. la “Genesis Mission” para integrar “AI Co-scientist” (basado en Gemini 3) en 17 laboratorios nacionales. El sistema multi-agente busca generar hipótesis y proponer experimentos en fusión, materiales y biomedicina.

Leer anuncio de DeepMind
🛡️

OpenAI endurece ChatGPT Atlas contra prompt injection con red teaming continuo

22 Dic 2025 Seguridad

OpenAI detalla un atacante automatizado entrenado con RL para descubrir inyecciones y despliega un modelo adversarialmente entrenado más salvaguardas en ChatGPT Atlas.

Fuente
🛡️

TechCrunch: los agentes web podrían ser “siempre” vulnerables a inyección

22 Dic 2025 Seguridad

TechCrunch concluye que la inyección en agentes web quizá no desaparezca, y recomienda defensa en capas reduciendo exposición, confirmaciones y mínimo privilegio.

Fuente
🤖

Tether publica QVAC Genesis II: dataset abierto (25B tokens) y QV0.5

22 Dic 2025 Modelos/Dataset

QVAC Genesis II aporta 25B tokens con ratio 1:1 code/math y acompaña un Qwen2.5-7B derivado, bajo licencia CC-BY-NC 4.0.

Fuente
🧰

Langflow v1.7 mejora apps agénticas: MCP Streamable HTTP, agentes y S3

22 Dic 2025 SDK/Dev

Langflow 1.7 suma Streamable HTTP para MCP, nuevos componentes de agentes y routing, además de auth para webhooks y backend S3 para archivos.

Fuente
🎛️

NVIDIA y MBL usan RTX+VR para explorar memoria humana en datasets 3D

22 Dic 2025 Hardware

El Marine Biological Laboratory usa RTX, VR y herramientas de IA para inspeccionar volúmenes 3D del hipocampo y acelerar el estudio molecular de la memoria.

Fuente
🤖

BiomedBERT Hash (NeuML): biomédico nano para embeddings y reranking

22 Dic 2025 Modelos

BiomedBERT Hash comprime conocimiento médico en modelos muy pequeños (~970K parámetros) y ofrece variantes para embeddings, ColBERT y reranking en Hugging Face.

Fuente
📄

MMRB2 y ranking tipo Solomonoff: mejor evaluación y razonamiento incierto

22 Dic 2025 Papers

MMRB2 actualiza RewardBench multimodal y muestra límites de LLM-as-a-judge; un ranking inspirado en Solomonoff busca mejorar decisiones bajo incertidumbre en agentes.

Fuente