Más allá del dilema de estabilidad-exploración: regularización ambiental para la…
La optimización de políticas (PO) para modelos de lenguaje de gran escala enfrenta una disyuntiva entre estabilidad y exploración, actualmente mediada por un regularizador de Policy-KL del lado de la acción. Esto pone a….
Ver anuncio Hugging FaceAgente Prime: Un Sistema RLM de Auto-Mejora
Los modelos de lenguaje son procesadores secuenciales, pero la agencia de horizonte largo requiere información externa y cómputo más….
MobilePA-Bench: Evaluación de Agentes Planificadores Móviles en Tareas Complejas…
A medida que los agentes LLM en el dispositivo evolucionan hacia copilotos personales, el sistema operativo móvil se ha convertido en un….
Descubrimiento de Recursos Agénticos (ARD): Una especificación abierta para el…
El Registro de Agentes de AWS le brinda a su organización un catálogo centralizado y buscable para agentes, herramientas y habilidades.
Corrección y armonización de metadatos impulsada por IA
La armonización de metadatos (estandarizar etiquetas, identificadores y formatos para que los conjuntos de datos puedan trabajar juntos) sigue….
Thomson Reuters apuesta 40 millones de dólares por tener su propia IA en lugar…
Thomson Reuters está lanzando "Thomson", su propio modelo de lenguaje basado en Qwen de Alibaba, con un costo de aproximadamente $40….
El Wan3.0 de Alibaba genera videos con IA de hasta 30 segundos de duración a…
El modelo de generación de video de Alibaba, Wan3.0, crea clips de hasta 30 segundos de duración a partir de texto, archivos PDF y….
Los niños superan a la IA en aprendizaje—y todavía no sabemos por qué
Las personas han estado hablando entre sí durante al menos 100,000 años, hasta donde podemos saber. Y en todo ese tiempo, solo ha….
Mismo Agente, Diferentes Respuestas: Una Auditoría Consciente de la Repetición…
Un sistema de QA con recuperación aumentada puede devolver respuestas diferentes después de una expansión de índice, incluso cuando su….