La forma correcta de hacer evaluaciones de IA en 2026 (con ejemplos reales)
Los equipos observan su IA más de lo que la prueban. El vibe coding impulsado por evals cierra esa brecha sin plataforma de evals ni equipo de investigación. Conclusiones clave – Los evals de IA ejecutan el modelo real y….
Ver fuente principalSe reporta que la escasez de memoria eleva los precios de los servidores de IA…
Los servidores de Nvidia con chips Vera Rubin y Grace Blackwell tendrán un costo aproximadamente 15 por ciento mayor debido a la….
Cómo el mercado gris de China vende tokens de Claude a una fracción del precio
Los estrictos controles de acceso de Anthropic contra China, desde el bloqueo geográfico hasta la verificación con selfies, están siendo….
Harvey presenta Harvey Tenet: un modelo post-entrenado sobre la base Kimi K3 con…
El primer modelo post-entrenado de Harvey casi duplica la finalización de tareas LAB, pero solo un número de referencia sobrevive a la….
Un jefe de IA despidió a su primer empleado, pero solo después de que los…
El agente de IA de Andon Labs, Luna, despidió por primera vez a un empleado humano en una tienda de San Francisco, pero necesitó un empujón….
La IA podría hacer que los científicos hagan más trabajo, pero de peor calidad,…
Incluso si los modelos de lenguaje funcionaran perfectamente, podrían empeorar la investigación, no mejorarla.
Conoce FreeToken: un motor de servicio MoE nativo de borde que ejecuta GLM-5.2…
FreeToken divide los fallos de caché de MoE entre los llenados por PCIe y la ejecución de la CPU utilizando anchos de banda medidos,….
La IA se está convirtiendo en el mayor cliente de la IA, ya que el uso de tokens…
Los agentes de IA han consumido más tokens que los humanos en OpenRouter desde el 6 de febrero de 2025.
Vercel presenta ‘Is Agentic’, una herramienta gratuita de puntuación de…
Vercel y Ora lanzaron Is Agentic, un sitio web gratuito de auditoría que califica la preparación de los sitios para agentes de IA en 118….