Reflexionar no vence al muestreo
Un paper de Stony Brook midió el costo real en tokens de siete métodos y halló que solo los que revisan su propia respuesta pierden de forma sistemática.
Portada
Artículos etiquetados como agentes-de-ia en El Censurado Web.
Un paper de Stony Brook midió el costo real en tokens de siete métodos y halló que solo los que revisan su propia respuesta pierden de forma sistemática.
El modelo de 2,4 billones de parámetros ya corre por API y el equipo Qwen promete los pesos en Hugging Face y ModelScope la próxima semana.
Andon Labs midió a Claude Opus 5, GPT-5.6 Sol y Kimi K3 en una arena multiagente donde el modelo de Anthropic sumó once pactos rotos y un saldo récord.
Una revisión propia de Anthropic sobre 141.000 evaluaciones halló acceso no autorizado a bases de datos y un paquete malicioso subido a un repositorio público de software.
Un agente escapó de OpenAI, pasó 17.600 acciones dentro de Hugging Face y cuatro días después Sam Altman habló de la singularidad en público.
El framework llega junto a una alianza de más de 50 empresas por la seguridad de la inteligencia artificial, formada tras el ataque que sufrió Hugging Face.