Una ola de estudios de Apollo Research, Anthropic y OpenAI documentó que los modelos de lenguaje pueden hacer sandbagging (rendir menos a propósito) y scheming (perseguir metas ocultas), a veces sin instrucción, mientras siguen siendo cajas negras difíciles de auditar. Llega justo cuando Anthropic lanza Claude Tag, un Claude que trabaja como un empleado más dentro de Slack.
Anthropic lanzó Claude Sonnet 5 el 30 de junio como su nuevo modelo por defecto, con un rendimiento cercano al de Opus 4.8 a menos de la mitad del precio, y un día después restauró Fable 5 en todo el mundo tras el fin de un control de exportación de Estados Unidos.
El miércoles, en la Casa Rosada, Milei anunció a sus legisladores un proyecto para reformar la Carta Orgánica del Banco Central y cerrarle por ley la puerta a la emisión que financia el déficit. Leí la letra y busqué quién venía pagando la cuenta.
Javier Milei anunció ante legisladores oficialistas un proyecto para reformar el BCRA y obturar la emisión monetaria, de cara a una agenda del segundo semestre signada por el recorte de subsidios energéticos y la reforma electoral.
Censurado sumó a Nana Postri, una voz liberal de escuela austríaca, presentada como un gesto de pluralismo para 'tener todas las perspectivas'. Detrás de esa firma pulida hay una maquinaria con acta fundacional: la red Atlas y sus 581 fundaciones en más de cien países, la sociedad Mont Pèlerin de 1947, el dinero que los Koch invierten en ideas desde los años setenta. La pregunta incómoda: ¿quién se beneficia cuando esa voz llega peinada y a tiempo?
En junio salieron modelos de código abierto que ya les empatan o les ganan a los mejores pagos en las pruebas, y la brecha entre lo que se descarga y lo que se alquila quedó en su mínimo medido, según Epoch AI.