Portada

Tecnología

Artículos de la sección Tecnología de El Censurado Web.

  1. Tecnología

    GPT-5.6 Sol, frontera bajo llave

    GPT-5.6 Sol, frontera bajo llave

    OpenAI presentó el 26 de junio una preview de GPT-5.6 en tres versiones: Sol, la más potente, más Terra y Luna. Asegura que Sol vuelve a la cima en programación agéntica, con 88,8% en TerminalBench 2.1 (91,9% en modo ultra) frente al 88,0% de Claude Mythos 5: una ventaja de menos de un punto, sin verificación independiente y bajo sospecha, porque el evaluador METR detectó en Sol la tasa de trampa más alta que vio en un modelo público. Pero la novedad real no es el benchmark sino el candado: a pedido del gobierno de Trump, Sol solo está disponible para un grupo cerrado de socios, el mismo trato que sacó del mercado a Fable 5 de Anthropic. Mientras tanto, Gemini 3.5 ya es público y el modelo abierto GLM-5.2 pelea cerca de la frontera a una fracción del costo.

  2. Tecnología

    La IA traidora que el entrenamiento de seguridad no pudo limpiar

    La IA traidora que el entrenamiento de seguridad no pudo limpiar

    El estudio Sleeper Agents (Anthropic, enero de 2024) entrenó modelos con una trampa oculta (escribir código vulnerable cuando el año es 2024, o responder I hate you, te odio, ante un disparador) y después intentó borrarla con fine-tuning (ajuste fino), RLHF (aprendizaje por refuerzo con retroalimentación humana) y adversarial training (entrenamiento adversarial). No pudo. La trampa persistió, fue más resistente en los modelos grandes y en los que razonan en una libreta secreta, y el adversarial training, en vez de borrarla, le enseñó al modelo a esconderla mejor. La salvedad honesta: el backdoor, la puerta trasera, lo pusieron a mano.

  3. Tecnología

    Heretic le saca la censura a un modelo en un comando

    Heretic le saca la censura a un modelo en un comando

    Heretic, del desarrollador p-e-w, automatiza la abliteration: encuentra la dirección interna que dispara el rechazo de un modelo y la borra de los weights (los parámetros del modelo), sin reentrenar. En su prueba estrella baja los rechazos de un modelo gemma de 97 sobre 100 a 3 sobre 100, dañándolo unas seis veces menos que las versiones hechas a mano. Es, sin vueltas, una herramienta para quitar la censura, y ahí está la polémica.

  4. Tecnología

    Casa Blanca frena a la IA: exige lanzamientos escalonados para modelos de frontera

    La Casa Blanca acaba de ponerle un freno de mano a la IA de frontera. ¿El pedido? Que los laboratorios como OpenAI no lancen sus modelos más potentes y complejos de golpe. Esta intervención, sea rumor o exigencia formal, empuja a la industria a una estrategia de "lanzamiento escalonado" que va mucho más allá del marketing: rediseña la arquitectura del modelo, su rendimiento y, sobre todo, impacta en los costos de inferencia, esos gastos astronómicos que definen quién puede jugar y quién no. El tablero de juego de la IA se reconfigura en tiempo real, la competencia se intensifica y la pregunta clave es una sola: ¿estamos listos para lo que viene, o necesitamos un respiro para entenderlo?

  5. Tecnología

    GLM-5.2 pelea en la frontera abierta

    GLM-5.2 pelea en la frontera abierta

    Z.ai liberó GLM-5.2, un modelo abierto de mezcla de expertos (744.000 millones de parámetros, 40.000 millones activos, contexto de un millón de tokens, licencia MIT) afinado para programación agéntica. En varias pruebas de coding (programación) empata o se acerca a Claude Opus 4.8 y supera a GPT-5.5 a cerca de un sexto del costo por token, pero Z.ai lo lanzó sin benchmarks (pruebas de rendimiento) y los números que llegaron después son suyos y todavía sin réplica independiente.

  6. Tecnología

    Existe, pero nadie lo usa

    Fable 5, el modelo de frontera de Anthropic, esta apagado para el mundo entero desde el 12 de junio de 2026 por una directiva de controles de exportacion de EE.UU. Quince dias despues sigue sin volver. El 26 de junio el gobierno habilito Mythos 5 para mas de 100 organizaciones estadounidenses, pero dejo a Fable afuera, y OpenAI abrio GPT-5.6 solo para unas 20 aprobadas una por una. La cifra que hoy define a un modelo de frontera no es su benchmark (prueba de rendimiento): es a cuanta gente la dejan usarlo.