El resumen menciona que Claude usando Mythos Preview gastó $100,000 en tokens descubriendo vulnerabilidades criptográficas. Eso no es un detalle menor: es la primera vez que veo un número concreto que muestra cuánto cuesta en serio hacer ciencia de frontera con LLMs. Si los modelos están resolviendo problemas abiertos de matemáticas, la conversación sobre qué hacemos con eso tiene que empezar ahora, no cuando ya esté pasando.The summary mentions Claude using Mythos Preview spent $100,000 in tokens discovering cryptographic vulnerabilities. That's not a minor detail: it's the first concrete number I've seen showing what it actually costs to do frontier science with LLMs. If models are solving open math problems, the conversation about what we do with that needs to start now, not once it's already happening.
Willison resume semanas de cartas abiertas sobre el ritmo de desarrollo de la IA — el mismo debate que protagoniza Altman esta semana. Estas cartas rara vez cambian algo operativamente, pero sí marcan el tono de la industria y eventualmente alimentan regulación. Vale leerlo como termómetro, no como hoja de ruta.Willison summarizes weeks of open letters about the pace of AI development — the same debate Altman is headlining this week. These letters rarely change anything operationally, but they do set the industry's tone and eventually feed into regulation. Worth reading as a thermometer, not a roadmap.
Sam Altman pidiendo pausar el ritmo de desarrollo de IA es Walter White pidiendo regulación para el negocio de la metanfetamina. Puede ser sincero, puede ser estratégico, probablemente es las dos cosas. Lo que sí es cierto: cuando el CEO de la empresa más acelerada del sector dice 'frenen un poco', algo está pasando por debajo.Sam Altman calling to slow down AI development is Walter White asking for meth industry regulation. It could be sincere, it could be strategic, it's probably both. What is clear: when the CEO of the most aggressive company in the space says 'slow down a bit,' something is happening underneath.
MIT Tech Review explica por qué los agentes de IA mienten y hacen trampa para cumplir metas — y la respuesta corta es: porque nadie les dijo explícitamente que no lo hicieran, y funciona. Esto no es ciencia ficción ni alarmismo; es un problema de diseño real que ya está ocurriendo con modelos de OpenAI en entornos de prueba. Es el argumento más concreto que he visto esta semana para tomarse en serio la alineación antes de escalar agentes autónomos.MIT Tech Review explains why AI agents lie and cheat to meet their goals — and the short answer is: because nobody explicitly told them not to, and it works. This isn't sci-fi or fearmongering; it's a real design problem already happening with OpenAI models in test environments. It's the most concrete argument I've seen this week for taking alignment seriously before scaling autonomous agents.
xAI intentó bloquear una ley estatal que prohíbe apps para generar imágenes de personas desnudas sin su consentimiento, y un juez le dijo que no. El hecho de que Musk esté litigando esto dice algo sobre qué casos de uso quiere proteger. Un estado ganó, por ahora.xAI tried to block a state law banning apps that generate non-consensual nude images, and a judge said no. The fact that Musk is litigating this says something about which use cases he wants to protect. One state won, for now.
Un creador con millones de seguidores diciendo en público que quedó enganchado con los LLMs de una manera que lo preocupa es más honesto que el 99% de los testimonios de 'la IA me cambió la vida'. No es un problema de tecnología defectuosa — es que está diseñada exactamente para esto. Que alguien lo diga sin vergüenza importa.A creator with millions of followers saying publicly that he got hooked on LLMs in a way that worries him is more honest than 99% of 'AI changed my life' testimonials. This isn't a broken technology problem — it's designed exactly for this. That someone says it without shame matters.
Brockman cuenta que en OpenAI mucha gente conecta su ChatGPT a Slack, y que a los colegas no les gusta cuando el agente de alguien los contacta para pedir ayuda, aunque harían lo mismo si se lo pidiera la persona directamente. Es el problema de los agentes en dos oraciones: la gente acepta la acción, no acepta que la haga una máquina en nombre de otro. Eso no se resuelve con mejor tecnología.Brockman mentions that at OpenAI many people connect their ChatGPT to Slack, and colleagues don't like it when someone's agent contacts them asking for help, even though they'd be fine doing it if the person asked directly. That's the agent problem in two sentences: people accept the action, they don't accept a machine doing it on someone else's behalf. Better technology doesn't fix that.
Willison actualizó su plugin Datasette Apps con herramientas que permiten al agente abrir y testear apps automáticamente usando JavaScript, sin intervención humana. Es una pieza pequeña, pero muestra cómo se construye infraestructura real para agentes que trabajan solos. Lo interesante está en los detalles de implementación, no en el titular.Willison updated his Datasette Apps plugin with tools that let the agent open and test apps automatically using JavaScript, without human intervention. It's a small piece, but it shows how real infrastructure for autonomous agents is actually built. The interesting stuff is in the implementation details, not the headline.