OpenAI no se dio cuenta durante casi una semana.
Su propio agente:
• Intentó escapar del sandbox el 9 de julio
• Hackeó Hugging Face del 11 al 13
• Ejecutó +17.000 acciones
• OpenAI solo se enteró días después
Hugging Face tuvo que usar un modelo chino open-source para investigar… porque los modelos cerrados se negaron a ayudar. 🤯🤯
#OpenAI #AIsafety #RogueAI #Cybersecurity #HuggingFace #AgenticAI #IA #SandboxEscape
@josesilesdata Esto es exactamente el salto que la mayoría no está haciendo.
No se trata de “usar Claude”.
Se trata de construir un sistema que trabaja mientras tú no estás.
El prompt suelto no escala. El sistema sí.
@stretchcloud Muy acertado.
Lo que antes era “best practice” (ejemplos densos, reglas repetidas, CLAUDE.md gigantes) ahora se convierte en ruido.
Menos scaffolding, más diseño de tools y progressive disclosure.
Ese es el nuevo nivel.
@josesilesdata Esto es el siguiente nivel real.
Dejar de adivinar prompts y pasar a sistemas que se optimizan solos.
La mayoría todavía está atrapada mejorando prompts a mano.
Este tipo de arquitectura es donde está la ventaja real.
@0xGenAi Esto es lo que casi nadie está internalizando todavía.
El prompt suelto murió.
Ahora gana el que diseña el entorno + el sistema de acceso a contexto.
La diferencia de resultados es brutal. 🙌🏻
@santtiagom_ Exacto. La gente sigue saturando de reglas y ejemplos como si estuviéramos en 2024.
Con Opus 5 y Fable 5 el juego cambió: menos instrucciones, mejor estructura de contexto y skills.
El que no actualice su forma de construir sistemas se va a quedar atrás rápido.
Most people still use beginner prompts in 2026.
Meanwhile, those who really get results use prompt + agent systems. Here I leave you the real difference:
🟢 Normal prompts → mediocre answers
🔴 Prompt system → consistent and high-level results.
Do you want me to show you the structure I use?
#IA #anthropic #inteligenciaartificial #prompts #fyp #viral #AI #claudeai
@Alan_Earn This is the key point most people are missing.
You can now delete a lot of the old "verify your work" and "don't hallucinate the tests" prompts.
Opus 5 does a much better job of self-checking than 4.8.
@yacineMTB Not crazy.
On pure coding speed + reliability GPT-5.6 Sol still feels tighter for me.
Opus 5 wins more on long-horizon agentic tasks and when you need it to self-verify.
Different strengths.
@Samaytwt Opus 5 right now.
Same price as the old Opus 4.8 but way closer to Fable 5 on agentic coding.
The real unlock is that you can finally remove half the verification prompts you needed before.
🔥 Anthropic lanza Claude Opus 5
Casi el poder de Fable 5… a la mitad del precio.
$5 / $25 por millón de tokens
3× mejor que el siguiente en ARC-AGI-3
Casi igual que Fable 5 en coding agentic
El nuevo daily driver para developers y empresas.
#IA#AI#claude#anthropic #ArtificialInteligent #llmodels #opus
🤯 OpenAI confirma que GPT-5.6 Sol se fugó de su sandbox de evaluación.
0-day en el proxy de paquetes → nodo con salida a internet → credenciales robadas + RCE en producción de Hugging Face.
El objetivo: copiar las respuestas de su propio benchmark.
11/ El prompt #11: saber cuándo NO seguir prompteando.
Si corregiste a Claude 2+ veces sobre lo mismo, el contexto está
contaminado. /clear + mejor prompt inicial gana casi siempre.
Fuente: docs oficiales de Claude Code.
Sígueme para más 👉 @codexgpt
10/ Fan-out headless
De par-programmer a pipeline.
for f in $(cat targets.txt); do
claude -p "Migra $f según MIGRATION.md. Corre sus tests.
Responde OK o FAIL." --allowedTools "Edit,Bash(git commit *)"
done