La verdad es que es una maravilla preguntarle a ChatGPT sobre algo de hace 15 años, de lo que te acuerdas con una o dos indicaciones, y que acierte de lleno con lo que era.
Yes, I think there have been a lot of changes lately that have merged into a big ball of mud: Computer History + ChatGPT/Codex fusion + New subagents system + New models + other things we are probably not even aware of.
I really wish they fixed all this so we could use Codex without thinking about it, like the good old days
@kimmonismus They like to strike con weekends I have seen, which is fair and interesting because major american labs go usually between Tuesday and Thursday probably to have a buffer of time to fix things before the weekend.
Si OpenAI no ha reducido el límite, y están tan seguro de ello, entonces GPT 5.6 es mucho menos eficiente que GPT 5.5 o el harness de Codex está completamente roto. Yo he notado bajadas graves de uso en la Codex App, siempre la última versión, y ya no puedo usar nunca Fast.
We've investigated a few messages about codex usage limits being different. That's not something we change without engaging the community and being transparent.
What we did see is that when talking to affected users many were using sub2api. Converting a subscription into api traffic to then re-serve or share across many users is not something we support and this type of usage gets flagged by our fraud-prevention systems.
You are completely fine if you use your subscription through Sign in With ChatGPT, either through the official clients or through one of the many OSS clients (Pi, OpenCode, ...) that support signing in with your account and using your included usage.
DeepSeek-V4-Flash-Vision-Exp is now live on the DeepSeek API Platform! 🚀
🔹 This experimental multimodal model matches DeepSeek-V4-Flash on text capabilities—including agents, reasoning, and world knowledge.
🔹 On multimodal agent benchmarks, V4-Flash-Vision-Exp makes a major leap over V4-Flash, bringing multimodal agent performance close to Opus-4.8.
Try it with model='deepseek-v4-flash-vision-exp'. DeepSeek Harness 0.1.1 was released today with out-of-the-box support for the new model.
1/n
Ha salido un modelo en modo "stealth" llamado "Ox Alpha", es decir, sin saber qué modelo o empresa está detrás, y todo el mundo está perdiendo la cabeza con él: contexto de 1M, capacidad de 100T de tokens diarios, multimodal con video incluido, bueno en frontend. La gente habla de que el tokenizer lo clasifica como GLM de https://t.co/Ia2FdNXp2U, así que quizás estamos viendo GLM 5.5, pero por ahora es difícil saber.
En mis pruebas de frontend, la verdad es que es bastante rápido y visualmente bastante bueno, para mi gusto, por encima de Fable 5, pero son gustos.
https://t.co/2boIp5ELWR
Mi percepción de los modelos que he probado en profundidad en los últimos meses:
- GPT 5.6 Sol, mi preferido, pero no tan listo como Fable 5, y los límites, a día de hoy, son demasiado bajos.
- Fable 5, el más listo, pero básicamente imposible de probar de forma seria incluso en la sub de 200$.
- Opus 5: mejor ni usarlo; la peor experiencia con un modelo que he tenido jamás.
- DeepSeek v4 Flash y Pro, la crème de la crème para combinar con PI y hacer tareas YOLO en tu ordenador, es como visiono que tendría que ser Siri, pero necesita multimodalidad y la subida de precios ha sido bastante dolorosa para este use case.
- Kimi K3, una locura de lento, lentísimo, y los límites incluso en la suscripción de Vivace (200$) palidecen al lado de Codex e incluso de Claude, pero es listo y los Swarms son la mejor implementación de Workflows que he visto, pero pide a gritos mejores límites.
- SWE 1.7: lo probé con Devin mientras era gratuito; súper rápido y súper competente, pero debería estar en API. No me gusta NADA la UX de Devin.
- Grok 4.6, el que menos he usado por ahora, muy interesante y parece inteligente, le frena que el modo Fast tiene un múltiplo demasiado alto de pricing pero me da ilusiones por lo que puede venir con Grok 4.7
Vivimos en el futuro, pero cada vez se notan más las limitaciones de hardware y de energía de los diferentes labs, mientras todo el mundo grita que necesitan versiones con 10, 20 o 50T de parámetros.
Soy el primero que tiene una lista de cosas que decir sobre lo que Anthropic hace mal, pero el tema del Watermarking en texto no está entre ellas; es una estupidez de la Unión Europea y OpenAI y demás proveedores acabarán implementándolo.
🚨 A successor to Fable 5, likely Fable 5.1, is now being tested for a subset of accounts with "Fable 5" selected on Claude Web, and possibly also Claude Code
Fable 5 also underwent this greyscale testing earlier on the day of its broader release, and Anthropic regularly carry out these tests pre-launch
Uno de los mayores usos que tengo para GPT Image 2.0 es la creación de posters explicativos de conceptos, el problema es que suelen tener esas marcas molestas que en los esquemas se ven demasiado -.-
Wow, una cosa es esperar a que Github se caiga, pero es que ha coincidido en la caida más grande de Github de los últimos meses. Mucha curiosidad por las primeras opiniones de esto.
Origin, our code hosting platform, is now live.
It's fast, easy to use, and deeply integrated with Cursor.
Get started by syncing your repos from GitHub.
Bueno, pues ha comenzado a resonar Qwen 35B-A3B y Composer 3; quizás sí que puede ser una semana grande en el mundo de la IA :D. Eso, junto a Astra, podría terminar agosto en lo alto.
La gente comenta que esta semana va a ser grande en el mundo de la IA, pero lo único que tengo en mente es GPT 5.6 Astra y no es nada seguro que salga. En cuanto a Grok, GLM, DeepSeek, Qwen y Gemini, ya han movido ficha, y Claude no parece que tenga nada para agosto.