I finally published my Jira clone application! Just for practicing concepts like Clean Architecture or SSR on a real-like app. Made with @remix_run, React, TS, @radix_ui and @tailwindcss. Srsly, Remix is awesome and I learnt a lot of web stuff thnx to it😁 https://t.co/3NsTBc8RWj
Es vergonzoso ser español cuando uno comprueba lo que ya sospecha desde hace tiempo: un antiguo presidente del gobierno involucrado en casos de corrupción sistemática junto a dictaduras crueles. Que más adelante un juez pueda determinar que la evidencia está probada más allá de toda duda razonable (un criterio muy estricto) es muy diferente de la clara acumulación de evidencia que ya tenemos sobre la mesa.
Pero si esto fuera un caso aislado de corrupción, la vergüenza podría sobrellevarse. Lo preocupante es que forma parte de un patrón sistemático. Zapatero fue presidente del gobierno bajo Juan Carlos I, quien tuvo que abdicar por casos de corrupción intolerables (corrupción que, por otra parte, ha sido constante e invariable en la dinastía Borbón en España desde la regencia de María Cristina de Borbón).
Y a Zapatero le sucedió Rajoy, sí, el Rajoy de “Luis, sé fuerte”. IU y su espacio (como se llame esa semana) tampoco se han librado de estos problemas cuando han tenido pequeños resortes de poder. Moral Santín es el caso más claro.
Y en Cataluña vimos que la antigua CiU y la familia Pujol eran una mafia. El único sitio donde el sistema no ha generado escándalos vergonzosos es el País Vasco, aunque uno sospecha que es más bien consecuencia de la ausencia práctica de libertad de expresión que de su ausencia real.
En otras palabras: los españoles hemos visto cómo la Monarquía, el PSOE, el PP, IU y los grandes partidos nacionalistas han vulnerado de manera sistemática todo tipo de normas éticas y penales.
Mientras tanto, los salarios están estancados, la vivienda está por las nubes, la seguridad social está en una situación límite y la prosperidad actual es un espejismo empujado por una inmigración no sostenible que solo traerá problemas profundos a largo plazo (la figura de @SantiCalvo_Eco lo dice todo).
Quizás sea el momento de aceptar que esto no se arregla cambiando a quien gobierna, sino cambiando las reglas que hacen que casi dé igual quién lo haga.
ahora que han pasado unos días desde la "presentación" de Mythos y os habéis calmado, vamos a revisar que es lo que ha pasado exactamente.
Anthropic saca Mythos, su nuevo modelo. Ahora ya si que si, AGI. Esta vez si que si de verdad de la buena. Los devs desaparecerán en 6 meses. 99999999% en SWE Benchmark Ultra Hyper Difficult. Es un cuatrillón de veces mas mejor que Slopus 4.6. Novecientos ochenta y cuatro gaziliones de parámetros. Ha encontrado vulnerabilidades en todos los proyectos. Dario está tan aterrorizado que ha decidido no sacar el modelo al público (de momento). Efectivamente, es game over. dep en rip en paz, el shur de forocoches tenían razón.
¿O no?
Vamos por partes.
"Es que este modelo es tan brutal que no lo vamos a sacar al público porque va a colapsar el mundo".
Durísimas declaraciones. Ya las hemos escuchado antes. Mas de una vez.
En su momento Dario era el vicepresidente de investigación en OpenAI. Y ya hacía las mismas afirmaciones allá por el 2019. Literalmente. OpenIA dijo exactamente lo mismo, palabra por palabra, para GPT-2.
https://t.co/US79iN6rHC
Hay que entender la situación general para saber el por que de estas declaraciones. A lo mejor habéis leído algo de que Anthropic factura unos cuantos billones.
Son cifras "anualizadas".
¿Que significa anualizadas?
Significa que han cogido el periodo mas bonito en términos fiscales (ej el mes que mas facturación tenían porque han cerrado varios contratos muy grandes) y han multiplicado por 12.
Ta-ta-ta-chaaaaaaaannnnnn...
Pero en el mundo real, si yo tengo 10 clientes y les facturo 1000€ anualmente, y da la casualidad de que a todos les facturo en Enero, eso no significa que mi facturación anual va a ser 1000€ * 10 * 12.
Pos ea. Un truqui que habéis aprendido. Pero volvamos al tema.
Anthropic necesita dinero. Mucho dinero. Muchisimo. No os hacéis una idea del pozo en el que están metidos (ellos, OpenIA y todos los demás jugadores). Necesitan tanto dinero que literalmente la economía yanki (y por extensión, la del resto del mundo) está aguantando la respiración para ver que ocurre, porque como esto pete lo del 2008 va a ser una tarde de relaxing cup of café con leche en la plaza Mayor.
¿Y que hace cualquier empresa grande que necesita dinero y que ya va por la ronda G de financiación y el stock está mas diluido de unas gotas homeopáticas?
Una IPO. Pronto. A finales de este año, por ejemplo.
Pero para la IPO necesitan crear expectativas. Necesitan hypear a la gente. Necesitan que se hable de Anthropic.
No lo estoy explicando bien. Lo intento de nuevo.
Dario tiene el *deber fiduciario* (responsabilidad legal) de hacer absolutamente todo lo posible para que la IPO salga de tal manera para maximizar el beneficio económico de los inversores. Y obviamente si a pocos meses de la IPO sacan un modelo que es el game over de todo y para todo, pues... stock go brrrr, expectativas go brrr, IPO go brrrr, Dario go brrrr.
Ahora que entendemos la motivación legal y económica de Dario, vamos a analizar el anuncio en sí.
https://t.co/crshws1eKJ
> el modelo es tan avanzado que encuentra vulnerabilidades en todos los proyectos a los que se le ha dado acceso: ffmpeg, firefox, openbsd, el kernel de linux
> y por esa misma razón, prefieren guardarlo bajo llave de momento y darle acceso solo a unas cuantas empresas (que, asumo, lo usarán para buscar vulnerabilidades en sus propios productos y parchearlos)
Nice. Very nice. Impressive.
"Veamos ahora con los modelos que ya tenemos!"
Llega AISLE, una empresa que se dedica a la cyberseguridad, y empieza a hacer preguntas. ¿pero este ejercicio cuanto ha costado? ¿se puede replicar? ¿se puede replicar con otros modelos? ¿cual es la severidad real de esas vulnerabilidades?
https://t.co/pa0N490Qoa
Oh boy... se va a liar...
Pues resulta que de los 8 modelos que probaron, 8 pudieron detectar el mismo fallo que Mythos detectó en openbsd.
Ídem con otro fallo de nfs en freebsd.
AISLE no refuta que Mythos no sea bueno, que lo es. Lo que refutan es que presente un peligro como el que Anthropic intenta hacer entender. Es decir, AISLE demuestra que lo que Anthropic afirma de Mythos ("puede buscar y encontrar vulnerabilidades en proyectos") ya lo hacen otros modelos. Y lo hacen igual de bien.
También es cierto que AISLE es una empresa que se dedica a buscar vulnerabilidades con su sistema de IA. Podríamos argumentar que está en su interés desacreditar las afirmaciones de Anthropic.
Vamos a ver que opinan otras personas.
Yann LeCun (vicepresidente y científico jefe de IA en Meta): "el drama de Mythos son tonteías producto del autoengaño"
https://t.co/qlazOsMDnf
Dawid Moczadlo (cto de vidoc security): "llevamos meses encontrando vulnerabilidades en el kernel de linux usando otros modelos. Puede que Mythos sea mejor (que los modelos actuales), pero no es ni de lejos la amenaza que Anthropic hace creer"
https://t.co/hZ1voRRl8y
George Hotz ("geohot", hacker, famoso por sus jailbreaks de ios y ps3, founder de tinygrad): "encontrar 0days no es tan difícil. No aparecen 0days todos los días porque nadie quiere mirar. Encontrar fallos en el código de mierda de la gente (y lucrarse por ello) es ilegal y los criminales no suelen tener mucha habilidad; de tenerla, no serían criminales"
https://t.co/0E0Y7zcTMT
Y aquí voy a permitirme hacer un +1 de geohot. Encontrar 0days no es tan difícil. Yo he encontrado unos cuantos (chungos de cojones; https://t.co/EmWvmL9KsN) y la ciberseguridad no es ni de lejos mi área principal. El problema es que encontrar vulnerabilidades no solo no es lucrativo, sino que en España es ilegal (https://t.co/ky6N50ZZYh) y corres el riesgo de meterte en un buen marrón incluso aunque tus intenciones sean buenas. Obviamente si tus intenciones son lucrarte vendiendo 0days, olvídate de hacerlo legalmente.
Y este es el punto de Geohot. No salen 0days todos los días porque nadie tiene el incentivo de buscarlos, no porque realmente sean tan difíciles de encontrar.
Anyways, que nos desviamos del tema.
¿A donde quiero llegar con todo esto? ¿Que significan todas estas cosas?
Significan que no os lancéis a la primera afirmación que suelta alguien. Y menos en este campo en particular, en estos últimos 3-4 años. Es muy probable que os estéis comiendo una (otra más) bola de hype. Hay muchísimos intereses ocultos (y no tan ocultos) y hay muchísimas maneras de decir las verdades a medias para pintar escenarios que dan a entender cosas que no son.
¿Pero todo esto quiere decir que Mythos no va a ser bueno? Obviamente no. Mythos será mejor que Opus (o eso espero, vaya). Pero Mythos no va a ser el fin de los tiempos. No se va a acabar el mundo.
Resumiendo, solo os pido que no caigáis (una vez más) en el "ahora ya si que si".
@devruso Una app para diseño 3D de cocinas y baños (reformas, obras). Orientado al público o quizá incluso para profesionales. Ahí tienes margen y complejidad técnica para aburrir
@Sharker ¿Qué plan de Codex? ¿Cuánto uso le das? Yo tengo Pro y prácticamente solo puedo usar Sonnet porque Opus se come el límite de 5h enseguida. Igual me renta el cambio
@mario_el_tonto @Recuenco@Jongonzlz Sinceramente apostaría por un evento tan catastrófico o llamativo que desvíe la atención lo suficiente como para que una reforma de las pensiones no sea un terremoto político
@mario_el_tonto @Recuenco Demasiada verdad en este tuit. El melón de las pensiones solo podría arreglarse con:
1. Un plan bien calculado (como dice @Jongonzlz)
2. Una narrativa tan fuerte como para q la gente trague con esto,bien con distracciones políticas,resultados a corto plazo o unidad de los jóvenes
@MrtnzAlvrz También puedes no encontrar nunca eso que buscas porque no es fácil. O encontrarlo tarde y no vivir muchas experiencias y etapas, y acabar solo o en una relación más de compañeros que de pareja, mientras te lamentas pensando si el riesgo mereció la pena.