🚨EL WEB SCRAPING HA MUERTO🚨
Han creado PixelRAG.
Un sistema open source que pasa de parsear HTML.
En vez de convertir una web en texto...
hace una captura de pantalla.
Y luego un modelo vision-language lee la respuesta directamente desde los píxeles.
Brutal.
Porque el scraping tradicional rompe muchísima información:
→ tablas
→ gráficos
→ layouts
→ columnas
→ botones
→ PDFs
→ páginas mal estructuradas
Todo eso se pierde cuando conviertes una web en texto plano.
PixelRAG hace algo mucho más simple:
indexa la página tal y como la ve una persona.
El equipo ha creado un índice visual de Wikipedia entero:
+30 millones de screenshots.
Y aun así supera al mejor RAG basado en texto por un 18,1% en QA.
Tiene también un plugin para Claude Code.
Básicamente le da ojos a Claude.
Le pasas una URL, un paper de arXiv o tu web local…
y Claude no scrapea el DOM.
La mira.
Cómo funciona:
→ renderiza webs, PDFs e imágenes en tiles
→ los embebe con Qwen3-VL-Embedding
→ construye un índice FAISS
→ busca visualmente sobre píxeles
Todo open source bajo Apache-2.0.
Link al repo en los comentarios 👇🏻
CORRE CODEX 100% LOCAL Y CASI GRATIS CON OLLAMA
Sin API. Sin rate limits. Sin enviar tu código a la nube.
Con un solo comando:
→ ollama launch codex
Levantas el agente de coding de OpenAI usando modelos locales (DeepSeek, Qwen, Gemma, Llama, Mistral…).
Lo que ganas:
→ Costo ≈ 0
→ Privacidad total (todo corre en tu PC)
→ Offline
→ Sin límites de uso
→ Velocidad de respuesta local
Setup en minutos:
1. Instala Ollama
2. Descarga el modelo que quieras
3. ollama launch codex
El video muestra cómo revisa PRs, explica codebases y ejecuta comandos como un agente real… todo local.
¿Ya estás usando Codex con Ollama o sigues pagando API?
استطاع المطور @0xjohnny
القدرة على تعديل بعض مهام الايفون بدون جلبريك هذا ليس جلبريك على
17 Pro Max running iOS 27 DB3.
عن طريق استخدامGPT-5.6 Sol Ultra
تخيل!!!!
ماذا يعني،
يعني مثل تقريبا ثغرة DarkSword الي تتيح لك التعديل على الجهاز بمميزات محددة دون جلبريك
يعني بس يصدر تحديث IOS27 الرسمي راح تقدر تضيف مميزات وتعديل على ايفونك الحديث بأحدث اصدار IOS دون جلبريك مثل الفيديو لو تلاحض بعض الخصائص التي تم تفعيلها على الجهاز ايفون 17 برو ماكس
عمل ضخم
ROSINT
Free online #Reddit user lookup tool.
Search any Reddit username to view their activity history (include deleted posts and removed comments).
https://t.co/q2MzbSFJat
Tip by @the_OSINT_rack
Encontré la herramienta de OCR que realmente estaba hecha para la era de los LLMs.
Se llama olmOCR.
Convierte PDFs, escaneos, PNGs y JPEGs en markdown limpio y bien estructurado que los modelos de IA pueden entender de verdad.
Ya no se rompe con lo que normalmente complica todo:
-> Tablas
-> Ecuaciones
-> Texto manuscrito
-> Diseños de varias columnas
-> Figuras e insets
-> Documentos antiguos escaneados
-> Encabezados y pies de página
-> Orden de lectura natural
En vez de pasarle a tu IA un texto desordenado y lleno de errores, le entregas un Markdown que respeta la estructura original del documento.
Esto importa mucho más de lo que parece.
Gran parte del conocimiento del mundo sigue atrapado en PDFs: papers, documentos legales, reportes financieros, historiales médicos, archivos escaneados, conocimiento interno de empresas…
Si estás armando RAG o agentes sobre documentos y tu OCR es mediocre, tu sistema ya empieza fallando desde el primer paso.
olmOCR soluciona esa primera milla.
Esa capa “aburrida” que nadie menciona hasta que tu agente empieza a alucinar por culpa de un texto roto.
Repo en los comentarios 🔥
Un abogado pierde una semana en un contrato de 500 páginas.
Un contador, cuatro días en 200 facturas.
Un investigador, dos semanas en 50 PDFs.
Todos copiando y pegando.
MinerU lo cambia todo.
Herramienta gratuita y de código abierto que convierte cualquier PDF, Word, Excel o imagen escaneada en Markdown limpio en segundos:
• Texto en orden correcto
• Tablas en HTML
• Ecuaciones en LaTeX
• OCR potente
• 109 idiomas
Un PDF de 200 páginas → Markdown perfecto en 90 segundos.
Funciona en CLI y Python. Corre en tu PC. 100% privado.
Más de 68.000 estrellas en GitHub.
La abogada: contrato listo en 4 min.
El contador: 200 facturas en 12 min.
El investigador: revisión lista en una tarde.
Adiós papeleo manual. Bienvenido tu tiempo.
GITHUB ACABA DE SOLUCIONAR EL MAYOR PROBLEMA DEL VIBE CODING
95K estrellas en días. no es casualidad.
en vez de tirar prompts vagos y rezar, Spec Kit obliga a la IA a entender lo que quieres ANTES de tocar código
el flujo:
/constitution → reglas
/specify → qué construir
/clarify → dudas primero
/plan → arquitectura
/tasks → orden
/implement → ejecución
compatible con Claude Code, Cursor, Copilot, Gemini CLI y +25 agentes
repositorio en los comentarios 👇
Chrome headless consume 200MB de RAM por instancia.
Si tu agente de IA abre 10 pestañas en paralelo, ya estás quemando 2GB solo en el navegador.
Alguien reescribió el navegador desde cero en Rust para arreglarlo.
Se llama Obscura. 14.8k estrellas en 7 semanas. Apache 2.0.
Los números son difíciles de creer hasta que los pruebas:
- Memoria: 30MB frente a los 200MB+ de Chrome
- Arranque: instantáneo frente a los 2 segundos de Chrome
- Carga de página: 85ms frente a los 500ms de Chrome
- Binario: 70MB frente a los 300MB+ de Chrome
- Anti-detección: integrado de serie. Chrome no tiene nada.
No es un webview envuelto. No es un simulador.
Corre JavaScript real via V8. Soporta el protocolo Chrome DevTools. Es un reemplazo directo para Puppeteer y Playwright sin cambiar tu código.
Lo que cambia para quien construye agentes:
Un agente con Chrome headless visita 50 páginas por minuto.
Con Obscura visita 500.
No es una optimización. Es lo que determina qué proyectos son económicamente viables construir.
✅ Modo stealth integrado: fingerprint aleatorio por sesión, anti-bot, bloqueo de trackers
✅ Scraping en paralelo de múltiples URLs con concurrencia configurable
✅ Compatible con Puppeteer y Playwright sin modificar el código
✅ Skills para Claude Code ya disponibles en el repo
✅ Binarios para Linux, Mac Intel, Mac Apple Silicon y Windows
✅ 981 forks. 8 releases. v0.1.7 hace 3 días. Activo hace 8 horas.
el enlace 👇
Esta herramienta revela el prompt detrás de cualquier repositorio de GitHub
Usarlo es muy sencillo:
→ Cambia “github” por “gitreverse” en la url
→ Te da el prompt para replicar el proyecto
Sin instalar ni configurar nada.
Solo editas la url.
Ingeniería inversa de cualquier proyecto en segundos.
100% Gratis.
Enlace abajo 👇
Pasa de tener que explicarle a la IA pedazo por pedazo tu proyecto… a entregarle todo el contexto de una sola vez en un archivo limpio.
[Repomix]
Convierte todo tu repositorio en un solo archivo optimizado para IA (XML, Markdown o JSON).
Esto es GOD
REPOOO👇
25 webs que parecen magia pero son reales.
1. https://t.co/Dx9aBaFwIU — genera listas, nombres, historias o cualquier cosa aleatoria con lógica personalizada
2. https://t.co/5WrSI0YXhf — más de 120 herramientas en un solo sitio: texto, imágenes, código, SEO
3. https://t.co/2PAGSigA5a — convierte código entre lenguajes al instante
4. https://t.co/bupo1fuVvl — convierte cualquier tabla (Excel, CSV, JSON, HTML, Markdown) a cualquier formato
5. https://t.co/dbxv41ZLyF — mockups de producto con un aspecto profesional en 10 segundos
6. https://t.co/J6B4YAQvOb — pega cualquier comando de terminal y te explica qué hace cada parte
7. https://t.co/4qst5Tc5l0 — escribe y testea expresiones regulares con explicación en tiempo real
8. https://t.co/iDcoyHoLK9 — comprueba si cualquier feature de CSS o JS funciona en todos los navegadores
9. https://t.co/38dzE8ziq6 — antes de instalar un paquete npm, mira exactamente cu��nto pesa
10. https://t.co/W2vMSItjSW — convierte fragmentos de código en imágenes bonitas para compartir
11. https://t.co/IxJAFviFQe — lo mismo pero con más temas y personalización
12. https://t.co/2LD1YuI2NF — captura cualquier web como imagen de alta resolución
13. https://t.co/A8r2jYALCS — visualiza tu diseño en todos los tamaños de pantalla a la vez
14. https://t.co/IEmAI9Hr7E — más de 100 herramientas gratuitas de PDF, imagen y video en un solo sitio
15. https://t.co/acX1tlQALE — comprime imágenes sin perder calidad, directo desde el navegador
16. https://t.co/ZWYYpIImdj — elimina el fondo de cualquier imagen en segundos
17. https://t.co/140ZyBkR3f — borra objetos de fotos como si nunca hubieran existido
18. https://t.co/M3NwGwrZEt — convierte cualquier imagen PNG o JPG a SVG vectorial
19. https://t.co/GncHQ6AN7v — pizarra infinita en el navegador, sin registro, con IA integrada
20. https://t.co/2wbEMIdg3e — diagramas con estilo sketch que parecen hechos a mano
21. https://t.co/UDOaH6r1t9 — toda la documentación de todos los lenguajes y frameworks en un solo lugar
22. https://t.co/D7UFLtWtB6 — rutas de aprendizaje para cualquier rol técnico, actualizadas por la comunidad
23. https://t.co/Njbg66bzZ6 — cheatsheets de más de 400 tecnologías en un solo sitio
24. https://t.co/xYchflXzPL — colección de cheatsheets de APIs y lenguajes con todo en una página
25. https://t.co/AAuZ6mfrvL — genera portadas profesionales para tus artículos de blog en segundos
No cuestan nada.
La mayoría lleva años ahí.
Nadie las enseña porque nadie las busca.
Vas a querer guardar esto.
Si no quieres perderte nada vente a mi Telegram (enlace en mi perfil)
Un tipo llamado nbatman en Reddit construyó accidentalmente el sitio web más útil de internet.
Se llama FMHY (Free Media Heck Yeah).
Este es el sitio web que Google eliminó de los resultados de búsqueda por violaciones de DMCA, que Reddit ocultó parcialmente por promover la piratería, que la Motion Picture Association señaló como una de las principales amenazas de piratería, y sobre el que la RIAA presionó a proveedores de hosting para que lo eliminaran. Aun así, sigue en línea. Y sigue actualizándose cada mes.
Así es como funciona.
FMHY es el índice. La wiki en sí no aloja nada. Solo te dice dónde vive realmente todo lo gratuito en internet, organizado en 14 categorías con calificaciones de seguridad en cada enlace.
→ Películas y series en 4K desde más de 50 sitios de streaming
→ Música con calidad de Spotify y Apple Music
→ Adobe Creative Cloud, Microsoft Office, AutoCAD, JetBrains
→ Todos los cursos de pago de las principales plataformas de aprendizaje
→ 100 millones de libros y artículos a través de Anna’s Archive
→ Alternativas gratuitas a todas las herramientas de IA de pago
→ Una extensión de navegador llamada SafeGuard que marca sitios inseguros en tiempo real
Comenzó como un simple Google Doc mantenido por un moderador de Reddit en 2018. Google lo eliminó mediante una solicitud DMCA en 2023.
La comunidad reconstruyó la wiki en su propio dominio, la replicó en GitHub e IPFS, y ahora funciona simultáneamente en 12 dominios de respaldo.
No hay empresa. No hay CEO. No hay un servidor central. Seis voluntarios anónimos mantienen todo esto en su tiempo libre. Las donaciones por Ko-fi pagan el hosting. Nadie obtiene beneficios.
Hollywood no puede cerrar esto. Spotify no puede cerrar esto. Adobe no puede cerrar esto.
Toda la economía de suscripciones se sostiene en que no sepas que esta wiki existe.
https://t.co/xDVW1xKCxd
Un desarrollador chino acaba de crear una “IMPRESORA DE DINERO” gratis.
Y no es una metáfora.
La ha llamado: MoneyPrinterTurbo.
Tiene más de 13.000 estrellas en GitHub.
Lo que hace es una locura: Tú escribes un tema o una palabra clave.
Y la herramienta 👇