un VPS básico te cuesta entre $20 y $40 al mes en la mayoría de proveedores.
este repo de GitHub lleva desde 2015 enseñando cómo conseguir lo mismo por $0.
https://t.co/xd195a1FFD
132.8k estrellas. mantenido a diario. casi 2.000 personas contribuyendo con nuevos tiers gratuitos y sacando los que ya no funcionan.
la regla es simple: si no es gratis por al menos un año, no entra en la lista. nada de trials de 14 días disfrazados de "gratis".
lo que hay dentro:
✅ Oracle Cloud, 2 servidores, 12 GB de RAM, gratis para siempre, sin límite de tiempo
✅ AWS Lambda, 1 millón de ejecuciones al mes antes de pagar un centavo
✅ Cloudflare, sitios web ilimitados, DNS, SSL y CDN global, gratis
✅ Google Cloud Run, 2 millones de solicitudes al mes de casa
cada proyecto nuevo empieza con los mismos 20 minutos buscando en Google "esto es realmente gratis". este repo ya hizo esa búsqueda por ti.
guárdalo antes de que tu próximo proyecto te haga buscarlo todo otra vez.
se llama free-for-dev 👇
https://t.co/NOK27aVZM4
Todo esto y más en el canal: https://t.co/pchlm7F7S5
China open-sourced a peanut-sized OCR that parses entire 100-page PDFs in one shot..
It's called Unlimited-OCR. Only 3B params. Runs locally.
Every other OCR tool chops your doc into pages and loses the thread. this one reads the whole thing in a single pass.
→ One-shot "long-horizon" parsing (32K context window)
→ Multilingual, out of the box
→ 93% on the standard parsing benchmark (+6 over baseline)
→ <0.11 error rate past 40 pages
→ Runs 100% locally on your own hardware
→ Works with Transformers, vLLM, SGLang, Docker, Ollama, llama.cpp
Traditional cloud OCR (Textract, Google Vision, Azure Doc Intelligence) costs $1.50–$15 per 1,000 pages.
This runs on your machine. For free. Forever.
Baidu built it explicitly to push DeepSeek-OCR one step further. Already at 1.9M downloads on Hugging Face and most people have no idea it exists yet.
100% open source.
🚨 Este OCR GRATUITO puede leer letra de médicos, tablas complejas y ecuaciones matemáticas.
Se llama **Chandra**, de Datalab.
Y es uno de los OCR más completos que he visto.
Puede procesar:
📌 **Texto escrito a mano**
Notas médicas, formularios rellenados, letra cursiva o poco legible.
📌 **Tablas complejas**
Mantiene celdas combinadas, filas y columnas. Ideal para facturas, informes financieros y PDFs con muchos datos.
📌 **Fórmulas matemáticas**
Convierte ecuaciones directamente a LaTeX.
📌 **Formularios**
Reconoce casillas, botones y valores introducidos.
📌 **Documentos con diseños difíciles**
Textos a varias columnas, periódicos, libros y documentos con imágenes.
Puede devolver el resultado en Markdown, HTML o JSON.
Funciona en más de 40 idiomas.
Para instalarlo:
`pip install chandra-ocr`
Es gratuito para uso personal.
Dejo el link al repo en los comentarios 👇🏻
Tus archivos tendrían que estar bajo tu control, no en el de otra empresa.
Esta herramienta de código abierto sincroniza tus dispositivos directamente, sin servidores centrales y sin ceder el control de tus datos.
👇 Enlace
Te comparto 8 de los mejores repos de github para extraer datos de cualquier sitio web automáticamente:
1. Firecrawl
Pasa una URL y recorre automáticamente todo el sitio, convirtiéndolo en datos limpios y listos para IA. Soporta páginas con JavaScript. Más de 140.000 estrellas.
https://t.co/QzjMTH0M98
2. Crawl4AI
Convierte cualquier web en texto que los LLM pueden leer directamente. Sin API key ni pagos. Lo creó un desarrollador que se hartó de los servicios que cobraban 16 $. Más de 70.000 estrellas.
https://t.co/fzDAMr29W4
3. browser-use
Agente de IA que usa el navegador como un humano: clics, login, formularios, todo. Creado por un startup de ETH Zurich. Más de 100.000 estrellas.
https://t.co/MIvcLE7c8E
4. Crawlee
Base completa para scraping con rotación de proxies, reintentos, anti-detección y manejo de colas. Evita bloqueos de forma profesional.
https://t.co/dQLG9NJdjE
5. Scrapy
El clásico framework de Python para scraping a gran escala. Lleva más de 10 años usándose y procesa millones de páginas de forma estable. Totalmente gratis.
https://t.co/aJYE4Uo1Mk
6. Scrapling
Se adapta automáticamente a los cambios de diseño de las webs y evita detecciones de bloqueo. Funcionalidades de nivel pago… pero gratis.
https://t.co/XyqvZR4vXX
7. AutoScraper
Solo le das un ejemplo de los datos que quieres y aprende solo el patrón. Extrae el resto sin escribir selectores. Muy sencillo y potente.
https://t.co/c6D5FS1ZcX
8. curl-impersonate
Imita las peticiones HTTP de un navegador Chrome real para saltarte las protecciones anti-bot más avanzadas.
https://t.co/dcqagz1uK4
Guárdalos todos, super recomendado.
Con estos puedes sacar datos limpios de casi cualquier web sin pagar servicios caros ni depender de apis limitadas.
WEB SCRAPING JUST GOT A SERIOUS UPGRADE.
PixelRAG doesn't read HTML. It reads the page exactly like you do.
100% open-source.
Instead of parsing websites into plain text, it captures screenshots and lets a vision model retrieve answers directly from the pixels.
Why that's a big deal:
• HTML parsers silently lose information.
• Tables, charts, formulas, and layouts often disappear.
• Even changing the parser can swing RAG accuracy by ~10%.
PixelRAG skips that entire bottleneck.
It indexes what users actually see.
The team built a visual index of 30M+ Wikipedia screenshots, and it outperformed the strongest text-based RAG baseline by 18.1% on text-only QA.
Even cooler:
It includes a Claude Code plugin that gives Claude visual browsing.
Instead of scraping the DOM, Claude can screenshot any webpage, PDF, arXiv paper, or even your local app—and answer based on the rendered page.
The pipeline is surprisingly clean:
→ Render pages into image tiles
→ Embed with Qwen3-VL-Embedding (LoRA-tuned on screenshots)
→ Store in a FAISS index
→ Search visually
The best part?
Upgrade to a better vision model later, and you don't need to rebuild the index.
Because the index stores pixels, not parsed text.
Fully open-source under Apache 2.0.
GitHub: https://t.co/B7whbNg60s
Este repositorio es una joya. Te da todos los pasos e instrucciones para proteger y asegurar tu servidor Linux.
Perfecto por si tienes un servidor propio o VPS:
https://t.co/yJD2GnXFPj
تطبيق مفتوح المصدر واحد بدأ يستبدل Notion وLinear وSlack وJira لفِرق العمل بالكامل. 😳
اسمه Huly، وهو من أكثر المشاريع انتشارًا على GitHub حاليًا، بأكثر من 26 ألف نجمة.
كل اللي عليك تشغّل Docker Compose، وخلال دقائق بيكون عندك مساحة عمل متكاملة مستضافة على سيرفرك الخاص.
🚀 Clonación de voz local que funciona en cualquier laptop
Este TTS ultrarrápido y ligero se ejecuta 100% en CPU, sin GPU ni internet.
• Primer audio en solo 200 ms
• Buena clonación de voz
• Soporte para múltiples idiomas
• Hasta 6x velocidad en tiempo real en CPU normal
Todo privado y corriendo en tu máquina.
¿Quieres probarlo? El repo está en los comentarios.
Like si te parece útil 👍
Sígueme para más herramientas de IA local
This shouldn’t be free.
Someone open sourced a bookmark manager that replaces Pocket, and it auto-tags everything with AI so you never lose a link in the void again.
It’s called Karakeep. Formerly Hoarder. Every link, note, image, and PDF you save, running on your own server instead of a company’s cloud that can shut down without warning.
→ Save links, plain notes, images, and PDFs all in one place, not four different apps
→ AI automatically tags and summarizes everything you save, no manual folder sorting ever again
→ Fetches a title, description, and preview image for every link, so you’re not staring at a wall of bare URLs
→ Full-text search that searches the actual content of what you saved, not just the title
→ Browser extensions for Chrome and Firefox, one click to save whatever page you’re on
→ Self-host on a Raspberry Pi, a home NAS, or a VPS, your data never touches a third party’s database
Mozilla just killed Pocket. Read-it-later apps have a track record of dying and taking your saved links with them. Karakeep’s answer: stop trusting a company’s roadmap with your own memory.
Built for the person with 40 open tabs and a bookmarks folder they never open again.
Open source. AGPL-3.0. Self-hosting first.
If your backend responses feel sluggish, these common code issues are often the reason.
In this thread I’ll walk through 19 practical ones, with a clear way to solve each. No hype, just useful fixes you can apply.
Bookmark if you work on backends.
Let’s get into it.
Un desarrollador chino llamado tw93 se hartó de que sus aplicaciones de escritorio le devoraran la RAM y el disco.
Abría Slack y desaparecían cientos de megabytes. Abría Discord, Notion o cualquier otra app y pasaba lo mismo. ¿La razón? Casi todas son lo mismo por dentro: un sitio web empaquetado con una copia completa del motor de Chrome (Electron).
Decidió que tenía que haber una forma mejor.
En 2022 empezó a construir Pake. Usó Rust + Tauri, que en vez de incluir un navegador completo, aprovecha el WebView nativo del sistema operativo.
El resultado fue brutal:
- Slack con Pake → 8 MB (en vez de 524 MB)
- Discord con Pake → 9 MB (en vez de 265 MB)
- ChatGPT con Pake → 9 MB (en vez de 260 MB)
Cuatro años después, su repositorio tiene más de 51.000 estrellas en GitHub. Tiene builds listos para Grok, ChatGPT, Gemini, Discord, YouTube, Twitter y muchos más. Todo bajo los 10 MB, ligero, rápido y gratis.
Y lo mejor: con un solo comando puedes convertir cualquier página web en una aplicación de escritorio nativa.
No fundó una startup. No levantó inversión. Solo resolvió un problema que molestaba a millones de personas.
A veces el cambio real lo hace una sola persona que se cansa de las cosas como están.
Esta brutal, repo en los comentarios 👇
The problem
Most notification systems start simple: user does X, and send them a push/email/SMS.
Works fine at 1,000 users.
At 5 million users, that same code brings down your database, floods your SMS provider, and gets your domain blacklisted for spam.
Here's how to actually build one that scales.
So that was the problem Tunde was staring at on a Monday morning, after his "send welcome email" function took down the entire user service during a signup spike.
HICIERON UN CAPCUT GRATIS Y SIN MARCAS DE AGUA, Y TIENE 55K STARS EN GITHUB
CapCut te mete marca de agua, te bloquea funciones y encima te cobra suscripción. Un grupo de devs se cansó y construyó la alternativa open source.
→ Editor de vídeo completo, sin marcas de agua ni paywalls
→ Compatible con web, escritorio y móvil → Open source con licencia MIT
→ Servidor MCP incluido para agentes de IA
→ Se está reescribiendo en Rust desde cero con API, plugins y scripting
Se llama OpenCut y es exactamente lo que CapCut debería haber sido desde el principio.
Te lo explico abajo (link de la repoo también) ⬇️
NativePHP is an open-source framework to build web and mobile apps using only PHP. It creates reactive UIs and native features without writing JavaScript.
https://t.co/F8sSdoS7at
Here are 10 GitHub repos that quietly print money while you sleep.
1. Cal. com
Open-source Calendly. Fork it, white-label it, sell to dentists and lawyers for $200/month. The founders hit $5M ARR in 3 years doing exactly this.
Repo → https://t.co/haz8ihRsHm
2. Plausible Analytics
Privacy-first Google Analytics. Self-host it, resell to agencies for $50/month per client. Two founders bootstrapped this to 7 figures.
Repo → https://t.co/RFrcpqTBQ7
3. Ghost
Open-source Substack with 100% margin. 1,000 readers at $5/month equals $60,000 a year. Forever.
Repo → https://t.co/Z1MdZ5Zapg
4. n8n
Open-source Zapier. Sell automation services for $500-$2,000 per setup. n8n raised $14M because the agency model behind it works.
Repo → https://t.co/hdycABGGc1
5. Supabase
Free Firebase replacement. Build a SaaS in a weekend, charge $29-$99/month. They raised $116M for a reason.
Repo → https://t.co/dFB2QvafA7
6. Medusa
Open-source Shopify. Take 5% on every sale forever. Zero rev share to Shopify.
Repo → https://t.co/uEuCK6zuZO
7. AppFlowy
Open-source Notion. Sell self-hosted to enterprises worried about data privacy. They raised $30M because this market is massive.
Repo → https://t.co/IDMykTCkMU
8. Coolify
Open-source Vercel and Heroku. Charge developers $20/month to manage their deployments. Replace their $200 Vercel bill.
Repo → https://t.co/N5Fk22qraT
9. Listmonk
Open-source Mailchimp. Send unlimited emails for the cost of an AWS bill. Resell to agencies at 10x markup.
Repo → https://t.co/NS6Uukcklw
10. Penpot
Open-source Figma. Sell self-hosted design tools to agencies who refuse to upload client files to the cloud.
Repo → https://t.co/Lx1CYUP4p4
The difference between developers who build features and developers who build businesses is one decision.
Pick one of these. Fork it this weekend. Ship it next week.
The founders behind these repos already proved the model.
Save this. Share it with the developer in your life who deserves to break free.
100% free. 100% open source.