NVIDIA ha liberado el código abierto de un modelo de 600M que transcribe 40 idiomas en tiempo real con una latencia de 80 ms y cuesta $0.
Eso es más rápido que parpadear. en mandarín, árabe, hindi, portugués, tagalo, lo que sea, desde un ÚNICO punto de control.
→ 17x más flujos concurrentes que ASR con búfer en el mismo H100.
→ puntuación + mayúsculas integradas. sin posprocesamiento.
→ se ejecuta en tu propia GPU. sin factura de API
100% Código Abierto.
Olvídate de los vector databases.
Tencent acaba de open sourcear tencentDB agent Memory: memoria a largo plazo real para cualquier agente de IA, corriendo 100% local sobre sqlite.
Sin pinecone.
Sin apis en la nube.
Sin tener que repetir todo cada sesión.
Resultados reales:
- Hasta 61% menos tokens
- Precisión en PersonaMem: 48% → 76%
- Cero dependencias externas
- Todo funciona con SQLite plano
En vez de comprimir tu historial en embeddings opacos que fallan cuando más los necesitas, construye una pirámide semántica clara:
L0 Conversación → L1 Átomo → L2 Escenario → L3 Persona
El estado corto plazo se resume en un grafo Mermaid que entra directo en el contexto del agente. Los logs detallados se guardan en disco y puedes volver a ellos al instante usando el `node_id`.
Sin compresión con pérdida. Todo queda en archivos Markdown legibles que puedes abrir y revisar cuando quieras.
Ya tiene más de 8.5k estrellas.
100% open source (MIT).
Enlace en los comentarios 👇