Created a new 3D model using @tripoai, and I'm seriously impressed. Generate production-ready 3D models from text or images in seconds. See the model here: https://t.co/c7NsXFCcsi
#TripoAI#3DGeneration#GenAI#3DPrinting#3D
Version 1.0.0 of #AutoRemesher will be released soon! More adaptive edge flow, more reliable remeshing, better handling for sharp edges, Better handling for lowpoly source mesh. https://t.co/AH1ozSUYbU
📢TriFlow: Generating Artist-Like 3D Mesh Topology via Nearest-Vertex Vector Fields (ECCV'26)📢
Compact 3D meshes with clean, artist-like triangle topology - structured connectivity you'd expect a human modeler to make🙂
🌐https://t.co/PsrCkwUrCJ
▶️https://t.co/nlLTliWEEa
NVIDIA acaba de eliminar uno de los mayores cuellos de botella en los modelos de visión + lenguaje.
Se llama LocateAnything y usa Parallel Box Decoding:
En vez de generar las coordenadas de cada bounding box token por token un proceso lento cuando hay muchos objetos, ahora predice la caja completa en un solo paso.
Resultados:
→ 12.7 cajas por segundo en una sola H100
→ 10x más rápido que Qwen3-VL
→ +3.8% F1 en LVIS (la precisión también mejoró)
→ Solo 3B parámetros y corre en GPU de consumidor
Al tratar la caja como una unidad completa, se mantiene la coherencia geométrica entre coordenadas, lo que explica por qué no solo es más rápido sino también más preciso.
Un solo modelo que maneja detección de objetos, GUI grounding, OCR y comprensión de documentos. Ideal para agentes, robótica y flujos de trabajo con documentos.
100% open source pesos, código, demo y paper disponibles.
Enlace en comentarios, te recomiendo guardar 👇
Un laboratorio chino acaba de humillar a media industria del video.
Subes una foto y un audio, sale un avatar hablando en sincro. Open source.
Lo que antes era agencia, cámara y edición ahora parece un repo.
Se llama LongCat-Avatar.