Para cerrar: la consulta sobre cancelar, reembolso y datos divide a Jev y Laya; quizá hacen falta varios documentos. Y ante el horario telefónico, que no figura en ninguno, ambos igual eligen uno. Próximo paso: permitir varios o "ninguno". ¿Qué opinan?
Seguí con dos consultas: un código de verificación que no llega y cómo navegar con el teclado. Jev eligió seguridad y manual de usuario; Laya, privacidad y términos. En ambos casos me convencen más las elecciones de Jev, aunque Laya volvió a responder más rápido con mi setup.
Con otras dos consultas volvieron a coincidir: para una factura que no aparece, facturacion_y_reembolsos.md; para una API key que devuelve 401, integraciones_y_api.md. Laya respondió más rápido en ambas. Cuando la pregunta apunta a un tema claro, los dos acertaron el doc.
Empecé a escribir: "¿Qué precio tiene la suscripción anual?". Antes de pulsar Enviar Jev y Laya ya sugerían planes_y_precios.md. Eso es lo que quería probar: si el agente puede tener una pista de qué consultar antes de que le llegue la pregunta, con mi setup Laya fue más velóz
Explorando qué se puede hacer con Jev y Laya, que (los de moda), me pregunté si podrían ayudar a un agente de soporte a preparar el contexto mientras el usuario escribe su mensaje. El contexto es clave para un LLM, así que armé una startup ficticia con 7 documentos. 🧵
@0xTobiasDev Si la tarea del modelo es precisamente elegir qué herramienta usar, entonces cuando elige mal… ¿no es el modelo el que está fallando? Mira la instrucción que le di, lo curioso es que solo falló con esa pregunta, le hice otras y elige bien.
De repente apareció Jev y abrió un mundo de posibilidades. A los pocos días salió Laya. Ambos están hechos para tomar decisiones, y me quedó dando vueltas una pregunta: ¿cómo funcionarían dentro del loop de un agente? Se me ocurrió montar una prueba sencilla, abro hilo🧵
En la segunda prueba: «¿Cuánto cuesta un env��o exprés a Cali?» Jev eligió cotizar; Laya no llamó ninguna herramienta. Lo raro: asignó 99,9 % a «ninguna de estas ciudades», aunque Cali estaba en el texto. Faltan pruebas y ajustes. ¿Ya los usaron en agentes? ¿Cómo les fue?
Y hubo otra sorpresa: en esa corrida Laya respondió en 581.2 ms y Jev en 1183.9 ms. El modelo local fue más rápido en esta primera prueba. No alcanza para sacar conclusiones sobre velocidad, pero me dieron ganas de seguir midiendo.
¡Todos los cursos de Platzi estarán abiertos, sin suscripción, por los próximos 3 días!
Compártelo con tu empresa y amigos ya mismo:
https://t.co/bs18jWEqNb
‼️ Mañana y por 48 horas, podrás aprender de Inteligencia Artificial, Ciberseguridad, Desarrollo Web, Inglés. Sin suscripción a Platzi.
Los cursos estarán abiertos por dos días, para ti, que en épocas de disrupción, te vuelves mejor.
Regístrate en https://t.co/CAn2BdJd5f
#PlatziDay
Finalizamos el año broche de oro, todos bienvenidos al meetup del próximo 21 de noviembre https://t.co/KH5SDRJzuQ, en esta oportunidad un Meetup en conjunto entre Manizales Tech Talk, @PerTechTalks y @pionerasdev. Con dos speakers de grandes ligas.
Solo tenemos motivos para agradecer🚀
A todos los que votaron por nuestro proyecto, mil gracias.
A quienes aún no nos conocen los invitamos a visitar: https://t.co/wypJ8hLN0T
------
We're grateful to have been chosen and thrilled for the journey ahead. 🧡 https://t.co/ZnsySdTv36