É incrível como o pessoal até hoje engaja em promessa de "hoje faço milhões me segue aí" sem nenhuma prova, sem nenhum histórico de nada, eu sei que é duro ouvir isso mas 99% é shit post e só vão te entregar mais um saas bosta que não agrega em nada
@lucas_montano Eu pago grok, gepeto, Kimi, as vezes um serviço ou outro no taxímetro, considero como um funcionário mais competente que eu e absurdamente barato, tenho certeza que algum empregador meu já me viu assim hahahahaha
Eu pago Kimi versão padrão, grok super e chat gpt pro, o de 5x. Considero como investimento e não custo, é um funcionário muito mais competente que eu em várias coisas e extremamente barato. Tenho certeza que alguns empregadores meus já me viram assim hahahaha
não tem, eu não consigo entender como que um DEV, profissional, com experiência, não consegue pagar uma ou duas assinaturas… é inaceitável
desculpa cara mas todo DEV deveria estar pagando Max 20x ou Codex Pro
recomendo inclusive pagar ambas
> ah Lucas mas nem todo mundo tem dinheiro pra isso, tu está descolado da realidade…
arruma alguém pra pagar pra ti, faz freela, convence teu empregador, não importa.
o custo do token subsidiado pela assinatura é ridículo, e a capacidade dos modelos absurdas. tu TEM QUE conseguir gerar pelo menos $100 de valor com os limites semanais dessas assinaturas.
@AkitaOnRails Talvez seja porque você criou uma puta autoridade palestrando, mantendo blogs e até publicando um livro né Makita, eu te conheci porque um amigo que era palestrante me falou: "conhece o akita? O cara é brabo". Nem lembro que ano era isso, mas faz tempo em... 2015 eu acho
Stocks might be easier than you think
Sen. Ashley Moody invested ~$250,000 into $AMD last year
Her entry price: ~$108
Today: ~$618
She's currently sitting on ~$1,170,000 in unrealized gains
A IA me ajuda muito, mas eu tenho capacidade e conhecimento para questionar as soluções dela e propor melhorias, e assim tenho feito e colocado coisa em produção como nunca fiz antes.
Eu não entendo essa "crise de identidade" toda de alguns devs com IA, eu já gerava bastante código usando IDE, tinha que codar muita coisa na mão o que era um saco, mas o conhecimento de engenharia continua comigo
@reidophotoshops@frodothecat_@Grazinascito E claro, proponho melhorias quando acho que faz sentido, pra mim não é mágica, automatizou uma parte extremamente chata do meu trabalho.
@reidophotoshops@frodothecat_@Grazinascito Eu não tenho sentido isso não, eu já gerava bastante código usando IDE, sério mesmo, claro tinha que codar muita coisa na mão, mas o conhecimento de engenharia continua comigo, a IA me ajuda muito sim, mas eu tenho capacidade e conhecimento para questionar as soluções dela
@AkitaOnRails Lutar contra a IA eu já desisti tem muito tempo, hoje eu só ainda não fechei qual é o melhor workflow, por enquanto sigo no planejar->executar, mas tem uma galera que enfia 50 agents no projeto etc, fico pensando se não estou perdendo algo
@AkitaOnRails@AkitaOnRails você tem usado subagents? Falo em explicitamente delegar revisão ou testes para agents que você mesmo criou, alguma pipeline de agents etc, algum processo de orquestração de tarefas entre eles, ou tem deixado o modelo decidir quando fazer?
@AkitaOnRails Pô mas vou te falar produzir coisa útil não é fácil não... Quando começou toda essa loucura de vários agents e skills eu estava tentando montar um framework/pipeline de ia até perceber que é over engineering pra 99% dos casos, rodar "vanilla" geralmente é mais barato e eficiente
Finalmente! Saiu o resultado do novo LLM Coding Benchmark V4!!
Foram 10 dias rodando 24/7, milhões de tokens e dezenas de horas de compute pra conseguir o melhor benchmark de programação prática que eu consegui até agora.
Re-testei 39 das principais LLMs do mercado, de Astra e Fable, até Deepseek ou GLM, até Qwen 3.8 Max e 27bi Local!
Ficou tão longo, que dividi em 2 partes. Pra entender o histórico, os objetivos, a metodologia, siga pra parte 1:
https://t.co/YnRCjPho5x
Pra ir direto pros resultados, tabela de ranking, análises, prós e contras de cada categoria de modelos, siga pra Parte 2:
https://t.co/d8TJaHQTDJ
A diferença deste V4 em relação aos anteriores é que em vez de mandar fazer um app, agora eu simulo mini-sprints (7 no total), e simulando um programador malicioso externo adicionando código malicioso e bugs sutis pra ver quem consegue chegar até o fim com um app que funcionaria em produção (nada de leetcodes ou similares). E por isso cada execução pode levar mais de 1h (ou 12 horas no caso do Qwen 3.8 27bi local).
Espero que gostem!