GPT-6.1 Sol não me convenceu em nada, apenas para reforçar que tem algo de estranho nas contas, só pode. Vejo todo mundo falando maravilhas dos limites, mas comigo aqui dá um ou dois Hello e já era.... Opus 5.5 até agora foi a surpresa positiva e olha que nunca fui fan boy Anthropic
Cara, eu não tou sentindo nada disso que vcs estão falando do GPT-6.1, honestamente... Dá dois ou três prompts e pra mim já era e não estou no effort máximo. Não sei o que acontece, mas me parece que eles devem fazer algumas diferenciações para determinadas contas, só pode. Tenho visto muita gente falando maravilhas dos limites, mas no meu caso, não vi grande diferença pro Astra, basta um oi e acabou!
Já o Opus 5.5 realmente é uma máquina
@rafaquint Even with $20 plan, really impressive. It's the first time that I'm seeing an Anthropic model that fits my daily demands. On the other end, Grok 4.7 which I've the $300 plan is really disappointing so far, let's see if they will release an update to this, otherwise...
Primeira atualização do ranking do LLM Benchmark v4:
Opus 5.5, GPT Sol/Luna 6, Mimo 2.6, Grok 4.7 no páreo, e surpresas nos números, leiam:
https://t.co/lLbtM7AiuT
Parece que "pace the frontier" não durou nem 2 semanas pro Dario. E parece que os chineses não ligaram também kkkk