Claude Fable 5.1 me tornou um pelicano animado muito legal

Claude Fable 5.1 me tornou um pelicano animado muito legal
1º de setembro de 2026
Hoje é dia de Claude Fable (e Mythos) 5,1. A Anthropic afirma que o Fable 5.1 “estabelece um novo padrão para codificação, trabalho de conhecimento e tarefas de resolução de problemas de longa duração”. Seu anúncio dedica uma quantidade notável de tempo à pesquisa científica, ostentando uma pontuação de 52,6% no novo benchmark Terminal-Bench-Science 0.1 (anunciado pela primeira vez em 27 de agosto), acima dos 24,7% para Fable 5, 29,0% para Opus 5 e 22,4% para GPT-5.6 Sol. Outros benchmarks mostram pontuações ligeiramente melhoradas, mas nenhuma tão impressionante quanto a da Science.
Mas quão bem pode ser o pelicano?
Em julho, escrevi sobre como estava perdendo a fé no benchmark Pelican – sua conexão com a qualidade dos modelos em outras tarefas não parecia se manter tão forte quanto em 2025. Os insights mais interessantes que obtenho dele agora são comparações dentro de famílias de modelos e, particularmente, comparações para o mesmo prompt em diferentes níveis de esforço de raciocínio.
Fable 5.1 tem cinco níveis de raciocínio: baixo, médio, alto, xalto, máximo – e nenhuma opção para desligar totalmente o raciocínio.
Corrigi um problema no llm-anthropic que fazia com que os rastros de raciocínio não fossem registrados corretamente e, em seguida, executei alguns prompts.
Aqui está o conjunto completo de pelicanos para todos os níveis de raciocínio, cada um com a transcrição completa do raciocínio. Vou replicá-los aqui:
Baixo e médio, ambos sem raciocínio?
A seguir, um pouco de mistério. Isso é o que consegui com esforço low:

A transcrição não mostra nenhum token de raciocínio resumido e a contagem de tokens de saída é 1.998. Com Claude, essa contagem de tokens de saída inclui tokens de raciocínio. Demorou 23,8 segundos e custou 10,017 centavos.
Eu aumentei isso para medium e consegui isso:

Estranhamente, esse também não mostra nenhum texto de raciocínio e usou 1.977 tokens de saída – 21 tokens menos que low. Demorou 23 segundos e custou 9,912 centavos.
Portanto, para este prompt específico (“Gerar um SVG de um pelicano andando de bicicleta”), a Fábula 5.1 pareceu pular totalmente o raciocínio em ambos low e medium configurações.
Alto
Aqui está high—29,6 segundos, 2.612 tokens de saída, 13,087 centavos:

Este fez um pedaço de raciocínio, resumo aqui:
Estou planejando o layout SVG de um pelicano andando de bicicleta, com fundo de céu e chão, uma bicicleta com duas rodas raiadas, quadro, assento e guidão, e um pelicano de corpo branco com pescoço longo e bico laranja posicionado no topo.
Realmente não há muita diferença de low e mediumno entanto.
No xhigh as coisas ficaram radicalmente diferente. 36.767 tokens de saída, 7 minutos e 51 segundos, US$ 1,83!

O rastreamento de raciocínio é bastante extenso e inclui detalhes como este:
Adicionando o olho, asas que se estendem até o punho do guidão, pernas laranja chegando aos pedais e uma pequena pena na cauda, mantendo o pelicano intencionalmente superdimensionado em comparação com a bicicleta para efeito cômico. (…)
Aceitarei a leve espessura como encantadora, em vez de exagerá-la.
Máx.
Definir o esforço para max me deu o melhor pelicano que já vi em qualquer um dos modelos da Anthropic. 65.927 tokens de saída, 13 minutos e 54 segundos, US$ 3,30:

Há muito o que gostar nisso. O fundo é de bom gosto, as pernas estão claramente de cada lado do quadro, os pés estão nos pedais, a asa está no guidão, o pelicano tem um lindo chapéu azul e há uma cesta com um peixe.
Ainda não está mostrando o mesmo nível de talento do Gemini 3.7 Flash, mas eu não perguntar para ter talento – pedi um SVG e foi isso que consegui.
Alguns destaques desse traço de raciocínio:
Adicionando formas de pedais perto de ambos os pés, com o pé mais distante da segunda perna parcialmente visível atrás do quadro. Estou pensando em adicionar um pequeno lenço ou boné para dar mais personalidade, mas estou inclinado a mantê-lo simples para evitar confusão.
Agora estou debatendo um capacete de bicicleta na cabeça versus o brasão característico do pelicano – o bico e a bolsa já podem ser lidos claramente como “pelicano”, então um capacete poderia reforçar o tema da bicicleta sem perder a identidade, embora pudesse competir com o brasão em termos de espaço visual.
Sei que o bico em (484,84) se sobreporia ao capacete dome, então preciso encolher o capacete para que cubra apenas o topo da cabeça, ajustando as extremidades do arco para ficar mais alto e mais estreito para que o bico possa se fixar de forma limpa na frente sem colisão. (…)
Estou adicionando uma região de ponta mais escura para representar as penas primárias e, em seguida, reconsiderando a borda posterior para incluir curvas de penas recortadas em vez de uma linha suave para uma aparência mais natural. (…)
Agora estou verificando o posicionamento das linhas de ventilação no capacete, certificando-me de que elas fiquem suficientemente dentro da borda do capacete, dada a largura do traçado e as tampas arredondadas, e confirmando que cada ventilação permanece dentro do limite circular do capacete. (…)
Decido pular a campainha do guidão e os destaques dos pneus, pois são acréscimos desnecessários. Agora estou reconsiderando a curva do garfo dianteiro – o ponto de controle atual puxa a forma para trás quando deveria se curvar para frente para obter uma inclinação adequada, então preciso deslocar o ponto de controle para a direita para corrigir a inclinação do garfo.
OK, vamos animá-lo
No Hacker News, Swalsh comentou sobre o Max Pelican:
Agora que o benchmark foi resolvido, podemos obter a versão animada?
Eu não queria gastar mais US$ 3, então peguei o Max Pelican e coloquei-o no nível de pensamento padrão Alto:
llm logs -cx | llm -m claude-fable-5.1 -s 'animate this'
6.121 entradas, 26.201 saídas = $ 1,37. O resultado ficou assim, exportado aqui como vídeo, pois algumas pessoas têm dificuldade para visualizar SVGs animados:
As rodas estão girando na direção errada, mas fora isso é uma animação muito boa derivada daquele SVG original.






