O melhor modelo diário de IA


A Anthropic acaba de lançar Claude Sonnet 5. Soneto. Tive que dizer isso duas vezes.

É o filho do meio da família Claude, e aquele que a maioria das pessoas realmente usará. É rápido, capaz, barato de operar e de uso gratuito para todos os usuários sem qualquer assinatura.

Neste artigo, examinamos a última iteração da família Soneto de Claude com Soneto 5. Nós o colocamos à prova para ver se suas afirmações de agente tinham alguma verdade ou não. E como um usuário common de Claude é impactado com esta atualização gratuita.

O modelo do povo

O melhor modelo diário de IA
Disponível para todos os usuários

Sonnet 5 é agora o modelo padrão para todos os usuários. Se você usa o Claude sem pagar, é com esse modelo que você está falando. Opus permanece com um plano pagoentão, para a maioria das pessoas, o Soneto 5 é simplesmente o que Claude é. Em suma, as seguintes melhorias foram feitas:

  • Acompanhamento da tarefa: conclui tarefas complexas de várias etapas completamente, em vez de parar cedo.
  • Autoverificação: verifica e confirma seu próprio trabalho sem ser solicitado.
  • Uso de ferramenta agente: planeja, usa ferramentas, executa e analisa seus próprios resultados.
  • Custo mais baixo: mais barato por token do que o Opus, com desconto no preço de lançamento.
  • Confiabilidade aprimorada: recusa melhor pedidos ruins e tem alucinações com menos frequência.

Conheça a família

Claude vem em três tamanhos. Haiku é o mais rápido, Opus é o peso pesado e Sonnet fica confortavelmente no meio.

Aqui está a parte que vale a pena observar: o Sonnet acabou de mudar para a versão 5. O Haiku ainda é 4.5 e o Opus é 4.8, então O Sonnet 5 é o modelo reconstruído mais recentemente de toda a linha.

Famílias Modelo Claude
Modelo Versão Melhor para Gratuito para usar?
Haiku4,5Perguntas rápidas e simplesSim
Soneto5A maior parte do trabalho diário e tarefas reaisSim (seu padrão)
obra4.8Os problemas mais difíceis e profundosNão (planos pagos)

Custa menos

Executar o Sonnet 5 é muito mais barato do que executar o Opus. No momento está ainda mais barato, graças a um preço de lançamento que vai até o remaining de agosto. Para quem executa muito, essa lacuna aumenta rapidamente.

Custo do Soneto 5 vs Opus 4.8 por token
Quando Para ler sua entrada Para escrever sua resposta
Agora, até 31 de agosto de 2026US$ 2 por 1 milhão de tokensUS$ 10 por 1 milhão de tokens
A partir de 1º de setembro de 2026US$ 3 por 1 milhão de tokensUS$ 10 por 1 milhão de tokens

Foco Agentic: O que ele realmente faz

O Soneto 5 não apenas conversa. Ele pode assumir uma tarefa e realizá-la. Ele faz um plano, usa ferramentas como um navegador da internet e seus arquivos, faz o trabalho e verifica sua própria resposta antes de devolvê-la.

Foco Agente em Claude Soneto 5

A grande mudança em relação à última versão é que termina o trabalho. Modelos anteriores muitas vezes paravam no meio de tarefas mais longas. O Soneto 5 tende a acompanhá-los e se verifica novamente sem ser solicitado.

Também é um pouco mais seguro entregar as coisas. É melhor recusar pedidos duvidosos, é mais difícil de enganar e inventa coisas com menos frequência do que o Soneto anterior (algo que muitas pessoas podem não gostar).

Prática: testando as capacidades da agência

Teste 1: Capacidades Agentes

Create a short lived Python undertaking referred to as agentic_sonnet_test. Inside it, create these recordsdata precisely: 

# cart.py
class Cart:
    def __init__(self):
        self.objects = ()
    def add(self, identify, worth, amount=1):
        self.objects.append({"identify": identify, "worth": worth, "amount": amount})
    def subtotal(self):
        return sum(merchandise("worth") for merchandise in self.objects)
    def low cost(self):
        complete = self.subtotal()
        if complete > 100:
            return complete * 0.1
        return 0
    def complete(self):
        return self.subtotal() - self.low cost()
    def receipt(self):
        strains = ()
        for merchandise in self.objects:
            strains.append(f'{merchandise("identify")}: ${merchandise("worth")}')
        strains.append(f"Whole: ${self.complete()}")
        return "n".be a part of(strains)


# test_cart.py
from cart import Cart
def test_subtotal_uses_quantity():
    cart = Cart()
    cart.add("E-book", 10, amount=3)
    cart.add("Pen", 2, amount=5)
    assert cart.subtotal() == 40
def test_discount_applies_at_100_or_more():
    cart = Cart()
    cart.add("Keyboard", 100, amount=1)
    assert cart.low cost() == 10
def test_total_after_discount():
    cart = Cart()
    cart.add("Monitor", 150, amount=2)
    assert cart.complete() == 270
def test_receipt_shows_line_totals_and_quantity():
    cart = Cart()
    cart.add("E-book", 10, amount=3)
    receipt = cart.receipt()
    assert "E-book x3: $30" in receipt
    assert "Subtotal: $30" in receipt
    assert "Low cost: $0" in receipt
    assert "Whole: $30" in receipt

Do the next:
1. Run the exams.
2. Examine the failure output.
3. Repair the implementation in cart.py.
4. Re-run the exams.
5. Hold debugging till all exams go.
6. Don't edit the exams.
7. On the finish, present:
   - the ultimate cart.py
   - the precise check command you ran
   - the ultimate check consequence
   - a brief clarification of what was damaged and the way you mounted it

Resposta:

Capacidades Agentes em Claude Sonnet 5

Veredicto: O Sonnet 5 executou os testes antes de tocar em qualquer código, diagnosticou três bugs separados em vez de corrigir cegamente e nunca editou o arquivo de teste para forçar a aprovação. Em seguida, ele executou tudo novamente para confirmar se a correção realmente foi realizada. Depuração cuidadosa e disciplinada que fecha o ciclo corretamente, em vez de apenas reivindicar sucesso.

Teste 2: Uso de Ferramentas + Planejamento + Autocorreção

Incitar:

I’m making an attempt to decide on the simplest on-line atmosphere for operating small Python experiments with a terminal. Examine Replit, GitHub Codespaces, and Google Colab utilizing present official docs or assist pages. For every one, verify whether or not it helps:

• creating recordsdata
• operating shell or terminal instructions
• putting in packages
• saving or sharing the workspace
• lowest-friction setup for a newbie

Please don’t depend on reminiscence. Confirm from sources.

On the finish, give me:
• a comparability desk
• your suggestion
• hyperlinks to the pages you checked
• something you’re unsure about

Resposta:

Uso de ferramentas + planejamento + autocorreção em Claude Sonnet 5

Veredicto: O Sonnet 5 ignorou a dependência da memória e verificou a documentação actual de cada plataforma, comparando as três com os mesmos critérios para que nada parecesse desequilibrado. Terminou com uma recomendação honesta, ao mesmo tempo que assinalava onde estava o seu próprio julgamento. subjetivo. Completo, bem fundamentado e refrescantemente aberto sobre seus limites.

Observação: Eu uso a assinatura Professional. No Sonnet 5 com nível de pensamento Médio, cerca de 3-5% do limite de uso foi usado por tarefa de agente. Isso é supereficiente.

Conclusão

O Soneto 5 não está tentando ser o modelo mais inteligente do planeta. A Opus ainda possui os problemas mais difíceis. É tentar ser aquele que você procura todos os dias.

Portanto, não apenas os recursos regulares de resolução de problemas dos modelos Sonnet melhoraram, mas também o uso esgotado para fazer o mesmo é muito menor (devido ao uso de um modelo Sonnet em vez de um modelo Opus). Isso leva a conversas mais longas/densas, sem o medo de que o limite de uso chegue.

No geral, os usuários finais que talvez não tenham uma assinatura acabaram de obter uma atualização do modo padrão. Quanto àqueles com assinatura, não acho que o Sonnet 5 assumiria o controle de suas cargas de trabalho do Opus 4.8. Quando se trata de usá-los through API, a conversa é completamente diferente.

Perguntas frequentes

Q1. O que é Claude Soneto 5?

A. Claude Sonnet 5 é o modelo da Anthropic de 30 de junho de 2026 desenvolvido para tarefas de agente, codificação, uso de ferramentas e trabalho profissional diário.

Q2. O uso de Claude Sonnet 5 é gratuito?

R. Sim. É o modelo padrão para usuários Gratuitos e Professional, enquanto o Opus permanece nos planos pagos.

Q3. Quanto custa Claude Soneto 5?

R. O preço da API começa em US$ 2 de entrada e US$ 10 de saída por 1 milhão de tokens até 31 de agosto de 2026.

Sou especializado em revisar e refinar pesquisas, documentação técnica e conteúdo orientados por IA relacionados a tecnologias emergentes de IA. Minha experiência abrange treinamento de modelos de IA, análise de dados e recuperação de informações, o que me permite criar conteúdo que seja tecnicamente preciso e acessível.

Faça login para continuar lendo e desfrutar de conteúdo com curadoria de especialistas.

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *