Blog · Rafique AI

IA na prática, testada antes de virar post.

Agentes, custos, ferramentas e o que dá certo em produção. Sem hype e com fonte.

Novidade de IA

19 artigos
Novidade de IA

GPT-6.1 Sol: preços, benchmarks e limites do novo modelo

O GPT-6.1 Sol chega com 1,05 milhão de tokens de contexto e preço de US$ 2/10 por milhão de tokens. Veja como ele se compara ao GPT-6 Astra, ao Opus 5.5 e em quais tarefas vale testar — sem ignorar os limites.

30 de set. de 20266 min
Codex no DevDay 2026: nuvem, voz e segurança
Novidade de IA

Codex no DevDay 2026: nuvem, voz e segurança

As novidades anunciadas para o Codex no fórum oficial de desenvolvedores da OpenAI em 29/09/2026. Veja o que muda no uso em nuvem, no CLI, em code review, na segurança e na velocidade — com os limites que você precisa considerar.

29 de set. de 20266 min
Dots: o guia completo dos agentes sempre ativos da OpenAI
Novidade de IA

Dots: o guia completo dos agentes sempre ativos da OpenAI

Os Dots são agentes da OpenAI com computador e navegador próprios na nuvem. Neste guia, você entende como eles funcionam, onde podem ser usados, quem tem acesso e quais cuidados tomar antes de delegar tarefas importantes.

29 de set. de 20265 min
GPT-6.1 Sol: benchmarks, preço da API e limites da comparação
Novidade de IA

GPT-6.1 Sol: benchmarks, preço da API e limites da comparação

O GPT-6.1 Sol promete quase o desempenho do Astra por uma fração do custo, segundo a OpenAI. Veja os preços da API, os resultados divulgados nos benchmarks e o que ainda precisa ser considerado antes de tirar conclusões.

29 de set. de 20265 min
OpenAI DevDay 2026: GPT-6.1 Sol, dots, Ultrafast e Codex Cloud
Novidade de IA

OpenAI DevDay 2026: GPT-6.1 Sol, dots, Ultrafast e Codex Cloud

O que a OpenAI anunciou para quem constrói com IA: o GPT-6.1 Sol, agentes dots com computador próprio, Ultrafast, Codex Cloud, Plugin Extensions e Agents API. Reunimos os pontos principais, os preços divulgados e os limites que você precisa conhecer antes de testar.

29 de set. de 20265 min
Novidade de IA

Jeff: o modelo de 0,8B que decide em 22 ms

Jeff é um modelo pequeno para escolher uma opção entre várias, sem treinamento prévio. Veja os números do README, onde ele se aproxima do Jev e por que não deve ser tratado como um modelo de raciocínio.

29 de set. de 20266 min
Claude Sonnet 5.5 x Opus 5.5: quando usar cada modelo
Novidade de IA

Claude Sonnet 5.5 x Opus 5.5: quando usar cada modelo

O Sonnet 5.5 superou o Opus 5.5 no Terminal-Bench 4.0 e custa menos por milhão de tokens. Veja o que os números mostram, onde o Opus ainda leva vantagem e como montar uma estratégia Sonnet primeiro.

29 de set. de 20265 min
A IA que não escreve nada — o Jev só decide: escolhe, pontua ou responde sim/não
Novidade de IA

Jev, da TypeSafe AI: o que é a IA que não escreve nada (e só decide)

O Jev não é chatbot nem agente: você manda um texto e perguntas fechadas, e ele devolve sim/não, uma escolha ou uma nota, com a probabilidade junto. Custa $0,042 por milhão de tokens de entrada e a saída é grátis. O que é, quem fez, quanto custa de verdade e onde ele falha.

23 de set. de 20266 min
LLM escreve. Jev decide. Código executa.
Novidade de IA

Jev na prática: LLM escreve, Jev decide, código executa

O jeito certo de usar o Jev não é trocar o seu LLM, é dividir o trabalho. Primeira chamada, o padrão de agente, a conta real de 100 mil tickets por dia e os dois lugares onde ele engana: não é determinístico, e rotear tudo pode sair mais caro.

23 de set. de 20265 min
Jev é tudo isso? Lemos a letra miúda.
Novidade de IA

Jev: hype vs realidade — de onde vêm o "193,6x" e o "não alucina"

A TypeSafe diz que o Jev é 193,6x mais rápido e 444,6x mais barato. Um teste da comunidade achou 72,2% de acerto quando ele dizia ter 90% ou mais de confiança. Os dois números são reais; eles só medem coisas diferentes. Lemos a letra miúda.

23 de set. de 20266 min
Claude Opus 5.5 vs GPT-6 Astra — 2,5x mais barato e na frente em código
Novidade de IA

Claude Opus 5.5 vs GPT-6 Astra: preço, benchmarks e quando usar cada um

A Anthropic lançou o Claude Opus 5.5 custando 2,5x menos por token que o GPT-6 Astra e na frente em código e trabalho de escritório na tabela oficial. Mas o Astra ainda ganha em ciência e automação entre apps — e preço por token não é custo por tarefa. O deep dive completo, sem hype.

23 de set. de 20268 min
Claude Opus 5.5 trabalhou 18 horas sozinho
Novidade de IA

Claude Opus 5.5 trabalhou 18 horas sozinho: o que muda para agentes de IA

Um dev deixou o Claude Opus 5.5 rodando a madrugada inteira em seis repositórios. Ele ficou mais de 18 horas no ar e entregou. "IA que trabalha enquanto você dorme" deixou de ser slide de pitch — mas só funciona com tarefa bem definida, testes, limite de gasto e trava nas ações perigosas.

23 de set. de 20267 min
O modelo mais barato pode sair mais caro — custo por tarefa
Novidade de IA

Preço por token engana: o custo real por tarefa do Claude Opus 5.5 e do GPT-6 Astra

O Opus 5.5 custa 2,5x menos por token que o GPT-6 Astra. Isso não quer dizer que sua conta vai cair 2,5x. Modelo que pensa mais gasta mais — e cache, esforço e a regra dos 272K mudam o resultado. A conta completa, com exemplos.

23 de set. de 20266 min
Trocou para o Opus 5.5? Seu código pode quebrar
Novidade de IA

Migrar para o Claude Opus 5.5: 4 mudanças que quebram seu código (e uma silenciosa)

Trocar claude-opus-5 por claude-opus-5-5 não é só mudar uma string. Thinking obrigatório, tool_choice forçado dando erro, blocos de thinking presos à conversa, computer use novo — e um app que fica mudo entre chamadas de ferramenta sem nenhum erro. Checklist com antes e depois.

23 de set. de 20266 min
Opus 5.5 e o pacing da Anthropic — IA de ponta com travas
Novidade de IA

Opus 5.5 e o "pacing": por que a Anthropic lança IA de ponta com travas

O Opus 5.5 é comparável ao Claude Mythos 5.1 em biologia e cibersegurança — por isso saiu com salvaguardas de nível Fable 5.1 e acesso verificado para essas áreas. Na mesma semana, Dario Amodei defendeu cadenciar o progresso da IA. O que isso significa na prática e o que muda para quem usa.

23 de set. de 20269 min
Grok Bot — material oficial xAI
Novidade de IA

Grok Bot (xAI): papéis oficiais, diferença do chat e como começar

A xAI posiciona o Grok Bot como trabalhador autônomo na sua stack — CRM, e-mail, planilha, desktop na nuvem. Ter o bot ligado não substitui processo, dono interno nem evidência. Este guia traduz o produto oficial e mostra onde encaixa (e onde não encaixa) numa operação brasileira.

22 de set. de 20267 min
Anúncio oficial da Anthropic sobre o Claude for Small Business
Novidade de IA

Claude for Small Business: 43 fluxos e 27 integracoes novas

A Anthropic expandiu o Claude for Small Business — lançado em maio, já instalado mais de 900 mil vezes — pra 43 fluxos prontos e 27 integrações novas, incluindo Shopify, Salesforce, Stripe e Zapier.

22 de set. de 20263 min
GPT-6 Astra — anúncio oficial OpenAI
Novidade de IA

GPT-6 Astra: não é só mais um ChatGPT

O modelo mais capaz da OpenAI chegou — raciocínio, código, computer use e trabalho profissional. Ter acesso não é a mesma coisa que ter resultado no negócio. Este guia mostra o que mudou e como implementar com método.

22 de set. de 20263 min
TypeSafe AI — Introducing System One Models & Jev
Novidade de IA

Jev explodiu. Pouca gente entendeu o que ele é.

Jev (TypeSafe AI) não escreve texto e não é "mais um agente". É um modelo System One: recebe estado + perguntas tipadas e devolve Choice, Score ou Noul com confiança calibrada — para o seu código decidir o próximo passo.

22 de set. de 20263 min

Receba os próximos artigos

O que a gente testou de IA na prática — agentes, custos e ferramentas — direto no seu e-mail. Sem hype e sem spam.

Blog da Rafique AI: IA na prática, sem hype