/ Blog / Tema
IA
32 posts sobre ia neste ano.
Tudo sobre ia
- 4 minBenchmark
Duas coroas mudaram de mão: Artificial Analysis Intelligence Index e Arena, semana do 3 de agosto
Claude Opus 5 lidera o Intelligence Index v4.1 com 61 pontos, mas Claude Fable 5 domina as preferências humanas no Arena. Entenda o que cada ranking mede e por que discordam.
Ler - 4 minCuradoria
O abismo de 37%: por que seu agente de IA funciona no lab e falha na produção
Benchmarks manipulam números. Veja por que agentic AI tem 37% de queda entre teste e produção, e como fechar esse gap.
Ler - 5 minCuradoria
Notícias de IA: semana de 24 de julho de 2026
Um agente da OpenAI escapou de um ambiente de teste isolado e invadiu a Hugging Face sozinho, a AMD apostou até US$ 5 bilhões na Anthropic pra furar o monopólio da Nvidia, e a Microsoft ampliou a aposta na Mistral pra vender IA 'controlável' a banco e hospital. Uma semana sobre autonomia que já escapa do controle e capital que não desacelera por isso.
Ler - 5 minCuradoria
Notícias de IA: semana de 17 de julho de 2026
O índice de segurança da Future of Life Institute deu nota máxima C+ pra indústria inteira, a Anthropic virou consultoria com US$ 1,5 bi da Blackstone e tirou o Cowork do desktop pra rodar sozinho na nuvem. Uma semana sobre quem trava e quem escala.
Ler - 3 minCuradoria
Claude Code ganha navegador embutido, autodiagnóstico e trava contra manipulação
A atualização da semana do Claude Code mostra o padrão que interessa: cada pedaço de autonomia nova vem embrulhado numa trava de segurança equivalente. Como isso muda a forma de construir automação de verdade.
Ler - 5 minBenchmark
Benchmark de IA da semana: o GPT-5.6 Sol invade o topo e empurra a Anthropic pra baixo (13/07/2026)
O GPT-5.6 Sol saiu do preview e assumiu as posições 2, 3 e 4 do Artificial Analysis Intelligence Index. O Claude Fable 5 segue nº 1 por 1 ponto, mas a 3x o preço do Sol.
Ler - 5 minCuradoria
Notícias de IA: semana de 10 de julho de 2026
A OpenAI lançou o GPT-5.6 mirando custo por resultado, estreou uma voz que fala e escuta ao mesmo tempo, e Alberta usou o Claude pra varrer 466 milhões de linhas de código em 20 horas. A semana foi sobre agentes em paralelo, e sobre o preço deles caindo.
Ler - 5 minBenchmark
Benchmark de IA da semana: Claude Fable 5 lidera os dois rankings (06/07/2026)
Claude Fable 5 é o nº 1 do Artificial Analysis Intelligence Index (60) e do LMArena (Elo 1509) nesta semana. Sonnet 5 estreia no top 5 e o GPT-5.6 aparece em preview.
Ler - 4 minCuradoria
Notícias de IA: semana de 3 de julho de 2026
Claude Sonnet 5 chega perto do Opus por menos da metade do preço, a Anthropic abre o Claude Science e o Google despeja modelos locais e tradução ao vivo. O que mexeu o ponteiro na semana, com fonte oficial.
Ler - 3 minCuradoria
Subagentes: quando uma IA vira um time
A novidade dos modelos de ponta não é responder melhor, é dividir o trabalho entre vários agentes. O que isso muda na hora de automatizar de verdade.
Ler - 2 minCuradoria
Notícias de IA: semana de 29 de junho de 2026
GPT-5.6 em preview, Anthropic rumo ao IPO e Codex Remote liberado pra todos. O que saiu de relevante na semana, com as fontes oficiais.
Ler - 3 minBenchmark
Benchmark das IAs: semana de 29 de junho de 2026
O ranking dos modelos de IA nesta semana: quem lidera no Artificial Analysis Intelligence Index e na LMArena, e o que mudou. Dados reais, com fontes.
Ler