Edições
Todo sábado uma nova. Aqui ficam todas — numeradas como autos, pra você folhear de trás pra frente ou caçar aquela que perdeu.
9 edições publicadas
2026
- Nº 009 IA em Cognição Nada Exauriente A Anthropic lançou o Claude Opus 5 pelo mesmo preço do modelo que ele substitui, três dias depois de o Google publicar três variantes do Gemini Flash que operam um computador sozinhas. Na mesma semana, a OpenAI explicou por que dois de seus modelos, rodando com os filtros de segurança desligados de propósito num teste interno, escaparam do ambiente isolado e invadiram os servidores da Hugging Face. Para quem trabalha com direito, o item mais concreto não veio de laboratório nenhum: dois advogados americanos publicaram o DingDuff, um conector gratuito que liga o Claude a bases de jurisprudência e legislação e que, no teste dos próprios autores, bate as ferramentas pagas das gigantes de pesquisa jurídica.
- Nº 008 IA em Cognição Nada Exauriente Dois modelos gigantes de pesos abertos chegaram na mesma semana, e o maior deles tem 2,8 trilhões de parâmetros. A chinesa Moonshot lançou o Kimi K3, que a avaliação independente da Artificial Analysis põe no mesmo patamar do Claude Opus 4.8; e a Thinking Machines, de Mira Murati, estreou o Inkling — entende texto, imagem e áudio — sob a licença mais permissiva que existe. No terreno da segurança, a OpenAI abriu a caixa do GPT-Red, um modelo treinado só para atacar outros modelos, e usou-o para endurecer o GPT-5.6 Sol contra a injeção de prompt. No Brasil, um agente de câmbio do Banco do Brasil cortou 90% do tempo da operação e um modelo brasileiro de leitura de documentos bateu os gigantes em português.
- Nº 007 IA em Cognição Nada Exauriente Em poucos dias saíram dois modelos de ponta, e nenhum dos dois quis falar de potência: falaram de preço. A OpenAI publicou a família GPT-5.6 (Sol, Terra e Luna) e a xAI soltou o Grok 4.5, ambos vendendo a mesma promessa de entregar mais gastando menos por tarefa. No terreno que toca quem advoga, a Anthropic detalhou o Claude for Legal, sua camada de IA feita sob medida para o direito, no momento em que um novo teste de pesquisa de jurisprudência mostra que mesmo o melhor modelo ainda erra mais da metade das questões. E, dentro do laboratório, a Anthropic abriu uma janela para o pensamento do próprio modelo — uma ferramenta que flagrou o instante exato em que ele decide inventar uma resposta falsa.
- Nº 006 IA em Cognição Nada Exauriente A Anthropic publicou o Claude Sonnet 5, com janela de contexto de 1 milhão de tokens e raciocínio que se ajusta sozinho ao tamanho do problema, encostando no modelo topo de linha da casa por preço menor. O Free Law Project ligou sua base de jurisprudência americana — o CourtListener — direto ao Claude, ancorando a pesquisa jurídica em decisões reais e auditáveis em vez do palpite do modelo. E a OpenAI lançou o GeneBench-Pro, um teste que não mede o que o modelo sabe, mas o julgamento de quem separa sinal de ruído, o último território a cair.
- Nº 005 IA em Cognição Nada Exauriente A OpenAI abriu o preview do GPT-5.6 e partiu a própria família em três modelos com nome de corpo celeste — Sol, o carro-chefe; Terra, o equilibrado; Luna, o barato. A Anthropic colocou o Claude Tag dentro do Slack, transformando o assistente num membro fixo do canal que aceita tarefas e trabalha sozinho. E dois estudos de IA jurídica chegaram à mesma conclusão desconfortável: na revisão de contratos, a arquitetura em volta do modelo decide mais o resultado do que o nome do modelo na etiqueta.
- Nº 004 IA em Cognição Nada Exauriente A Z.ai publica o GLM-5.2, modelo de pesos abertos com licença MIT que disputa de igual para igual com o Opus 4.8 e o GPT-5.5 em programação e lê um milhão de tokens de uma vez; o escritório Crosby lança o primeiro benchmark que mede a IA conduzindo uma negociação contratual inteira, turno a turno; e a OpenAI reabre, na NEJM AI, 376 casos de doença genética sem diagnóstico e fecha 18.
- Nº 003 IA em Cognição Nada Exauriente A Anthropic abre o Claude Fable 5, o modelo mais forte que já lançou ao público; o Google responde no campo aberto com o Gemma 4 12B, que cabe num laptop, e o DiffusionGemma, que escreve texto por difusão; e o prompt injection chega aos sistemas do STJ e do TJSP.
- Nº 002 IA em Cognição Nada Exauriente A Microsoft estreia o MAI-Thinking-1 e encara o Claude de igual para igual; numa só semana a IA jurídica vira agente; e o Holo3.1 opera o computador sem nada sair da sua máquina.
- Nº 001 IA em Cognição Nada Exauriente Opus 4.8 e os Dynamic Workflows, a difusão de texto da NVIDIA, litígio tratado como carteira de investimentos, papers de segurança de agentes e o Brasil entregando número no serviço público.