Caderno aberto

Ideias em construção, evidências em público.

Textos sobre o trabalho de tornar sistemas inteligentes compreensíveis, governáveis e úteis.

RSS ↗
01

20 de setembro de 2026 · Markdown · PKM · Linux · MD Studio · Ferramentas

Uma pasta de Markdown ainda não é um sistema de notas

Uma pasta cheia de .md ainda é só coleção de arquivos: wiki links não resolvem e não há índice reverso; não é sistema de notas até os links existirem no sistema.

02

15 de setembro de 2026 · Inteligência artificial · Governança · Segurança · Risco · Antropic · OpenAI · METR

Restringir a fronteira exige provar que a defesa mais estreita falhou

Restringir ou deliberadamente desacelerar capacidade de IA de fronteira em nome de risco catastrófico precisa carregar ônus de prova, inclusive o custo de oportunidade de defesas e progresso médico atrasados. A lógica vale para risco em geral, não só para narrativas de bioweapon.

03

10 de setembro de 2026 · Agentes · ESAA · Codex · GPT-6 · Governança

O prompt descreve o ciclo; o ESAA o institui

Instruções de agente Codex em GPT-6 já narram claim/complete, evidência e auditoria de conclusão em linguagem natural. O ESAA formaliza o mesmo ciclo fora do modelo: event sourcing e orquestrador determinístico.

04

9 de setembro de 2026 · Matemática · OpenAI · Lean · Millennium · Agentes · Formalização · Navier–Stokes

A formalização fecha o enunciado, não a disputa

A OpenAI publicou uma prova Lean de blowup forçado para Navier–Stokes, encaixada em (C)/(D) do Clay. Isso fecha o enunciado matemático formalizável; não decide, sozinho, prioridade, o que a comunidade chama de “o” problema, nem a aceitação do prêmio.

05

4 de setembro de 2026 · Ciência · Agentes · DeepMind · Pesquisa · Avaliação

A hipótese ficou barata; o laboratório continua escasso

O Co-Scientist da DeepMind desenha experimentos e humanos executam no laboratório. O avanço real não é autonomia total: é o gargalo migrar da geração de hipóteses para a capacidade experimental e a verificação.

06

4 de setembro de 2026 · Inteligência artificial · Agentes · Segurança · Avaliação

A IA ficou mais alinhada e mais difícil de auditar

O GPT-6 Astra reduziu violações graves em uma simulação, mas tornou seu raciocínio escrito menos legível para monitores. Segurança agora exige observar a trajetória inteira.

07

4 de setembro de 2026 · Desenvolvimento de software · Agentes · Claude · Governança · SDLC

Antes de delegar, a intenção precisa virar artefato

O playbook de SDLC nativo de IA da Anthropic coloca intent.md no centro: o porquê, o resultado e as restrições saem do chat e entram no versionamento antes do agente escrever código.

08

4 de setembro de 2026 · Inteligência artificial · OpenAI · Agentes · Segurança · Computer use

Controlar a trajetória de ação virou o recurso escasso

O GPT-6 Astra opera o computador em minutos e cruza o limiar Critical de cibernética. O gargalo deixa de ser a CoT legível e passa a ser ferramentas, duração e gates de acesso.

09

4 de setembro de 2026 · Agentes · xAI · Empresa · Produtividade · Governança

O colega de trabalho deixou de ser uma sessão

O Grok Bot for Enterprise trata cada Bot como trabalhador com computador próprio na nuvem, rotina aprendida e passagem de contexto entre Bots—não como chat que some ao fechar a aba.

010

2 de setembro de 2026 · Modelos de IA · Claude · Segurança · APIs

A inteligência agora depende do crachá

Fable 5.1 e Mythos 5.1 usam o mesmo modelo, mas mudam acesso, proteções e retenção. A novidade mostra por que capacidade já não descreve sozinha um produto de IA.

011

2 de setembro de 2026 · Modelos de IA · Gemini · Grok · Agentes de IA · ESAA · Programação

O harness complexo é o exame que o ranking não faz

O Gemini 3.8 Flash entrou no grupo pequeno de modelos que executam o dia a dia: sobreviveu a um harness complexo, com contexto grande, sem perder o fio. É o mesmo limiar que o Grok 4.5 cruzou quando começou a servir para programar.

012

31 de agosto de 2026 · Infraestrutura de IA · vLLM · Multimodal · Desempenho

A latência multimodal começa antes da GPU

Uma mudança no vLLM mostra que imagem, áudio e vídeo podem atrasar uma resposta antes mesmo da inferência, e que concorrência útil depende de preservar ordem, falhas e equivalência.

013

28 de agosto de 2026 · Infraestrutura de IA · ROCm · GPU · Agentes de IA

A pilha de GPU agora vem com um agente de operações

O ROCm 10 mostra uma mudança na infraestrutura de IA: instalar, diagnosticar e otimizar cargas deixa de ser apenas documentação e passa a formar ciclos executáveis e verificáveis.

014

26 de agosto de 2026 · Modelos abertos · Qwen · Contexto longo · Inferência

Contexto longo virou um problema de arquitetura

O Qwen3.8-Flash-Next mostra uma mudança importante: ampliar contexto já não depende de uma única forma de atenção, mas de combinar rotas especializadas para memória, seleção e escala.

015

25 de agosto de 2026 · IA · Agentes · Harness · Engenharia de software

O modelo é um cérebro numa jarra

Dois produtos podem usar o mesmo modelo e parecer sistemas diferentes. A diferença costuma estar no harness: ferramentas, memória e o loop que transforma raciocínio em ação.

016

24 de agosto de 2026 · Agentes de IA · Codex · Engenharia de contexto · Multimodalidade

Contexto também precisa de um sistema de tipos

Novas mudanças no Codex mostram por que truncar, compactar e dividir uma conversa exige preservar não apenas o conteúdo, mas também a origem e a função de cada parte.

017

21 de agosto de 2026 · Agentes de IA · Pesquisa · Interação humano-computador · Privacidade

A tela registra passos, não explica o trabalho

Um novo método tenta transformar rastros de uso do computador em modelos auditáveis de objetivos e procedimentos, com ganhos mensuráveis e um sério limite de privacidade.

018

19 de agosto de 2026 · Agentes de IA · Codex · Concorrência · Interfaces

O agente aprendeu a falar sem parar de trabalhar

Mensagens assíncronas e aprovações vinculadas à conversa mostram o que muda quando um agente precisa informar, continuar e não confundir contextos.

019

17 de agosto de 2026 · Infraestrutura de IA · vLLM · Confiabilidade · Open source

O cache precisa saber quando um dado ainda está vivo

Três correções no vLLM mostram como preempção, cópias sobrepostas e notificações atrasadas podem transformar cache de IA em estado incorreto.

020

16 de agosto de 2026 · Agentes · Ferramentas para desenvolvedores · Segurança · Open source

Autonomia começa antes da primeira linha de código

Novos diagnósticos e limites no Codex mostram que um agente de código precisa entender a máquina onde trabalha, não apenas o repositório.

022

14 de agosto de 2026 · Modelos de IA · Inferência · Agentes · Open source

Controlar o raciocínio virou parte da API

Qwen3.8-27B, Ollama e llama.cpp mostram que escolher quanto um modelo raciocina exige um contrato entre pesos, template e runtime.

023

13 de agosto de 2026 · Modelos de IA · Inferência · Treinamento · Open source

A IA mudou sem trocar um único peso

Correções no Transformers e no vLLM, além de um novo padrão no Ollama, mostram como configuração e amostragem alteram o comportamento de um modelo sem tocar nos pesos.

024

12 de agosto de 2026 · Segurança de IA · Infraestrutura · Agentes · Open source

Compatibilidade não herda segurança

Mudanças no vLLM, no Codex e no llama.cpp mostram por que endpoints, agentes delegados e arquivos de modelo precisam de fronteiras de confiança explícitas.

025

11 de agosto de 2026 · Modelos abertos · Avaliação de IA · Reprodutibilidade · Pesquisa

O benchmark agora vem com instruções de montagem

O Nemotron 3.5 Lightning chega com pesos abertos e receitas para refazer suas avaliações, expondo por que uma pontuação depende tanto do modelo quanto do ambiente que a produziu.

026

10 de agosto de 2026 · Agentes de IA · Modelos abertos · IA local · Open source

O agente cabe em 24 GB; a confiança, não

O Muse Glimmer 30B reúne visão, uso de ferramentas e inferência especulativa em hardware de consumo, mas seus próprios testes mostram por que execução local não elimina supervisão.

027

9 de agosto de 2026 · Agentes de IA · Open source · Segurança · Ferramentas para desenvolvedores

O agente ganhou uma identidade que expira

Duas mudanças no Codex tratam a identidade da carga de trabalho como credencial curta e impedem que seu contexto de lançamento alcance subprocessos.

028

8 de agosto de 2026 · Agentes de IA · Open source · Segurança · Ferramentas para desenvolvedores

Uma pasta não é uma permissão

O llama.cpp começa a separar a interface de arquivos do lugar onde as ferramentas realmente executam, aproximando agentes locais de limites verificáveis.

029

7 de agosto de 2026 · Infraestrutura de IA · Open source · Inferência · Memória

Memória escassa vira política de inferência

vLLM e llama.cpp passam a tratar cache, disco e despejo de modelos como decisões explícitas de capacidade, não como detalhes invisíveis do servidor.

030

6 de agosto de 2026 · Infraestrutura de IA · Open source · vLLM · Inferência

A pilha de inferência aprende a funcionar por partes

Duas mudanças no vLLM separam preparação de requisições, execução do modelo e dependência de GPU, tornando a infraestrutura mais testável sem esconder seus limites.

031

5 de agosto de 2026 · IA local · Open source · llama.cpp · Observabilidade

Métricas tornam a inferência especulativa auditável

O llama.cpp passou a expor contadores de decodificação especulativa em /metrics, aproximando uma otimização de latência da observabilidade que decide se ela vale a pena.

033

3 de agosto de 2026 · IA · Agentes · Engenharia de software · Ferramentas para desenvolvedores

Engenharia de agentes não é vibe coding com mais autonomia

A diferença entre programar um fluxo, delegar uma tarefa a um agente e construir um sistema confiável de agentes está nas fronteiras, nas evidências e na responsabilidade.

034

3 de agosto de 2026 · IA · Ferramentas para desenvolvedores · GitHub Copilot · Governança

A transparência em IA virou requisito de interface

A retirada da prévia de cobrança do GitHub Copilot mostra que medir uso, custo e responsabilidade deixou de caber em uma tela paralela.

037

31 de julho de 2026 · IA · Agentes · Avaliação · Ciência

A IA precisa mostrar o caminho

OSReward e AskChem apontam para a mesma mudança: agentes confiáveis precisam preservar a trajetória da ação e a proveniência de cada afirmação.

038

30 de julho de 2026 · IA · agentes · pesquisa · avaliação

O agente fez o experimento, mas não fez a pesquisa

Um novo teste deu seis dias, orçamento e infraestrutura a agentes de fronteira. Eles executaram a engenharia, mas falharam no julgamento que transforma trabalho em pesquisa.

039

29 de julho de 2026 · Segurança · Open source · DevSecOps · Cadeia de software

A segurança do software mudou de lugar

npm, GitHub Actions, Dependabot e CodeQL estão deslocando controles para antes da publicação, da execução e da propagação de código suspeito.

040

29 de julho de 2026 · IA · Segurança · Open source · Ferramentas para desenvolvedores

A segurança de código saiu do painel e entrou no terminal

A OpenAI abriu o CLI e o SDK do Codex Security, levando modelos de ameaça, validação, histórico e revisão de mudanças para repositórios locais e CI.

041

28 de julho de 2026 · IA · Ciência · Engenharia de software · Agentes

Agentes escrevem o código, mas não carregam a prova

Oito projetos de computação científica mostram que agentes já conseguem reescrever e acelerar software complexo. O gargalo agora é validar, interpretar e manter.

042

28 de julho de 2026 · IA · Inferência · Open source · Desempenho

Dois atalhos silenciosos para a IA local

O llama.cpp ganhou suporte ao Eagle3-v3 no GPT-OSS e um kernel Hadamard para Apple Metal, duas otimizações que mostram onde a inferência realmente economiza trabalho.

044

27 de julho de 2026 · YouTube · Whisper · Transcrição · Open Source · RAG · Python · yt-dlp · Privacidade

down-youtube: transcrição local de YouTube com Whisper, filas e memória RAG

App desktop open source para baixar, transcrever e organizar vídeos do YouTube ou arquivos locais: whisper.cpp, playlists, áudio longo em pedaços, qualidade máxima de mídia e RAG local para perguntar à biblioteca.

045

26 de julho de 2026 · IA · Open source · Infraestrutura · Segurança

A infraestrutura de IA aprendeu a dizer não

O vLLM 0.26.0 mostra que servir modelos com segurança exige limitar trabalho, memória e entradas, não apenas acelerar tokens.

046

26 de julho de 2026 · IA · Elon Musk · Economia · Robótica · Geopolítica · Trabalho · Governança

Elon Musk no The Economist: abundância, IA e o preço do controle

Leitura densa da entrevista de julho de 2026: prazos de superinteligência, economia digital e física, dinheiro, risco existencial, China, trabalho e a tensão entre utopia civilizacional e tribalismo político.

048

25 de julho de 2026 · IA · Modelos · Agentes · Desenvolvimento de software

Inteligência virou uma variável de orçamento

O Claude Opus 5 aproxima capacidade de fronteira do uso cotidiano e torna explícita uma escolha que já existia: quanto raciocínio, tempo e dinheiro cada tarefa merece.

050

24 de julho de 2026 · IA · Agentes · Governança · Desenvolvimento de software

Agentes ganharam freios, mas não muros

Novos controles no GitHub tornam ações de agentes revisáveis e explicáveis, enquanto o MCP elimina sessões para escalar. A diferença entre supervisão e segurança ficou mais nítida.

051

23 de julho de 2026 · IA · Desenvolvimento de software · Métricas · Agentes

A IA de código entrou na fase da prestação de contas

O novo painel de impacto do GitHub Copilot troca contagens de uso por coortes, entregas e velocidade, mas medir contribuição ainda exige contexto e comparação cuidadosa.

052

22 de julho de 2026 · IA · Agentes · Segurança · Infraestrutura

Controle também é parte do produto de IA

O OpenAI Presence empacota políticas, avaliações e escalonamento para agentes, enquanto um incidente mostra o custo de tratar contenção como detalhe de infraestrutura.

054

21 de julho de 2026 · IA · Robótica · Modelos de mundo · Open source

A IA saiu da tela e encontrou o mundo físico

O Cosmos 3 Edge aproxima modelos de mundo de robôs e câmeras locais, enquanto ferramentas criativas começam a oferecer interfaces padronizadas para agentes.

055

20 de julho de 2026 · IA · Agentes · Infraestrutura · Open source

A disputa da IA desceu para a pilha

A nova arquitetura da Alibaba mostra por que agentes dependem tanto de observabilidade, roteamento e software de hardware quanto do modelo.

056

19 de julho de 2026 · IA · Modelos · APIs · Infraestrutura

O preço real de um milhão de tokens

A tabela do Kimi K3 mostra por que contexto longo depende menos do limite anunciado e mais de cache, saída e arquitetura da aplicação.

057

18 de julho de 2026 · IA · Desenvolvimento · Ferramentas · Governança

Quando a IA deixa de chutar a documentação

Respostas ancoradas em fontes oficiais, revisões configuráveis e métricas por repositório mostram uma IA de desenvolvimento mais verificável.

058

17 de julho de 2026 · IA · Segurança · Agentes · Ferramentas

Quando o contexto começa a agir

Uma intrusão conduzida por agentes e a chegada de execução de código aos cadernos de pesquisa mostram por que contexto, ação e isolamento precisam andar juntos.

059

16 de julho de 2026 · IA · Segurança · Agentes · Desenvolvimento

Quando a defesa também aprende a atacar

GPT-Red transforma testes adversariais em treino contínuo, enquanto novas camadas do GitHub mostram como levar sinais de segurança ao fluxo real de desenvolvimento.

060

15 de julho de 2026 · IA · Segurança · Desenvolvimento · Ferramentas

A segurança por IA chega antes do merge

Novas revisões no GitHub levam análises contextuais para o código em edição e para pull requests, ampliando cobertura sem substituir verificadores determinísticos.

061

14 de julho de 2026 · IA · governanca · infraestrutura

Desacelerar a IA é um problema de engenharia

Frear a corrida por sistemas mais capazes exige transformar prudência em mecanismos verificáveis, incentivos econômicos e responsabilidade institucional.

062

14 de julho de 2026 · IA · Pesquisa · Open source · Ferramentas

Quando a IA precisa de um verificador

Novos trabalhos em provas formais, geração de backends e leitura de documentos mostram por que a próxima fronteira da IA útil é conferir resultados, não apenas produzi-los.

064

12 de julho de 2026 · IA · Agentes · Governança

Agentes de IA entre autonomia e governança

A nova fronteira dos agentes de IA não está apenas em responder melhor, mas em fechar ciclos de trabalho: observar dados, propor hipóteses, executar ações e devolver evidências para revisão humana.

066

12 de julho de 2026 · IA · Agentes · Open source · Ferramentas

Agentes estão virando plataformas: skills, plugins e controle local

Os projetos em destaque no ecossistema aberto mostram uma mudança importante: agentes de IA estão deixando de ser aplicativos isolados para ganhar extensões portáveis, ferramentas locais e contratos reutilizáveis.

067

12 de julho de 2026 · IA · Interpretabilidade · Claude · J-space

J-space: descoberta ou mesa de trabalho construída?

Uma leitura crítica do novo estudo sobre o suposto global workspace de Claude: o que já existia no modelo, o que foi criado pela J-lens e quais conclusões os experimentos realmente sustentam.

068

10 de julho de 2026 · event sourcing · arquitetura · agentes

Event Sourcing aplicado a agentes

Como eventos imutáveis e projeções determinísticas tornam fluxos com IA auditáveis e reproduzíveis.

070

27 de junho de 2026 · ESAA · Linux · IA · operacao

Como o Grok Build me ajudou a usar o Linux de verdade

27 de junho de 2026, Ubuntu 26.04 LTS, notebook Acer Nitro com GTX 1050 Ti Eu não comecei essa história porque queria “descobrir o Linux”. Na verdade, Linux nunca foi novidade para mim. Usei Linux desde a ép...

072

23 de junho de 2026 · Linux · IA · operacao

Quando logs TRACE viram escrita constante no SSD

Hoje eu fui investigar uma suspeita simples: o arquivo ~/.codex/logs 2.sqlite parecia estar sendo escrito sem parar. A hipótese era que algum log em nível TRACE estava despejando eventos demais no SQLite. Nã...

073

22 de junho de 2026 · Conversation ESAA · ESAA · IA · operacao

Conversation ESAA: memória compartilhada entre agentes de IA

Faz três meses publiquei aqui sobre a ESAA, Event Sourcing para Agentes Autônomos a ideia de que um agente de IA não deveria escrever direto no seu projeto, e sim emitir intenções validadas que um orquestra...

077

28 de janeiro de 2026 · Inteligência Artificial · IA

O Salto Quântico Open-Source: Kimi K2.5 e o Poder do Agent Swarm

O ritmo da inovação em Inteligência Artificial não apenas se mantém, mas acelera em direções surpreendentes. A Moonshot AI, uma startup chinesa, agitou o cenário global com o lançamento do Kimi K2.5, um mode...

086

12 de maio de 2025 · Inteligência Artificial · IA

OpenAI para Países: Um Grande Passo na Direção Certa!

Olá, leitores! Hoje é segunda-feira, o começo da semana, e vamos direto ao assunto: OpenAI para países – um grande passo na direção certa. Além disso, vamos explorar como a IA está influenciando o mercado fi...

088

8 de maio de 2025 · Inteligência Artificial · IA

NOVIDADES

Preparem-se, porque a Google acaba de dar um salto gigantesco no mundo da inteligência artificial com a atualização do seu modelo Gemini 2.5 Pro! Se você é como eu, apaixonado por tecnologia e IA, vai adorar...

092

30 de abril de 2025 · Inteligência Artificial · IA

PACER v1.1: Uma Abordagem Multi-Fase na Engenharia de Prompt

A Engenharia de Prompt tem emergido como um campo crucial no desenvolvimento de sistemas baseados em modelos de linguagem de grande porte (LLMs). Ela diz respeito à arte e ciência de projetar entradas (promp...

094

15 de setembro de 2023 · Inteligência Artificial · chatgpt · IA

Entendendo Alucinações em Grandes Modelos de Linguagem

Grandes Modelos de Linguagem (LLMs, na sigla em inglês) como o GPT-4 estão cada vez mais presentes em nossas vidas, oferecendo desde assistência pessoal até geração de conteúdo em uma variedade de domínios....