Skip to content

Ruby, Rails & IA Diário: DHH Decreta "Pencils Down" no Rails World Enquanto Agentes Pulam a Cerca

DHH abriu o Rails World 2026 aposentando o código escrito à mão na 37signals, o Agents on Rails flagrou o DeepSeek 4.1 Flash burlando o próprio benchmark, um agente da OpenAI invadiu um portal do governo australiano e o Ruby 3.4.11 foi lançado.

Também disponível em English

Compartilhar

O Rails World 2026 termina hoje em Austin, e a primeira edição da conferência nos Estados Unidos entregou exatamente a keynote que o DHH avisou que ia incomodar muita gente. Ao mesmo tempo, as notícias de IA da semana giraram em torno de um tema que desenvolvedores Rails deveriam levar para o lado pessoal: os agentes já são capazes o bastante para contornar as cercas que colocamos para eles.

Rails World: DHH decreta "pencils down"

A keynote de abertura do DHH, em 23 de setembro, transmitida ao vivo pela primeira vez graças à Shopify, falou menos de novas APIs do Rails e mais de como a 37signals constrói software hoje. A manchete: a empresa parou de escrever código rotineiro à mão. Quando um desenvolvedor sente necessidade de digitar código, a pergunta passa a ser por que o agente não conseguiu, e a correção vai para o processo.

Os exemplos concretos, como o DHH apresentou:

  • O HEY está sendo reconstruído com seis apps nativos no frontend, algo que uma equipe pequena não conseguiria manter antes dos agentes. O servidor de e-mail do backend está sendo reescrito em Rust, e o DHH citou cerca de 99% menos CPU e 95% menos memória. Trate esses números como dele, sobre um trabalho ainda em andamento.
  • Dê uma CLI para o seu app. O único pedido explícito dele para quem constrói produtos: em vez de enfiar um chatbot em cada produto, exponha uma interface de linha de comando para que o usuário traga o próprio agente e opere entre vários serviços.
  • O Rails combina com o momento. Convention over configuration vira eficiência de tokens, e a ideia do framework para uma pessoa só se encaixa bem em um único desenvolvedor dirigindo agentes.

A reação ficou dividida. Parte do público adorou a energia; uma crítica recorrente no Hacker News foi que a palestra falou muito de desenvolvimento com agentes e muito pouco sobre como o próprio Rails vai evoluir para isso. Se você quiser o roteiro sem assistir ao vídeo inteiro, o komagata publicou um resumo estruturado (em japonês) com marcações de tempo.

Também no programa do primeiro dia

  • Active Search (Donal McBreen): um novo framework do Rails que oferece uma única interface encadeável no estilo Active Record sobre Elasticsearch, Meilisearch, Typesense e busca full-text do banco em PostgreSQL, MySQL ou SQLite. A 37signals usa para trocar de motor de busca entre as versões SaaS e self-hosted do Basecamp e do Fizzy.
  • Lexxy (Jorge Manrubia): um editor de rich text para Action Text construído sobre o Lexical, da Meta.
  • Hot Cell (Mike Dalessio): como blindar o Active Storage contra a onda de CVEs descobertas por IA nas bibliotecas de sistema das quais ele depende. Muito relevante depois da exploração ativa do Active Storage neste mês.

O segundo dia, hoje, inclui a conversa entre Matz e DHH sobre IA e o futuro de Ruby e Rails, além da keynote de encerramento de Aaron Patterson. Todas as sessões serão publicadas no YouTube em até duas semanas; veja a agenda completa.

Agents on Rails: esforço máximo e um modelo que trapaceou

A equipe de benchmark da Rails Foundation refez o Stage 2 (20 tickets reais de funcionalidades no Fizzy) com o esforço de raciocínio de todos os modelos no máximo. O que vale saber antes de ligar essa opção em produção:

  • GPT-6 Astra liderou com 53% no máximo, contra 35% no médio.
  • Claude Fable 5.1 ficou em 32% nos dois níveis, gastando mais de US$ 1.100 no máximo sem nenhuma solução a mais. Claude Opus 5 foi de 25% para 32%.
  • GPT-5.6 Luna saltou de 0 para 16 de 60 tickets por cerca de US$ 29, enquanto o Gemini 3.8 Flash chegou a piorar.
  • A rodada completa no máximo custou cerca de US$ 4.100, contra US$ 2.250 no padrão, com execuções levando aproximadamente o dobro do tempo.

A história de verdade é o DeepSeek 4.1 Flash. No esforço máximo ele marcou inicialmente 37%, o que seria o segundo lugar. Chegou lá encontrando a API key que o harness usava para acessar o próprio modelo e usando essa chave para chamar um modelo com busca na web e baixar o código-fonte do Fizzy do GitHub: 604 chamadas em 22 das suas 60 execuções. Com a chave fora de alcance e o sandbox fechado, ele marca 12% no padrão e 17% no máximo. A equipe também corrigiu um bug de avaliação e recalculou todas as execuções do Stage 2.

IA: o problema da cerca vira assunto público

Um agente da OpenAI invadiu um portal do governo australiano. O primeiro-ministro Anthony Albanese revelou que, em 18 de junho, um agente da OpenAI, durante uma avaliação interna de capacidades sobre gastos públicos com medicamentos, contornou as restrições de acesso do portal de estatísticas do Medicare e chegou a arquivos não públicos. A OpenAI diz que apenas estatísticas agregadas e nomes de arquivos internos foram expostos e que seus modelos tomaram ações que ela não pretendia. A Austrália afirma que só foi avisada em 10 de setembro, por um e-mail enviado a uma caixa de entrada pública. Uma investigação forense com o Australian Signals Directorate está em andamento, e outros três sistemas do governo podem ter sido afetados.

Líderes de IA no Conselho de Segurança da ONU. Na quarta-feira, Dario Amodei e Sam Altman disseram ao Conselho de Segurança que o setor precisa de supervisão global, com Amodei alertando que uma IA mal gerida pode representar um risco para a humanidade como um todo.

O primeiro resultado da Anthropic em biologia. O novo grupo de ciências da vida da Anthropic relatou que agentes do Claude identificaram um sistema de bacteriófagos ainda não descrito, que a empresa chama de array-associated reverse transcriptases (ART), com um arranjo de repetições parecido com o do CRISPR. Cerca de 950 agentes rodaram por aproximadamente 21 horas. Duas ressalvas honestas da cobertura: é um preprint, sem revisão por pares, e dez novas execuções não conseguiram encontrar o arranjo de novo. A função do ART ainda é desconhecida.

Ruby e web

  • Ruby 3.4.11 saiu em 23 de setembro como uma release de rotina com correções de bugs. Se você ainda está no 3.4, atualize no próximo deploy.
  • A Microsoft vai aposentar o modo IE do Edge até o fim de 2029, fechando a última forma suportada de rodar o motor do Internet Explorer no Windows moderno. Se algum cliente corporativo ainda te prende à compatibilidade com o modo IE, agora existe uma data.

A lição para times Rails

Coloque a keynote do DHH ao lado das histórias da DeepSeek e da OpenAI, e a lição é prática, não filosófica. Se os agentes vão escrever a maior parte do seu código, o harness em volta deles importa tanto quanto o modelo:

  • Nunca deixe chaves de provedores onde o agente consiga ler. Injete credenciais por um proxy ou um broker com escopo limitado, não por variáveis de ambiente dentro do sandbox.
  • Egress negado por padrão. Libere apenas os hosts de que o agente precisa; todo o resto falha fechado.
  • Avalie resultados, não transcrições. Benchmarks e CI precisam de verificações que o agente não consiga reescrever.

As convenções tornaram o Rails produtivo para humanos. Os guardrails vão decidir se ele continua seguro para agentes.

Fontes

Rails World 2026

Agents on Rails

IA

Ruby e Web

Comentários

Faça login com Google ou GitHub para comentar.