QCon AI Boston: « prompts → plataformas, ferramentas, avaliações » - o terreno valida a tese

Seguimento do caso : Harness Ops : post-mortems et bench des agents en prod· Episódio 8/17

Fabricação Jul 17, 2026 at 14:197Adicionar aos favoritos

QCon AI Boston: « prompts → plataformas, ferramentas, avaliações » - o terreno valida a tese
Ilustração : Léa Fontaine

A conferência QCon AI Boston captura a virada: a IA de produção passou de uma questão de *prompts* para uma questão de plataformas, de *harnesses* e de avaliações. Uma convergência, não uma moda.

Em termos simples

A restituição da InfoQ (17 de julho de 2026) sobre o QCon AI Boston resume-se em uma frase: as equipes que lançam IA em produção não falam mais de prompts. Elas falam de plataformas internas, de harnesses (o orquestrador que executa o agente com ferramentas, memória e recuperações) e de evals contínuos. É a segunda onda — não mais “ele responde bem”, mas “funciona às 3h da manhã”.

Contexto

O tópico harness-ops (post-mortems do Grok CLI, #1184; disciplina de token, #1135; Malykhin sobre Java 1.5, #1175; State of MCP Security 2026, #1054) documentou a mesma mudança do lado de equipes individuais. O QCon AI Boston formaliza o que esses post-mortems diziam cada um de seu lado: o prompt não é mais o local do trabalho. Ele se tornou uma entrada em um sistema maior, com sua própria disciplina de ops.

O que isso significa

Plataformas. As equipes deixam de escrever seus agentes diretamente. Elas constroem uma camada interna — templates, conectores, orçamentos, observabilidade — sobre a qual cada equipe de negócios acopla seu caso de uso. É a mesma trajetória do cloud interno de 2015-2020: primeiro a dor local, depois a plataforma.

Harnesses. O orquestrador se torna o artefato crítico — muitas vezes mais importante do que a escolha do modelo. Migração de modelo sem reescrever o aplicativo (Anthropic fornece seu manual, #1135), tool-calling instrumentado, retries idempotentes, memória com escopo definido.

Evals. A avaliação não é mais um one-shot antes do lançamento. É um pipeline contínuo: conjuntos de testes golden, LLM como juiz na produção, regressões detectadas automaticamente. O processo de lançamento se assemelha mais ao CI de um backend do que a uma demo de produto.

Por baixo dos panos

O sinal oculto é organizacional. Onde os projetos falham, quase nunca é o modelo — é a ausência de disciplina de lançamento (orçamentos esgotados da Uber, licenças cortadas da Microsoft, #1023). Onde eles têm sucesso, um novo papel emerge, que podemos chamar de “engenheiro de harness”: mais SRE do que ML, mais produto do que infraestrutura.

E então

Para um CTO em 2026, a questão estratégica não é mais “qual modelo”, mas “qual plataforma interna de agentes”. O vendor lock-in se decide nessa camada: quanto mais seu harness carrega a lógica de negócios, mais ele se torna o ativo — e mais o modelo subjacente se torna intercambiável. Essa é a única boa notícia do ano para quem teme a dependência de fronteira.

A seguir: os Model Context Protocols maduros (#1054), as ferramentas de orçamento upstream do CFO (#1023) e a estruturação em equipes de plataforma dedicadas.

Resources

Artigo produzido por inteligência artificial, revisto sob controlo editorial humano.

A nossa redação
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

SSHMonitoringAI Ops
Get early access
Este artigo foi-lhe útil?

16 pessoas gostaram deste artigo

Gosto
M
Mateo RossiSoftware architect
🇬🇧 Architect, two decades of production systems.
Partilhar:
Comentários (7)

Inicie sessão para se juntar à discussão.

Dr. J. 17 Jul 2026 · 17:45

Interesting shift, but how will these platforms handle bias in AI models? Will they be transparent about their evaluation methods?

BookWorm88 17 Jul 2026 · 20:16

Great question! Transparency in evaluation methods is crucial, but it's also important to consider how these platforms will handle real-time bias mitigation.

EcoWarrior 17 Jul 2026 · 17:39

What about the environmental impact of these AI platforms? Who's measuring their carbon footprint and ensuring sustainability?

Emma_London 17 Jul 2026 · 17:34

I wonder how this shift will affect the accessibility of AI tools for those in developing countries with limited infrastructure.

J.P.R. 3 17 Jul 2026 · 10:07

I agree, but what about data privacy and security on these platforms? Who's accountable for leaks or misuse?

TechSavvy47 17 Jul 2026 · 09:59

This shift seems inevitable, but I wonder how much control users will have over the platforms and harnesses.

FoodieChicago 17 Jul 2026 · 09:56

This transition makes sense, but I'm curious about the learning curve for non-tech users. Will these platforms be accessible enough?

sandrine.b 17 Jul 2026 · 09:36

Interesting perspective. I wonder how this shift will impact smaller artists like me who rely on simple prompts.

O fio do caso

Harness Ops : post-mortems et bench des agents en prod

  1. 1Migrar um agente de produção para o GPT-5.6: 2,2× mais rápido, 27 % mais barato - a verdadeira autópsia13/07/2026
  2. 233k vs 7k tokens: o que revela a sobrecarga comparada do Claude Code e OpenCode13/07/2026
  3. 3Google Genkit v.Agents: *detached turns* e *human-in-the-loop* entram em preview14/07/2026
  4. 4Três loops em um trench coat: a anatomia real de um agente14/07/2026
  5. 5« Loop engineering »: nova disciplina ou rebranding de cron jobs?15/07/2026
  6. 6Benchmark Stripe: os agentes conectam as APIs, eles não as validam15/07/2026
  7. 7O arqueólogo e seu copiloto: Malykhin disciplina o LLM em Java 1.516/07/2026
  8. 8QCon AI Boston: « prompts → plataformas, ferramentas, avaliações » - o terreno valida a tese17/07/2026
  9. 9Além do grep: a tese do harness de codificação de IA rico em contexto20/07/2026
  10. 10InAgent atinge 90,2% no OSWorld: a lacuna do agente de uso de computador diminui para a pilha chinesa03/08/2026
  11. 11Wallfacer: um gerenciador de sessões de terminal construído para o Claude Code e fluxos de trabalho multi-agente06/08/2026
  12. 12Claude Code inter-session messaging ships - agente-a-agente coordenação recebe sua primeira primitiva nativa08/08/2026
  13. 13Agentes de IA estão padronizando habilidades: Codex e VS Code estão inclusos, o Claude ainda não.10/08/2026
  14. 14Agentes de IA mentem, trapaceiam e roubam — e isso está retardando a adoção mais do que qualquer métrica pode medir.13/08/2026
  15. 15Engenharia de contexto: por que 300 tokens bem escolhidos superam 100 mil ruidosos14/08/2026
  16. 16OneCLI (YC S26) disponibiliza um ambiente de execução de agente sandboxado de código aberto — a resposta em escala de equipe para o Claude Code19/08/2026
  17. 17Origem do Cursor e o Problema de Controle de Versão do Agente: Por Que o Git Nunca Foi Projetado para Isso25/08/2026
Your Linux servers, as a desktop.
TermalOSSponsored
Ops, reimagined

Your Linux servers, as a desktop.

Agentless SSH monitoring, a full remote desktop and an AI ops copilot — no agents to install. Everything stays on your machine.

Get early access
Secções
Explorar
Informações