← BACK_TO_LOG

When the chatbot got hands

Quando AI tém mãos

When the chatbot got hands

###The landscape of Artificial Intelligence is currently undergoing a fundamental shift.

While 2023 and early 2024 were defined by the "Chat Era," where Large Language Models (LLMs) acted as sophisticated conversational interfaces, we are now well into the "Agentic Era." Claude Code arrived as a research preview in February 2025 and became generally available that May. In my view, and I am not alone in it, the real inflection point came with Claude Opus 4.5 in November 2025. We are moving away from tools that simply talk to tools that actually do.

From Chatbots to Agents

The core distinction between a standard chatbot and an "Agentic" system lies in autonomy and reasoning. A traditional chatbot is reactive: it waits for a prompt, processes the text, and provides a response. An AI agent, however, is proactive. It is designed to achieve a specific goal by breaking down a high-level objective into a series of sub-tasks, selecting the necessary tools, and executing them autonomously.

If you ask a chatbot to "plan a trip," it might give you an itinerary. If you ask an Agentic system to "book a trip," it might search for flights, compare prices based on your preferences, interact with booking APIs, and ultimately reserve the tickets.

The Core Pillars of Agentic AI

To achieve this level of autonomy, Agentic AI relies on several key technological pillars:
  1. Reasoning and Planning: Using techniques like "Chain of Thought" or "Tree of Thoughts," agents can map out a path to a goal. They can evaluate if a step was successful and re-plan if they encounter an error.
  2. Tool Use (Function Calling): Agents are no longer confined to their training data. Through APIs, they can "reach out" into the real world: querying databases, checking live weather, searching the web, or executing code in a sandbox.
  3. Multi-Agent Collaboration: The most talked-about architecture for 2026 is "Multi-Agent." Instead of one giant model doing everything, a swarm of specialized agents (for example, a "Researcher" agent, a "Writer" agent, and a "Fact-checker" agent) work together to complete complex projects. The evidence so far is more interesting than the pitch. In Anthropic's own testing, 45 coordinated agents found 266 vulnerabilities where an uncoordinated parallel run found 21, but only 12 were common to both: more agents produced a different set of findings, not a bigger one. Push the population from 10 to 80 and the fraction of merged pull requests goes down. And when agents shared a queue with no way to coordinate, one run logged 2.4 million job requests against 117 accepted jobs. Their conclusion is the part worth keeping: coordination does not arrive on its own by making the individual agents smarter. I went through the full research over on XT.PT.
  4. Human-in-the-Loop Orchestration: Despite their autonomy, the best-designed systems include "guardrails" where the agent pauses to ask for human approval before performing critical actions, such as making a payment or publishing a post.

The Impact on Software and Development

For developers, this shift changes the way we build software. We are moving toward "Agentic Workflows." Instead of coding every single "if/then" statement, engineers are designing the environment in which an agent can operate. This involves providing the agent with the right documentation, the correct toolset, and a clear set of goals.

In the world of software engineering, this means the rise of autonomous coding assistants that do not just suggest snippets of code but can identify a bug in a repository, plan the fix, and submit a pull request independently.

Conclusion: The Next Frontier

The transition from Chat to Agent is the next logical step in the AI evolution. By granting models the ability to use tools, reason through multi-step workflows, and collaborate with other agents, we are moving toward a world where AI acts as a digital workforce. For the tech community, this means a massive shift in how we think about automation, software design, and the role of the human in the creative and productive process.

Giving a model hands turned out to be the easy part. Deciding what it is allowed to reach for is the work, and that part is still ours.

O cenário da Inteligência Artificial está a passar por uma mudança fundamental.

Enquanto 2023 e o início de 2024 foram definidos pela "Era do Chat", em que os Grandes Modelos de Linguagem (LLMs) funcionavam como interfaces de conversação sofisticadas, agora estamos bem dentro da "Era dos Agentes". O Claude Code chegou como uma pré-visualização de investigação em fevereiro de 2025 e ficou geralmente disponível em maio desse mesmo ano. Na minha opinião, e não estou sozinho nisto, o verdadeiro ponto de viragem chegou com o Claude Opus 4.5 em novembro de 2025. Estamos a afastar-nos de ferramentas que apenas falam para ferramentas que, de facto, executam ações.

De Chatbots a Agentes

A principal diferença entre um chatbot padrão e um sistema "Agente" reside na autonomia e na capacidade de raciocínio. Um chatbot tradicional é reativo: espera por um comando, processa o texto e fornece uma resposta. Um agente de IA, no entanto, é proativo. Foi concebido para atingir um objetivo específico, decompondo uma tarefa de alto nível numa série de sub-tarefas, selecionando as ferramentas necessárias e executando-as de forma autónoma. Se pedir a um chatbot para "planear uma viagem", ele poderá fornecer um itinerário. Se pedir a um sistema Agente para "reservar uma viagem", ele poderá pesquisar voos, comparar preços com base nas suas preferências, interagir com APIs de reserva e, por fim, efetuar a reserva.

Os Pilares Fundamentais da IA Agente

Para alcançar este nível de autonomia, a IA Agente assenta em vários pilares tecnológicos essenciais:
  1. Raciocínio e Planeamento: Utilizando técnicas como "Cadeia de Pensamento" ou "Árvore de Pensamentos", os agentes conseguem mapear um caminho para atingir um objetivo. Podem avaliar se uma etapa foi bem-sucedida e replanear caso encontrem um erro.
  2. Utilização de Ferramentas (Chamada de Funções): Os agentes já não estão limitados aos seus dados de treino. Através de APIs, podem "alcançar" o mundo real: consultar bases de dados, verificar a meteorologia em tempo real, pesquisar na web ou executar código num ambiente isolado.
  3. Colaboração entre Múltiplos Agentes: A arquitetura mais discutida em 2026 é a "Multi-Agente". Em vez de um único modelo gigante fazer tudo, um conjunto de agentes especializados (por exemplo, um agente "Investigador", um agente "Escritor" e um agente "Verificador de Factos") trabalham em conjunto para concluir projetos complexos. Até agora, as evidências são mais interessantes do que as promessas. Nos próprios testes da Anthropic, 45 agentes coordenados encontraram 266 vulnerabilidades, enquanto uma execução paralela não coordenada encontrou 21, mas apenas 12 eram comuns a ambos: mais agentes produziram um conjunto diferente de resultados, não um maior. Ao aumentar a população de 10 para 80 agentes, a percentagem de pull requests aceites diminuiu. E quando os agentes partilhavam uma fila sem qualquer forma de coordenação, uma execução registou 2,4 milhões de pedidos de tarefas para apenas 117 tarefas aceites. A conclusão que vale a pena reter é esta: a coordenação não surge automaticamente apenas por tornar os agentes individuais mais inteligentes. Analisei a investigação completa aqui no XT.PT.
  4. Orquestração com Intervenção Humana: Apesar da sua autonomia, os sistemas mais bem concebidos incluem "barreiras de segurança" onde o agente pausa para solicitar aprovação humana antes de realizar ações críticas, como efetuar um pagamento ou publicar uma mensagem.

O Impacto no Desenvolvimento de Software

Para os programadores, esta mudança altera a forma como construímos software. Estamos a evoluir para "Fluxos de Trabalho Agentes". Em vez de codificar cada instrução "se/então", os engenheiros estão a criar o ambiente no qual um agente pode operar. Isto envolve fornecer ao agente a documentação correta, o conjunto de ferramentas adequado e um conjunto claro de objetivos. No mundo da engenharia de software, isto significa o surgimento de assistentes de codificação autónomos que não se limitam a sugerir trechos de código, mas que conseguem identificar um bug num repositório, planear a correção e submeter um pull request de forma independente.

Conclusão: A Próxima Fronteira

A transição do Chat para o Agente é o próximo passo lógico na evolução da IA. Ao conceder aos modelos a capacidade de utilizar ferramentas, raciocinar através de fluxos de trabalho com múltiplas etapas e colaborar com outros agentes, estamos a caminhar para um mundo onde a IA funciona como uma força de trabalho digital. Para a comunidade tecnológica, isto representa uma mudança significativa na forma como pensamos sobre automação, design de software e o papel do ser humano nos processos criativos e produtivos. Dar "mãos" a um modelo revelou-se a parte fácil. Decidir o que ele pode alcançar é o verdadeiro trabalho, e essa parte continua a ser nossa.
← The Transition Log