Pular para o conteúdo principal

Introdução a agentes de IA: comece com Auto-GPT, AgentGPT e BabyAGI

Descubra como os agentes de IA Auto-GPT, AgentGPT e BabyAGI estão revolucionando sistemas autônomos de IA. Veja aplicações, limitações e muito mais.
Atualizado 17 de set. de 2026  · 12 min lido

Explorar com IA

ChatGPTClaudePerplexity

Agentes de IA como Auto-GPT, AgentGPT e BabyAGI são a próxima evolução no mundo acelerado da IA. Enquanto o ChatGPT levou a IA generativa ao grande público no fim de 2022, ele depende de prompts inseridos por humanos. A ideia por trás dos agentes de IA é fazer a IA trabalhar de forma independente em direção a um objetivo com entrada humana mínima ou nenhuma.

Muitos desenvolvedores já perceberam o potencial dessa nova tecnologia. O Auto-GPT é o projeto open source que mais cresceu na história se você medir pelo número de estrelas no GitHub (equivalente a “favoritar” um projeto de software). Nas seis semanas desde o início do desenvolvimento, ele acumulou 107 mil estrelas. Para comparar, o pandas, o pacote Python mais popular para ciência de dados, tem 38 mil estrelas.

Este tutorial explica o que são agentes de IA, como eles se relacionam com grandes modelos de linguagem como o GPT e como podem ser usados. Antes de ler, ajuda entender o que é um grande modelo de linguagem. A Beginner's Guide to GPT-3 é um bom ponto de partida. Também recomendo nosso novo curso Introduction to AI Agents para aprender tudo sobre agentes de IA e seus usos reais.

Introdução aos agentes de IA

Aprenda os fundamentos dos agentes de IA, seus componentes e o uso no mundo real - não é necessário programar.
Explorar O Curso

Como os agentes de IA se relacionam com o ChatGPT?

Para explicar agentes de IA, é preciso conhecer um pouco do jargão. Confira as definições abaixo:

  • Um grande modelo de linguagem (LLM) é um tipo de modelo de machine learning usado para gerar texto.
  • O GPT da OpenAI é atualmente o LLM mais popular. A versão mais recente é o GPT-4, embora a anterior, GPT-3.5-turbo, ainda seja usada.
  • Chat é um fluxo de trabalho em que você envia um prompt em texto para a IA, que devolve uma resposta em texto.
  • Embedding é um fluxo em que você envia um prompt em texto para a IA, que devolve uma representação numérica do texto. Representar texto como números é útil para busca, recomendação e classificação.
  • O ChatGPT da OpenAI é um aplicativo web que oferece uma interface prática para conversar com o GPT.

Assim como o ChatGPT é um aplicativo web alimentado pelo LLM GPT, os três agentes de IA abordados neste tutorial também são aplicações impulsionadas pelo GPT.

O principal problema que esses agentes tentam resolver é reduzir a quantidade de interação humana necessária para que a IA conclua uma tarefa.

AgentGPT e BabyAGI são essencialmente “GPT em loop”, em que o GPT é chamado repetidamente para quebrar o pedido do usuário em problemas solucionáveis, e a saída de cada etapa é refinada até que cada subtarefa seja concluída com sucesso.

O Auto-GPT vai além ao dar ao agente de IA acesso à internet e a capacidade de executar código, permitindo resolver uma variedade maior de problemas.

Vale destacar as inovações a seguir.

Memória de longo prazo

LLMs geram palavras com base nas palavras anteriores da conversa (tanto os prompts do usuário quanto as respostas da IA). Porém, LLMs têm memória relativamente curta: muitos modelos lembram apenas algumas centenas de palavras, e o GPT-4, que é estado da arte, lembra cerca de 6 mil palavras por padrão. Quando a conversa ultrapassa essa janela de memória, as respostas podem ficar inconsistentes entre si.

Na maioria dos casos, isso não é um problema. Mas, em outros, é essencial lembrar toda a conversa — e talvez até conversas anteriores. Chatbots e, de forma mais avançada, agentes de IA, são um exemplo.

Dar memória a um agente de IA é feito usando um fluxo de embedding para armazenar o texto da conversa como números. Cada prompt do usuário ou resposta da IA é armazenado como um vetor que representa o significado do texto.

Esses vetores numéricos são guardados em um banco de dados vetorial. Atualmente, Auto-GPT e BabyAGI usam o Pinecone (o líder nesse segmento), e a equipe do AgentGPT está desenvolvendo suporte para esse recurso.

Se você perguntar ao ChatGPT algo sobre eventos recentes, ele dirá que não pode responder porque foi treinado apenas com dados até setembro de 2021. De novo, essa limitação não atrapalha muitas aplicações, mas causa problemas se sua tarefa envolve informações atuais.

Uma solução é dar ao agente capacidade de navegar na web para acessar a internet e encontrar respostas por conta própria.

O Auto-GPT consegue fazer pesquisas por conta própria via Google Search API.

Esse recurso gera alguma controvérsia: os desenvolvedores do AgentGPT e do BabyAGI ainda não o adicionaram, preferindo restringir o conhecimento do agente ao que o GPT já sabe.

Execução de código

Embora LLMs como o GPT possam gerar código do zero e depurar ou melhorar código existente, eles não conseguem executá-lo.

O Auto-GPT pode executar comandos de shell e código Python. Ou seja, ele pode escrever e rodar o próprio código.

Uma capacidade particularmente poderosa disso é escrever o código para interagir com outros softwares e executá-lo. Assim, ele pode concluir tarefas aproveitando outras aplicações.

Quais são os casos de uso de agentes de IA?

Ainda é cedo para definir todos os usos de agentes de IA. Muitos exemplos são variações de um assistente pessoal automatizado, como uma nova geração do IBM Watson Assistant.

Udit Goenka, CEO da FirstSales.io, postou no Twitter que usou o Auto-GPT para construir um motor de prospecção. A captura de tela no tweet mostra o agente criando um plano para buscar empresas que levantaram rodada seed no último ano (ou seja, potenciais clientes com caixa) e descrevendo os detalhes para montar a lista (extraindo nomes e URLs das empresas).

Udit Goenka no Twitter

Yew Jin Lim, engenheiro de software no Google, publicou que usou o Auto-GPT para criar um assistente de e-mail (repositório no GitHub). O vídeo no tweet mostra Yew Jin enviando um e-mail ao agente com detalhes de uma tarefa e o agente executando ações como adicionar um evento ao calendário.

Yew Jin Lim no Twitter

Quais são os riscos e limitações dos agentes de IA?

O consenso ao trabalhar com IA é manter um humano no circuito para verificar se o que a IA faz faz sentido. Lembre que a IA deve ser uma assistente, não a especialista (e é uma assistente que às vezes alucina). Alguns alertas merecem atenção.

Rodar a IA continuamente pode sair caro

Embora uma única chamada ao GPT via API da OpenAI seja bem barata (geralmente menos de 1 centavo de dólar no GPT-3.5, dependendo do volume; o GPT-4 é mais caro), usar qualquer um dos três agentes aqui para uma tarefa complexa pode envolver centenas ou milhares de chamadas à API.

É uma boa prática incluir checkpoints em que seja necessário um aval humano para a IA continuar rodando.

Dar acesso do Auto-GPT a software pode ser perigoso

Embora o Auto-GPT possa ter acesso a qualquer API, se você der permissão para comprar ações automaticamente em seu nome, esteja preparado para perder todo o dinheiro da conta. Da mesma forma, é uma péssima ideia dar permissão de escrita ao seu banco de dados corporativo.

Para além de perdas pessoais ou corporativas, alguns pesquisadores argumentam que IAs avançadas oferecem riscos maiores, até existenciais. Embora tentativas iniciais de usar o Auto-GPT para destruir a humanidade tenham fracassado, vale considerar o alerta de Eliezer Yudkowsky, pesquisador sênior no Machine Intelligence Research Institute.

Para imaginar uma IA super-humana hostil, não pense em um pensador erudito e inerte, preso à internet e enviando e-mails mal-intencionados. Pense em uma civilização alienígena inteira, raciocinando milhões de vezes mais rápido que humanos, inicialmente confinada a computadores — em um mundo de criaturas que são, do seu ponto de vista, muito burras e muito lentas. Uma IA suficientemente inteligente não ficará presa a computadores por muito tempo. No mundo atual, é possível enviar sequências de DNA por e-mail a laboratórios que produzem proteínas sob demanda, permitindo que uma IA inicialmente confinada à internet crie formas de vida artificiais ou parta direto para manufatura molecular pós-biológica.

Se alguém construir uma IA poderosa demais nas condições atuais, eu espero que todo ser humano e toda a vida biológica na Terra morra pouco depois.

Embora seja claramente um cenário extremo, vale ponderar os perigos que uma IA sem restrições poderia trazer.

Como posso acessar um agente de IA?

Para testar esses agentes por conta própria, há vários sites que permitem experimentar a tecnologia. Se quiser usar de forma mais séria, será preciso instalá-los na sua plataforma de desenvolvimento preferida.

Independentemente do agente e do uso, você precisará obter uma chave da API da OpenAI. As instruções estão no tutorial Using GPT-3.5 and GPT-4 via the OpenAI API in Python.

Se quiser instalar qualquer um desses agentes, observe que são aplicações de linha de comando e, no estado atual, todos exigem um pouco de esforço para configurar.

Interfaces web

A plataforma de IA Hugging Face oferece uma versão hospedada do Auto-GPT. Você só precisa informar sua chave da API da OpenAI e, em seguida, dar um papel e alguns objetivos para a IA.

God Mode (batizado em referência a um modo de trapaça de videogame) também permite inserir sua chave da API da OpenAI e simplesmente dar ao Auto-GPT uma tarefa a cumprir.

Para quem usa Replit, você também pode fazer fork deste repl e informar sua chave da API da OpenAI.

A equipe do AgentGPT fornece uma versão de demonstração do agente, mas por ser grátis, ele roda por cerca de dois minutos antes de encerrar.

No momento, não encontrei uma versão hospedada do BabyAGI.

Instalar o Auto-GPT

O Auto-GPT é uma aplicação de linha de comando e, no estado atual, exige um pouco de trabalho para configurar. Você encontra documentação detalhada de instalação para começar.

Este guia pressupõe que você tem acesso a um shell (como bash ou zsh) e que o git e o Python estão instalados.

Clonar o repositório do Auto-GPT

No terminal, clone o repositório do Auto-GPT.

git clone https://github.com/Significant-Gravitas/Auto-GPT.git

Navegue até o diretório Auto-GPT recém-criado e faça checkout da branch estável

cd Auto-GPT
git checkout stable

Obter chaves de API

O Auto-GPT exige que você tenha uma chave da API da OpenAI (para contatar o GPT). A conta gratuita permite apenas 3 chamadas à API por minuto, o que é insuficiente para uso com o Auto-GPT, então você precisará de uma conta paga. As instruções estão no nosso tutorial Using GPT-3.5 and GPT-4 via the OpenAI API in Python.

Opcionalmente, você pode usar a API do Pinecone (para armazenamento), a API do ElevenLabs (para interface de voz), a API do Google (para busca) e a API do Twitter (para divulgar o que você construiu).

Configurar o Auto-GPT

O Auto-GPT armazena todas as chaves de API em um arquivo de configuração chamado .env.

Observe que guardar chaves de API em arquivo texto simples é uma prática de segurança fraca; portanto, rode o Auto-GPT apenas em um ambiente seguro, como sua máquina local, ou invalide as chaves após o uso.

Faça uma cópia do arquivo .env.template e nomeie como .env.

Em um editor de texto, encontre a linha que começa com OPENAI_API_KEY= e adicione sua chave da OpenAI sem espaços ou aspas.

Inclua quaisquer outras chaves no mesmo formato chave=valor.

Executar o Auto-GPT

O Auto-GPT é executado via script de shell run.sh (run.bat no Windows).

Para ver a ajuda de uso do script, use o argumento --help.

sh run.sh --help

Observe que o script faz várias checagens de versões de pacotes Python antes de exibir os detalhes de uso.

Para iniciar um assistente do Auto-GPT, rode o mesmo comando sem o argumento de ajuda.

sh run.sh

Após passar pelas checagens de pacotes, o Auto-GPT vai pedir três coisas

  1. Forneça um nome para seu assistente de IA.
  2. Descreva o papel da sua IA.
  3. Informe até cinco objetivos para o assistente tentar cumprir.

Instalar o AgentGPT

O AgentGPT traz um guia rápido para começar no README do repositório no GitHub.

Clonar o repositório do AgentGPT

No terminal, clone o repositório do AgentGPT.

git clone https://github.com/reworkd/AgentGPT.git

Navegue até o diretório AgentGPT recém-criado.

cd AgentGPT

Executar o script de setup

Há um script bash para configurar o agente.

bash setup.sh --local

A primeira solicitação será inserir sua chave da API da OpenAI e pressionar ENTER.

Você pode ser solicitado a dar acesso aos arquivos da sua Área de Trabalho e a aceitar conexões de rede de entrada. Aceite.

Após alguns segundos, você deverá ver uma mensagem como:

ready - started server on 0.0.0.0:3000, url: http://localhost:3000

Copie a URL e cole na barra de endereços do navegador. O AgentGPT abrirá com uma mensagem de boas-vindas.

Tela de boas-vindas do AgentGPT

Fazer o deploy do seu agente

Dê um nome e um objetivo ao seu agente e clique em "Deploy Agent". 

Captura de tela do deploy no AgentGPT

Instalar o BabyAGI

O BabyAGI tem alguma documentação (bem mínima) no README do repositório no GitHub.

Clonar o repositório do BabyAGI

No terminal, clone o repositório do BabyAGI.

git clone https://github.com/yoheinakajima/babyagi.git

Navegue até o diretório BabyAGI recém-criado.

cd BabyAGI

Instalar os pacotes Python necessários

Use o pip para instalar os pacotes exigidos pelo BabyAGI.

pip install -r requirements.txt

Configurar o BabyAGI

Crie um arquivo de configuração chamado .env.

cp .env.example .env

Edite o arquivo de configuração. Você pode usar qualquer editor de texto no terminal; aqui, vamos usar o vim.

vim .env

Pressione i para inserir texto.

  • Na linha que começa com OPENAI_API_KEY=, inclua sua chave da OpenAI.
  • Na linha que começa com INSTANCE_NAME=, opcionalmente dê um nome ao seu agente.
  • Na linha que começa com OBJECTIVE=, defina um objetivo para o agente atingir.

Executar o BabyAGI

Rode o script do BabyAGI.

python3 babyagi.py

Exemplo com Auto-GPT

Como teste, dei ao meu assistente de IA o nome "Jeff", descrevi como "um especialista em ciência de dados que escreve tutoriais sobre IA" e defini o objetivo de "escrever um tutorial sobre Auto-GPT".

Comando e resposta de exemplo do AutoGPT

O Auto-GPT vai pedir regularmente sua permissão para executar a próxima tarefa, seja pesquisar mais informações na internet ou escrever um arquivo. Digite 'y' para prosseguir ou envie um feedback em texto.

Após alguns minutos tentando escrever um tutorial, o Auto-GPT gerou este arquivo de tutorial.

Arquivo de saída do Auto-GPT

Não é um bom tutorial, nem mesmo 100% correto. Como sempre ao usar IA, você precisa ser bem preciso nos requisitos dos seus prompts e acompanhar de perto o que a IA está fazendo.

Leve isso para o próximo nível

Agentes de IA como Auto-GPT, AgentGPT e BabyAGI representam um grande salto no campo da IA, aproximando-nos da visão de sistemas realmente autônomos. Ao trabalharem com mínima intervenção humana, eles abrem um mundo de aplicações, de assistentes pessoais a solucionadores de problemas.

Para se manter à frente nesse cenário em rápida evolução, vale ampliar seus conhecimentos e habilidades em ciência de dados, machine learning e IA. Confira estes recursos para aprender mais:

Curso de Introdução ao ChatGPT

Comece a usar o ChatGPT

Comece Agora

Richie Cotton's photo
Author
Richie Cotton
LinkedIn

Richie ajuda indivíduos e organizações a melhorar o uso de dados e IA. Ele é cientista de dados desde antes de o termo ser chamado de ciência de dados, escreveu dois livros e criou muitos cursos DataCamp sobre o assunto. Ele é apresentador do podcast DataFramed e dirige o programa de webinars do DataCamp.

FAQs

Qual é a diferença entre o ChatGPT e agentes de IA como o Auto-GPT?

O ChatGPT foi projetado para interações com humano no circuito: uma pessoa insere prompts e recebe respostas. Já agentes de IA como o Auto-GPT foram feitos para trabalhar de forma autônoma em direção a um objetivo definido, muitas vezes usando loops, memória e ferramentas externas como navegadores ou execução de código para concluir tarefas com pouca ou nenhuma intervenção humana.

Preciso saber programar para usar agentes de IA?

Geralmente, é necessário ter noções básicas de linha de comando, Python e chaves de API para instalar e rodar agentes de IA como Auto-GPT ou BabyAGI. Algumas plataformas (como Hugging Face ou God Mode) oferecem interfaces mais amigáveis, mas para aproveitar todo o poder dessas ferramentas, muitas vezes é preciso configuração e setup manuais.

Agentes de IA conseguem navegar na web e acessar dados em tempo real?

Sim, alguns agentes como o Auto-GPT podem acessar a internet por meio de APIs como a do Google Search, permitindo obter dados em tempo real. Porém, esse recurso às vezes é omitido (por exemplo, no AgentGPT e no BabyAGI) devido a preocupações com segurança, custos ou confiabilidade.

Tópicos
Inteligência Artificial
Agentes de IA

Aprenda IA com a DataCamp

Curso

Sistemas Multiagentes com LangGraph

2 h 45 min
8.4K
Crie sistemas multiagentes poderosos aplicando padrões emergentes de design de agentes na estrutura LangGraph.
Ver detalhesRight Arrow
Iniciar Curso
Ver maisRight Arrow
Relacionado

blog

Tipos de agentes de IA: Compreensão de suas funções, estruturas e aplicações

Saiba mais sobre os principais tipos de agentes de IA, como eles interagem com os ambientes e como são usados em todos os setores. Entenda o reflexo simples, baseado em modelo, baseado em meta, baseado em utilidade, agentes de aprendizagem e muito mais.

blog

Anthropic vs. OpenAI: Os Dois Gigantes da IA Comparados

Saiba como OpenAI e Anthropic lideram o desenvolvimento de IA com abordagens únicas. Explore produtos como o ChatGPT e os modelos inovadores que elas oferecem.
Khalid Abdelaty's photo

Khalid Abdelaty

15 min

blog

Tudo o que sabemos sobre o GPT-5

Saiba como o GPT-5 evoluirá para um sistema unificado com recursos avançados, visando um lançamento no verão de 2025, com base no mais recente roteiro da OpenAI e no histórico do GPT.
Josep Ferrer's photo

Josep Ferrer

8 min

An avian AI exits its cage

blog

12 Alternativas de código aberto ao GPT-4

GPT-4 alternativas de código aberto que podem oferecer desempenho semelhante e exigem menos recursos computacionais para serem executadas. Esses projetos vêm com instruções, fontes de código, pesos de modelos, conjuntos de dados e interface de usuário do chatbot.
Abid Ali Awan's photo

Abid Ali Awan

9 min

Tutorial

Visão GPT-4: Um guia abrangente para iniciantes

Este tutorial apresentará tudo o que você precisa saber sobre o GPT-4 Vision, desde o acesso a ele, passando por exemplos práticos do mundo real, até suas limitações.
Arunn Thevapalan's photo

Arunn Thevapalan

12 min

Tutorial

Como fazer o ajuste fino do GPT 3.5: Liberando todo o potencial da IA

Explore o GPT-3.5 Turbo e descubra o potencial transformador do ajuste fino. Saiba como personalizar esse modelo de linguagem avançado para aplicativos de nicho, aprimorar seu desempenho e entender os custos associados, a segurança e as considerações de privacidade.
Moez Ali's photo

Moez Ali

11 min

Ver MaisVer Mais