Playbooks · 4 min de leitura
O playbook de 30 dias, semana a semana.
Da primeira chamada à produção: os passos, os entregáveis e quem assina cada um. Tal e qual trabalhamos.
Trinta dias parece pouco para pôr agentes de IA em produção. E é. Mas é também por isso que a maioria dos nossos projetos lá chega: com uma data fixa, as decisões que um piloto ia adiando tomam-se na primeira semana.
Este é o playbook que seguimos. Cada passo acaba com algo escrito e com o nome de alguém ao lado.
Semana 0: diagnosticar
Começa com uma chamada gratuita. Se fizer sentido, passamos a semana seguinte dentro das tuas operações, quase sempre com as pessoas que fazem o trabalho. Sentamo-nos ao lado da caixa de email, do relatório, do ficheiro do fornecedor. Queremos ver onde se vão as horas e por onde foge o dinheiro. Não o processo como aparece num slide.
O entregável é um mapa das tuas operações, com o valor de cada agente que construiríamos e um preço fixo. A decisão é tua: que processo avança primeiro. Puxamos por um que tenha volume, regras claras e um número que já preocupa alguém.
Semana 1: mapear
É a semana que a maioria dos pilotos salta. E é a que decide se o teu chega a produção.
- Acessos. Credenciais reais para os sistemas reais: o CRM, o helpdesk, o ERP, a caixa de email. Nada de exportações.
- Casos reais. Um conjunto de emails, tickets ou ficheiros antigos, e como devia ser a boa resposta em cada um. Passam a ser os testes.
- Uma métrica, assinada. Tempo de primeira resposta, tempo até detetar um anúncio novo, horas dos sócios em papelada. Um número, da equipa cujo trabalho muda, assinado por quem responde por ele.
- Primeiras regras de aprovação. O que os agentes podem fazer sozinhos e o que vai sempre para uma pessoa, escrito em português corrente.
Se a semana 1 acabar sem acessos e sem métrica assinada, dizemos-te. Sai mais barato a ambos do que descobrir no dia 29.
Semana 2: construir
Agora construímos os agentes, as regras, a memória partilhada e o centro de comando, ligados às tuas ferramentas. Os agentes vivem onde a tua equipa já trabalha. Ninguém tem uma app nova para aprender.
Os casos reais da semana 1 passam a avaliações automáticas: testes que comparam cada resposta com o que seria uma boa resposta. As respostas que chegam ao cliente têm um juiz. O tom combina-se com quem responde por ele, muitas vezes numa única sessão de trabalho com uma pilha de respostas antigas.
No fim da semana, a aprovação é uma demonstração ao responsável da equipa, com os casos dele.
Semana 3: provar
Primeiro as avaliações, em casos reais que os agentes nunca viram. Depois o modo sombra, com trabalho real: os agentes preparam, as pessoas enviam. Cada alteração que uma pessoa faz é um sinal, e lemo-las todos os dias.
É também aqui que se afinam com a equipa as regras de passagem para uma pessoa. Que casos seguem logo para alguém, a partir de que limite, por que canal. A tua equipa deve conseguir mudar uma regra sozinha, e na semana 3 treina isso.
| PASSO | ENTREGÁVEL | QUEM ASSINA |
|---|---|---|
| Semana 0 | Mapa de operações, valor por agente, preço fixo | Tu: que processo primeiro |
| Semana 1 | Acessos, casos reais, primeiras regras de aprovação | O dono da métrica |
| Semana 2 | Agentes, memória, regras, centro de comando, avaliações | O responsável da equipa, depois da demonstração |
| Semana 3 | Resultados das avaliações, registo do modo sombra, passagens afinadas | O responsável da equipa: pronto para produção |
| Dia 30 | Produção, monitorização, equipa formada | Nós e tu, face à métrica |
Dia 30: em produção
No dia 30 os agentes estão em produção, com trabalho real, vigiados a partir do centro de comando. A tua equipa sabe usá-lo: ler uma execução, aprovar, pausar um agente, mudar uma regra.
Produção quer dizer que os agentes respondem, encaminham ou atualizam sozinhos, dentro das regras. E que o número da semana 1 passa a ser seguido todos os dias. Não quer dizer “disponível a pedido” nem “pronto para a fase dois”.
Porque é que a data se cumpre
Há três coisas que mantêm a data honesta. O âmbito é um processo, não a empresa inteira. A métrica fica acordada antes da primeira linha de código, por isso ninguém muda as regras a meio do jogo. E pomos o nosso dinheiro em cima da mesa: em produção em 30 dias, ou devolvemos o dinheiro.
Depois do dia 30, gerimos a frota: monitorização, afinação e, quando estiveres pronto, a equipa de agentes seguinte. No nosso maior projeto, isso passou a ser uma equipa nova por mês, cada uma construída sobre a memória e as regras das anteriores.
Tens um piloto a ganhar pó?
Em 30 minutos dizemos-te o que falta para o pôr em produção.
O André é o fundador e CTO da WizardingCode. Oito anos a construir o software em que as empresas assentam, agora a pôr agentes em produção.