Conceito e mecanismo
Um modelo generativo produz conteúdo condicionado pelo pedido e contexto. Tokens são unidades de processamento, que não correspondem necessariamente a palavras completas. Embeddings representam conteúdo numericamente e permitem comparar proximidade semântica; proximidade não demonstra verdade. A janela de contexto limita o material disponível numa chamada. Context engineering organiza instruções, informação recuperada, histórico e resultados de ferramentas para a tarefa. Texto redundante pode aumentar custo e dificultar a seleção de informação relevante. Compara modelos através de qualidade na tarefa, modalidades, latência, custo, restrições e disponibilidade. Uma resposta fluente pode conter factos inventados; a apresentação segura não é uma medida de confiança calibrada. Define quando pedir esclarecimento, procurar evidência ou encaminhar para uma pessoa.
Aplicação guiada
Um assistente de suporte pode resumir tickets; um agente pode também escolher ferramentas, consultar estado e executar passos autorizados. MCP ajuda a ligar ferramentas e sistemas a agentes, mas não concede autorização empresarial. Memória retém contexto entre interações segundo configuração e política; não deve misturar informação de utilizadores diferentes. Vários agentes podem dividir trabalho, acrescentando coordenação, custo e pontos de falha. AgentCore oferece componentes de execução, identidade, ferramentas e observabilidade; a aplicação continua a definir limites e supervisão. Num cálculo fictício, 100 pedidos usam cada um 2000 tokens de entrada e 500 de saída. Com tarifas inventadas de 1 e 4 unidades por milhão, o custo é 0,20 + 0,20 = 0,40 unidades, antes de outros serviços e repetições. Regista também conclusão da tarefa e satisfação: custo baixo sem resultado útil pode ser desperdício.
Um resumo não precisa necessariamente de um agente com permissões para alterar produção.
Armadilhas comuns
Embeddings como prova factual; MCP como autorização; memória partilhada sem limites; custo só dos tokens de entrada.
Tópicos relacionados: IA e ML: problema, dados e métricas · Modelos fundacionais: RAG, prompts e avaliação · IA responsável e explicabilidade
Escolhe capacidades proporcionadas à tarefa e mede qualidade, custo e controlo.
Referência: AIF-C01 domain2: Fundamentals of GenAI · AIF-C01