Cada salto em uma só máquina.
Lab · IA · Segurança
Security Agent.
Um pipeline de retrieval sobre o OWASP Web Security Testing Guide, rodando de ponta a ponta em uma só máquina — sem nuvem, sem chave de API, sem dado saindo do computador. O diagrama acima segue uma única pergunta por ele.
Um índice construído uma vez
Antes de qualquer pergunta, o corpus do OWASP WSTG é dividido em chunks de 2000 caracteres com 300 caracteres de sobreposição, para que um trecho cortado no meio da frase sobreviva inteiro no chunk vizinho. Cada chunk vira embedding com o all-MiniLM-L6-v2 e os vetores vão para um índice ChromaDB local. Isso acontece uma vez; depois disso o corpus nunca mais é lido na hora da pergunta.
A pergunta faz o mesmo caminho
A pergunta digitada vira embedding pelo mesmo modelo, é comparada com o índice e os três chunks mais próximos voltam. Eles são montados em um prompt junto da pergunta e respondidos pelo llama3.1:8b rodando no Ollama. A resposta cita o material recuperado em vez de improvisar a partir do treino do modelo — que é o ponto do retrieval: o modelo explica, o corpus fundamenta.
Onde o pipeline entra
O retrieval é metade do agente. A outra é um conjunto de 14 padrões determinísticos da OWASP que sinalizam vulnerabilidades em código Python na hora; o caminho de RAG fornece o contexto e a correção sugerida para o que eles encontram. O pipeline em si nasceu como um assistente de retrieval sobre PDFs farmacêuticos — trocar o corpus por material de segurança reapontou o sistema inteiro sem mudar o formato dele.