Segurança e revisão

Revisor de segurança para comandos de shell de um agent

Guillermo Rauch · @rauchg425,5 mil visualizações no X

Uso do Jev como revisor de segurança que analisa cada comando de shell antes da execução em uma ferramenta de agent com modo automático. Em comparação com o revisor baseado em GPT Luna, o Jev foi até 18 vezes mais rápido no p95 e mais preciso, e pode se tornar o padrão da ferramenta.

O que o Jev decide aqui?

Para cada comando de shell proposto pelo agent, o Jev julga se ele é seguro para rodar automaticamente.

Qual foi o resultado?

Até 18x mais rápido no p95 que o revisor baseado em GPT Luna, com maior acurácia.

Por que isso importa?

Agents em modo automático só são aceitáveis se houver uma checagem antes de cada ação com efeito real. Essa checagem roda em toda chamada, então latência alta vira atrito direto para quem usa. Um revisor rápido permite manter a proteção ligada sem que o usuário queira desligá-la.

O padrão vale para qualquer agent que escreve em banco, envia mensagens ou mexe em arquivos. Cuidado: o revisor é uma camada, não a única; mantenha também listas de bloqueio, permissões mínimas e registro de tudo que foi executado.

Post original

Foto de perfil de Guillermo Rauch

Guillermo Rauch

@rauchg

We're seeing extraordinary results from @typesafeai. Default mode in 𝚏𝚡 is auto, with a safety reviewer analyzing every command. That reviewer runs on GPT Luna today. Jev is up to 18x faster (p95) *and* more accurate. It's coming to @vercel AI Gateway and likely new default.
Ver post original no X

Casos parecidos

Ver todos os casos de uso