36
COBRA-Skills reduz em 55–58% o custo de otimizar skills de agentes LLM em comparação com SkillOpt
O COBRA-Skills usa contextual bandits para priorizar quais skills de agentes LLM merecem avaliação e evolução. Em seis benchmarks e três modelos-alvo, o preprint relata o melhor desempenho médio entre os métodos comparados, com custo de otimização 55–58% menor que o SkillOpt e apenas 50 exemplos únicos por benchmark. O trabalho ainda não passou por revisão por pares.