GUIA de IA de linguagem

Agregação de mistura de agentes

Mistura de Agentes (MoA) é uma técnica em que vários modelos de linguagem elaboram respostas e, em seguida, um modelo agregador funde suas melhores ideias em uma resposta aprimorada.

2 minutos de leituraÚltima atualização

Visão geral

It lets a team of open models rival or beat a single top-tier model.

Mergulho profundo

Apresentado em um artigo de 2024 da Together AI, Mixture-of-Agents organiza vários LLMs em camadas. Na primeira camada, vários modelos de 'proponentes' respondem, cada um, independentemente ao prompt. Suas saídas são então concatenadas e entregues à próxima camada, onde os modelos respondem novamente, agora condicionados a todos os rascunhos anteriores. Após uma ou mais rodadas, um modelo “agregador” final sintetiza tudo em uma única resposta. A ideia central, que os autores chamam de “colaboratividade dos LLMs”, é que os modelos produzem melhores respostas quando mostradas as respostas dos pares, mesmo as imperfeitas. No benchmark AlpacaEval 2.0, um MoA construído inteiramente a partir de modelos de código aberto superou a pontuação do GPT-4 Omni, demonstrando que a agregação cuidadosa de modelos diversos e mais baratos pode vencer um sistema de fronteira única.

Visão Técnica

O MoA difere da votação por maioria simples: em vez de escolher uma resposta, o agregador lê todas as respostas dos candidatos como contexto e gera uma nova síntese, combinando pontos fortes e filtrando erros. A diversidade entre os proponentes ajuda, por isso misturar diferentes famílias de modelos é valioso. A estrutura é em camadas, como uma rede profunda onde os “neurônios” de cada camada são chamadas LLM inteiras. A compensação é a latência e o custo: cada camada multiplica o número de chamadas de inferência, de modo que o MoA gasta mais computação para aumentar a qualidade.

Impacto Estratégico

Velocidade e escala

Os fluxos de trabalho de idiomas podem avançar mais rapidamente sem sacrificar a consistência.

Acesso e alcance

Ele expande o acesso entre idiomas e estilos de comunicação.

Decisões mais claras

As equipes podem gastar mais tempo julgando enquanto a automação cuida da repetição.

O futuro da agregação de mistura de agentes

Espere que a agregação no estilo MoA se espalhe à medida que a inferência se torna mais barata e as estruturas de orquestração amadurecem. As direções de pesquisa incluem aprender em quais proponentes confiar por consulta (roteamento), reduzir a penalidade de latência executando os proponentes em paralelo e eliminando os fracos antecipadamente, e combinando MoA com agentes usuários de ferramentas para que o agregador funda não apenas texto, mas ações e evidências recuperadas. À medida que os modelos abertos proliferam, juntá-los de forma inteligente torna-se um caminho cada vez mais prático para a qualidade de nível fronteiriço, sem um único modelo gigante.

Implementação no mundo real

Combinar três modelos diferentes de chat aberto como proponentes e, em seguida, usar um agregador forte para produzir uma resposta refinada de suporte ao cliente.

Aumentando as pontuações de seguimento de instruções em benchmarks no estilo AlpacaEval usando apenas modelos de código aberto.

Fusão de diversas sugestões de código de vários modelos em uma implementação de função única e mais robusta.

Executando um pipeline de peso aberto que se aproxima da qualidade de fronteira para uma implantação sensível à privacidade, onde os dados não podem sair dos servidores de uma empresa.

Riscos e guarda-corpos

Fatos alucinados podem entrar silenciosamente em relatórios, fluxos de apoio ou resultados de pesquisas.

A sensibilidade do prompt pode criar resultados inconsistentes em solicitações semelhantes.

Dados de texto confidenciais podem ser expostos se os controles de acesso forem fracos.

Roteiro de implementação

1

Defina o formato de saída, o tom e os padrões de qualidade antes da implementação.

2

Respostas terrestres com fontes confiáveis ​​sempre que a precisão for importante.

3

Mantenha um ponto de verificação de revisão humana para resultados de alto risco.

4

Rastreie padrões de falha e treine novamente prompts ou fluxos de trabalho regularmente.

Continue explorando

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Mixture-of-Agents Aggregation quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Iniciar teste

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Perguntas frequentes

What is Mixture-of-Agents Aggregation?

Mistura de Agentes (MoA) é uma técnica em que vários modelos de linguagem elaboram respostas e, em seguida, um modelo agregador funde suas melhores ideias em uma resposta aprimorada. Ele permite que uma equipe de modelos abertos rivalize ou vença um único modelo de primeira linha.

Na Mistura de Agentes, qual é o papel do modelo agregador?

O agregador lê todas as respostas dos candidatos e gera uma resposta fundida e de maior qualidade.

Em que propriedade principal dos LLMs o artigo do MoA se baseia?

Os autores observam que os modelos melhoram suas respostas quando condicionados aos rascunhos de outros modelos, mesmo os imperfeitos.

Como o MoA difere da votação por maioria simples?

Ao contrário da votação, o MoA não seleciona apenas uma resposta existente; gera uma resposta nova que combina os candidatos.

Por que a diversidade entre os modelos proponentes é valiosa no MoA?

Proponentes variados cobrem mais terreno, dando ao agregador um conjunto mais rico de ideias para fundir e erros para filtrar.

Qual é o principal custo prático da abordagem MoA?

Cada camada adiciona mais chamadas LLM, de modo que o MoA troca computação e tempo extras por melhor qualidade de resposta.