GUIA Técnico

Solicitação de planejar e resolver

A solicitação Planejar e Resolver (PS) diz a um modelo de linguagem para primeiro elaborar um plano explícito e depois executá-lo passo a passo, corrigindo as falhas que a solicitação simples de 'vamos pensar passo a passo' deixa para trás.

  • 2 minutos de leitura
  • Última atualização
Nesta página2 minutos de leitura
  1. Visão geral
  2. Mergulho profundo
  3. Impacto Estratégico
  4. O futuro da solicitação de planejar e resolver
  5. Implementação no mundo real
  6. Riscos e guarda-corpos
  7. Roteiro de implementação
  8. Continue explorando
  9. Perguntas frequentes

Visão geral

It is a simple prompt tweak that meaningfully boosts multi-step reasoning without any extra training.

Mergulho profundo

Apresentado em um artigo do ACL de 2023 por Lei Wang e colegas, o prompt Planejar e Resolver foi uma resposta a uma fraqueza específica na cadeia de pensamento de tiro zero: os modelos muitas vezes pulam etapas, calculam mal ou interpretam mal a questão. PS substitui a instrução única “Vamos pensar passo a passo” por uma diretriz dividida em duas partes: “Vamos primeiro entender o problema e traçar um plano para resolvê-lo. Então, vamos executar o plano e resolver o problema passo a passo.’ Uma variante aprimorada, PS+, adiciona lembretes para extrair variáveis ​​relevantes, calcular resultados intermediários e prestar atenção aos números. Em benchmarks como GSM8K e SVAMP, o PS+ preencheu grande parte da lacuna com uma cadeia de pensamento de poucos disparos, sem precisar de exemplos trabalhados no prompt.

Impacto Estratégico

Custo e orçamento

As decisões de arquitetura impulsionam o desempenho e os custos operacionais durante anos.

Decisões mais claras

A educação técnica ajuda as equipes a escolher a pilha certa, não apenas a mais nova.

Controle de qualidade

Melhores escolhas de engenharia reduzem incidentes de confiabilidade na produção.

O futuro da solicitação de planejar e resolver

O pensamento de planejar e resolver agora está integrado em estruturas de agentes e modelos de “raciocínio” que separam nativamente o planejamento da execução. Espere que os prompts de planejamento se fundam com o uso de ferramentas, a autoverificação e os métodos de pesquisa em árvore, e se tornem um comportamento padrão interno em modelos treinados para raciocinar, em vez de um prompt manual. A lição duradoura é que decompor uma tarefa antes de agir é um ganho de confiabilidade barato e amplamente transferível.

Implementação no mundo real

Resolver problemas matemáticos de várias etapas para o ensino fundamental (GSM8K), onde o modelo primeiro lista as quantidades e depois as calcula em ordem.

Orientar um assistente de codificação para delinear funções e casos extremos antes de escrever qualquer código de implementação.

Estruturar um agente de suporte ao cliente para primeiro identificar o objetivo subjacente do usuário e depois sequenciar as etapas de resolução.

Dividir uma solicitação complexa de análise de dados em fases de ‘planejar as consultas’ seguidas de fases de ‘executar e combinar resultados’.

Riscos e guarda-corpos

  • A otimização de um benchmark pode ocultar fraquezas mais amplas do sistema.

  • Os custos de infraestrutura e manutenção são frequentemente subestimados.

  • As lacunas de segurança e observabilidade podem aumentar à medida que os sistemas se tornam mais complexos.

Roteiro de implementação

  1. Defina metas de latência, qualidade e custo antes da implementação.

  2. Benchmark sob condições realistas de carga e dados.

  3. Monitoramento de instrumentos para erros, desvios e impacto no usuário.

  4. Prepare caminhos de reversão e resposta a incidentes antes de escalar.

Continue explorando

Free newsletter

Get the daily AI briefing

Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.

One email each weekday. Unsubscribe in one click. We never sell or share your address.

Test yourself

Take the Plan-and-Solve Prompting quiz

Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.

Iniciar teste

Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation

Perguntas frequentes

What is Plan-and-Solve Prompting?

A solicitação Planejar e Resolver (PS) diz a um modelo de linguagem para primeiro elaborar um plano explícito e depois executá-lo passo a passo, corrigindo as falhas que a solicitação simples de 'vamos pensar passo a passo' deixa para trás. É um ajuste simples e rápido que aumenta significativamente o raciocínio em várias etapas, sem qualquer treinamento extra.

Que mudança central o prompt Planejar e Resolver faz na cadeia de pensamento padrão de tiro zero?

A solicitação do PS divide a instrução em elaborar um plano e depois executá-lo passo a passo, em vez da linha única 'Vamos pensar passo a passo'.

Quais fraquezas específicas da cadeia de pensamento simples o Planejar e Resolver foi projetado para resolver?

Os autores visaram erros de passos perdidos e erros de aritmética/cálculo que a cadeia de pensamento zero-shot frequentemente produzia.

O que a variante PS+ aprimorada adiciona ao prompt básico de planejar e resolver?

PS+ adiciona lembretes detalhados para extrair variáveis ​​relevantes, calcular resultados intermediários e prestar atenção aos números, aprimorando a estrutura autogerada.

Em que tipo de referência o Plan-and-Solve foi avaliado com destaque?

PS e PS+ foram testados em benchmarks de raciocínio matemático como GSM8K e SVAMP, entre outros conjuntos de dados de raciocínio.

Por que gerar um plano antes das etapas detalhadas tende a ajudar um modelo autorregressivo?

Como a geração é autoregressiva, os tokens do plano de alto nível tornam-se o contexto que orienta o raciocínio passo a passo subsequente, reduzindo as etapas ignoradas.