A seguirPróximo guia
Solicitação do mínimo para o máximo
IA de linguagem
GUIA Técnico
A solicitação Planejar e Resolver (PS) diz a um modelo de linguagem para primeiro elaborar um plano explícito e depois executá-lo passo a passo, corrigindo as falhas que a solicitação simples de 'vamos pensar passo a passo' deixa para trás.
It is a simple prompt tweak that meaningfully boosts multi-step reasoning without any extra training.
Apresentado em um artigo do ACL de 2023 por Lei Wang e colegas, o prompt Planejar e Resolver foi uma resposta a uma fraqueza específica na cadeia de pensamento de tiro zero: os modelos muitas vezes pulam etapas, calculam mal ou interpretam mal a questão. PS substitui a instrução única “Vamos pensar passo a passo” por uma diretriz dividida em duas partes: “Vamos primeiro entender o problema e traçar um plano para resolvê-lo. Então, vamos executar o plano e resolver o problema passo a passo.’ Uma variante aprimorada, PS+, adiciona lembretes para extrair variáveis relevantes, calcular resultados intermediários e prestar atenção aos números. Em benchmarks como GSM8K e SVAMP, o PS+ preencheu grande parte da lacuna com uma cadeia de pensamento de poucos disparos, sem precisar de exemplos trabalhados no prompt.
As decisões de arquitetura impulsionam o desempenho e os custos operacionais durante anos.
A educação técnica ajuda as equipes a escolher a pilha certa, não apenas a mais nova.
Melhores escolhas de engenharia reduzem incidentes de confiabilidade na produção.
O pensamento de planejar e resolver agora está integrado em estruturas de agentes e modelos de “raciocínio” que separam nativamente o planejamento da execução. Espere que os prompts de planejamento se fundam com o uso de ferramentas, a autoverificação e os métodos de pesquisa em árvore, e se tornem um comportamento padrão interno em modelos treinados para raciocinar, em vez de um prompt manual. A lição duradoura é que decompor uma tarefa antes de agir é um ganho de confiabilidade barato e amplamente transferível.
Resolver problemas matemáticos de várias etapas para o ensino fundamental (GSM8K), onde o modelo primeiro lista as quantidades e depois as calcula em ordem.
Orientar um assistente de codificação para delinear funções e casos extremos antes de escrever qualquer código de implementação.
Estruturar um agente de suporte ao cliente para primeiro identificar o objetivo subjacente do usuário e depois sequenciar as etapas de resolução.
Dividir uma solicitação complexa de análise de dados em fases de ‘planejar as consultas’ seguidas de fases de ‘executar e combinar resultados’.
A otimização de um benchmark pode ocultar fraquezas mais amplas do sistema.
Os custos de infraestrutura e manutenção são frequentemente subestimados.
As lacunas de segurança e observabilidade podem aumentar à medida que os sistemas se tornam mais complexos.
Defina metas de latência, qualidade e custo antes da implementação.
Benchmark sob condições realistas de carga e dados.
Monitoramento de instrumentos para erros, desvios e impacto no usuário.
Prepare caminhos de reversão e resposta a incidentes antes de escalar.
Free newsletter
Three verified AI stories every weekday morning, written in plain English. Free forever, no ads.
One email each weekday. Unsubscribe in one click. We never sell or share your address.
Test yourself
Instant feedback on every answer, and a shareable certificate with a verifiable ID once you pass a course.
Support free AI education. AI Understanding is a 501(c)(3) nonprofit — no ads, no paywall, ever. Make a donation
A solicitação Planejar e Resolver (PS) diz a um modelo de linguagem para primeiro elaborar um plano explícito e depois executá-lo passo a passo, corrigindo as falhas que a solicitação simples de 'vamos pensar passo a passo' deixa para trás. É um ajuste simples e rápido que aumenta significativamente o raciocínio em várias etapas, sem qualquer treinamento extra.
A solicitação do PS divide a instrução em elaborar um plano e depois executá-lo passo a passo, em vez da linha única 'Vamos pensar passo a passo'.
Os autores visaram erros de passos perdidos e erros de aritmética/cálculo que a cadeia de pensamento zero-shot frequentemente produzia.
PS+ adiciona lembretes detalhados para extrair variáveis relevantes, calcular resultados intermediários e prestar atenção aos números, aprimorando a estrutura autogerada.
PS e PS+ foram testados em benchmarks de raciocínio matemático como GSM8K e SVAMP, entre outros conjuntos de dados de raciocínio.
Como a geração é autoregressiva, os tokens do plano de alto nível tornam-se o contexto que orienta o raciocínio passo a passo subsequente, reduzindo as etapas ignoradas.
Continue aprendendo
Mais guias escolhidos para este tópico
A seguirPróximo guia
Solicitação do mínimo para o máximo
IA de linguagem