Presets
Presets agrupam prompt, parâmetros de geração e modelos permitidos em uma configuração reutilizável
Um preset é uma configuração nomeada e reutilizável que agrupa um prompt de sistema, parâmetros de geração e uma lista de modelos permitidos. Em vez de repetir essas configurações em cada requisição, você cria um preset uma única vez e o referencia pelo slug ao chamar a API — útil para manter um caso de uso (um assistente de suporte, uma tarefa de extração de dados, etc.) consistente entre chamadas.
Criar um preset
- Acesse a página Presets e clique em Adicionar.
- Dê um nome ao preset — o slug é gerado automaticamente a partir do nome e é o identificador usado nas requisições.
- Clique em Salvar.
Somente membros com permissão de admin ou owner podem criar, editar ou excluir presets. Qualquer membro do workspace pode visualizar e usar um preset existente.
Prompt do sistema
Cada preset tem um prompt de sistema próprio, editado na aba de prompt da página do preset. Esse prompt é enviado como a mensagem de sistema em toda requisição que usa o preset, à frente das mensagens enviadas pela aplicação.
Parâmetros de geração
Um preset pode definir os seguintes parâmetros, aplicados a toda requisição feita através dele:
- Nível de raciocínio: quantos tokens internos de "pensamento" o modelo utiliza antes de gerar a resposta final. Opções: Desativado, Baixo, Médio ou Alto.
- Temperatura: controla a aleatoriedade, criatividade e previsibilidade do texto gerado.
- top_p: controla a diversidade e a aleatoriedade do texto limitando a probabilidade cumulativa considerada.
- top_k: limita a escolha da próxima palavra estritamente às opções mais prováveis.
- Penalidade de frequência: reduz a chance de o modelo repetir as mesmas palavras ou frases, com base em quantas vezes elas já apareceram no texto.
- Penalidade de presença: desencoraja o modelo a repetir qualquer token que já tenha aparecido no texto.
- Penalidade de repetição: reduz a probabilidade de o modelo repetir palavras ou frases idênticas.
Cada parâmetro é opcional e pode ser configurado individualmente na página do preset.
Selecionar e ordenar modelos
Você pode restringir um preset a uma lista específica de modelos permitidos. Se nenhum modelo for selecionado, todos os modelos ativos do workspace são considerados no roteamento.
A ordem da lista importa: ela define a sequência de fallback usada quando o preset é chamado — se o primeiro modelo falhar, a Retrace tenta o próximo da lista, e assim por diante. Esse é o mesmo mecanismo usado no roteamento do workspace, mas aplicado apenas às requisições que usam esse preset.
Você também pode exigir que o preset só use provedores com retenção zero de dados (ZDR) — ou seja, provedores que não retêm nem usam os dados para treinar seus modelos. Se essa opção estiver ativa e a lista de modelos permitidos incluir provedores que não oferecem ZDR, a página exibe um aviso de conflito com a opção de remover provedores em conflito, que limpa automaticamente da lista os modelos incompatíveis.
Usar um preset em requisições
Para usar um preset em uma requisição, informe @preset/<slug> no campo model, no lugar do nome de um modelo:
const completion = await openai.chat.completions.create({
messages: [{
role: "user",
content: "Conte-me uma piada."
}],
model: "@preset/exemplo-claude",
});A Retrace aplica o prompt de sistema, os parâmetros de geração e o nível de raciocínio definidos no preset, e roteia a requisição entre os modelos permitidos do preset seguindo a ordem configurada.
Editar um preset
Acesse a página do preset em Presets para alterar o prompt de sistema, os parâmetros de geração, os modelos permitidos ou a exigência de retenção zero de dados a qualquer momento. As alterações passam a valer nas próximas requisições que usarem o preset.
Excluir um preset
- Acesse a página do preset em Presets.
- Clique em Deletar e confirme a ação.
Essa ação é irreversível. O preset é removido permanentemente do workspace, e qualquer requisição que ainda referencie o slug dele passa a falhar.