Administração

Modelos de IA

Rode o seu workspace nos modelos gerenciados do Polylane, na sua própria chave da OpenAI, da Anthropic ou do Gemini, ou no seu próprio endpoint compatível com OpenAI.

Todo workspace tem uma configuração de modelo de IA, e ela se aplica a todo agente do workspace: threads, execuções de correção, autofixes e trabalho em segundo plano. Defina-a na seção AI Models de Settings > Workspace no console.

Provedores

ProvedorDescriçãoPlano
Polylane PureO padrão. O Polylane gerencia a inferência para você, sem chave e sem configuração.Todo plano
OpenAIA família de modelos da OpenAI, com a opção de trazer a sua própria chave.Enterprise
AnthropicA família de modelos da Anthropic, com a opção de trazer a sua própria chave.Enterprise
Google GeminiA família de modelos do Google, com a opção de trazer a sua própria chave.Enterprise
Custom (OpenAI-compatible)O seu próprio endpoint e os seus próprios modelos, um por nível.Enterprise

Traga a sua própria chave

No plano Enterprise, selecione OpenAI, Anthropic ou Google Gemini, ligue Bring Your Own Key e cole uma chave de API da sua conta no provedor. As chamadas de modelo passam então a rodar contra essa conta sob o seu próprio contrato com o provedor, e a chave é criptografada em repouso. O acesso aos modelos mais recentes normalmente exige um plano pago do lado do provedor, então uma chave de nível gratuito pode falhar ou ficar limitada a modelos mais antigos.

Use Test connection antes de salvar: ele executa uma geração de teste pelo caminho que as requisições reais percorrem, incluindo o seu gateway quando há um definido. Voltar para Polylane Pure e salvar remove a chave e o gateway armazenados.

No plano Enterprise, Custom Gateway encaminha toda requisição de inferência pelo seu próprio gateway compatível com OpenAI em vez do endpoint padrão do provedor. O campo é desbloqueado depois que você informa uma chave de API.

Endpoint personalizado

No plano Enterprise, o provedor Custom (OpenAI-compatible) roda os agentes em modelos que o Polylane não oferece, como um deployment auto-hospedado ou privado. O uso no seu endpoint é cobrado pelo seu provedor e não é medido contra o seu plano do Polylane.

CampoDescrição
Base URLA raiz da sua API de inferência compatível com OpenAI.
Models URLOpcional. Um endpoint separado que lista os modelos disponíveis. Deixe em branco para usar o caminho de modelos sob a URL base.
Auth header nameO cabeçalho com que o seu endpoint autentica. O padrão é Authorization; use x-api-key se o seu endpoint exigir.
Auth header valueEnviado literalmente como o valor desse cabeçalho, então inclua qualquer prefixo que o seu endpoint espere. Criptografado em repouso.

Níveis de modelo

O Polylane encaminha cada tarefa interna para um nível. Clique em Load models para buscar a lista de modelos do seu endpoint, depois atribua um modelo por nível.

NívelDescrição
PremiumRaciocínio profundo: investigações, autofix, planos de ação.
StandardA maior parte do trabalho dos agentes: triagem, revisões.
CheapTarefas leves de alto volume: títulos, resumos, classificação.
CodeExploração de repositórios e infraestrutura.
EmbeddingsIndexação para busca vetorial.
RerankerReordenação dos resultados de busca.

Premium, Standard e Cheap recorrem uns aos outros, e Code recorre a eles, então definir apenas Standard roda todo o trabalho dos agentes em um modelo. Nenhum nível recorre a Code, então Code sozinho não basta para salvar. Embeddings recorre aos embeddings gerenciados do Polylane quando não está definido, e a reordenação é pulada quando nenhum reranker está definido.

Termine com Test connection, que executa uma geração de teste contra o nível mais barato que você configurou.

Relacionado

  • Cobrança e uso para qual plano desbloqueia qual provedor.
  • Workspace para o restante da página de configurações do Workspace.