Amministrazione

Modelli AI

Esegui il tuo workspace sui modelli gestiti da Polylane, sulla tua chiave OpenAI, Anthropic o Gemini, oppure sul tuo endpoint compatibile con OpenAI.

Ogni workspace ha una sola configurazione dei modelli AI, e si applica a ogni agente del workspace: thread, fix run, autofix e lavoro in background. Impostala nella sezione AI Models di Settings > Workspace nella console.

Provider

ProviderDescrizionePiano
Polylane PureIl predefinito. Polylane gestisce l'inferenza per te, senza chiave e senza configurazione.Ogni piano
OpenAILa famiglia di modelli di OpenAI, con la possibilità di portare la tua chiave.Enterprise
AnthropicLa famiglia di modelli di Anthropic, con la possibilità di portare la tua chiave.Enterprise
Google GeminiLa famiglia di modelli di Google, con la possibilità di portare la tua chiave.Enterprise
Custom (OpenAI-compatible)Il tuo endpoint e i tuoi modelli, uno per tier.Enterprise

Porta la tua chiave

Nel piano Enterprise, seleziona OpenAI, Anthropic o Google Gemini, attiva Bring Your Own Key e incolla una chiave API del tuo account presso il provider. Le chiamate ai modelli girano allora su quell'account secondo il tuo accordo con il provider, e la chiave è cifrata a riposo. L'accesso ai modelli più recenti richiede in genere un piano a pagamento lato provider, quindi una chiave del livello gratuito potrebbe fallire o essere limitata a modelli più vecchi.

Usa Test connection prima di salvare: esegue una generazione di prova attraverso il percorso che seguono le richieste reali, incluso il tuo gateway quando ne è impostato uno. Tornare a Polylane Pure e salvare rimuove la chiave e il gateway salvati.

Nel piano Enterprise, Custom Gateway instrada ogni richiesta di inferenza attraverso il tuo gateway compatibile con OpenAI invece dell'endpoint predefinito del provider. Il campo si sblocca una volta che hai fornito una chiave API.

Endpoint personalizzato

Nel piano Enterprise, il provider Custom (OpenAI-compatible) esegue gli agenti su modelli che Polylane non offre, come un deployment self-hosted o privato. L'utilizzo sul tuo endpoint viene fatturato dal tuo provider e non viene conteggiato nel tuo piano Polylane.

CampoDescrizione
Base URLLa radice della tua API di inferenza compatibile con OpenAI.
Models URLFacoltativo. Un endpoint separato che elenca i modelli disponibili. Lascialo vuoto per usare il percorso dei modelli sotto il Base URL.
Auth header nameL'header con cui il tuo endpoint si autentica. Il predefinito è Authorization; usa x-api-key se il tuo endpoint lo richiede.
Auth header valueInviato così com'è come valore di quell'header, quindi includi qualsiasi prefisso che il tuo endpoint si aspetta. Cifrato a riposo.

Tier dei modelli

Polylane instrada ogni attività interna verso un tier. Fai clic su Load models per recuperare l'elenco dei modelli dal tuo endpoint, poi assegna un modello per tier.

TierDescrizione
PremiumRagionamento profondo: indagini, autofix, piani d'azione.
StandardLa maggior parte del lavoro degli agenti: triage, revisioni.
CheapAttività leggere ad alto volume: titoli, riepiloghi, classificazione.
CodeEsplorazione di repository e infrastruttura.
EmbeddingsIndicizzazione per la ricerca vettoriale.
RerankerRiordinamento dei risultati di ricerca.

Premium, Standard e Cheap ricadono l'uno sull'altro, e Code ricade su di essi, quindi impostare solo Standard esegue tutto il lavoro degli agenti su un solo modello. Nessun tier ricade su Code, quindi Code da solo non basta per salvare. Embeddings ricade sugli embedding gestiti da Polylane quando non è impostato, e il riordinamento viene saltato quando nessun reranker è impostato.

Concludi con Test connection, che esegue una generazione di prova sul tier più economico che hai configurato.

Correlati