Prezzi e specifiche API di GPT-6 Luna
Il modello più piccolo di OpenAI, con gli stessi tool ospitati di Astra e un'impostazione di ragionamento 'none' per i passaggi rapidi ed economici.
In Chat Completions, il function calling funziona solo con il livello di ragionamento impostato su none; per combinare tool e ragionamento, usa la Responses API. Il limite delle conoscenze è il 18 maggio 2026.
I prompt che superano 272K token vengono fatturati a 0,20 USD per i token di input, 0,020 USD per quelli in cache e 0,75 USD per quelli di output, per milione di token. La tariffa più alta si applica all'intera richiesta.
Scheda tecnica
- Nome del modello nell'API
gpt-6-luna- Provider
- OpenAI
- Contesto
- 1,05M token
- Output massimo
- 128K token
- Rilascio
- 22 settembre 2026
- API Batch
- Sconto del 50%, risultati entro poche ore
- Funzionalità per agenti documentate
- Chiamata di toolOutput strutturatoUso del computerMCP remotoRicerca web integrataRagionamento regolabile
Quanto costa un'attività
Quattro carichi di lavoro di riferimento, calcolati con i prezzi di listino del modello e con la cache applicata dopo la prima chiamata. I tuoi valori saranno diversi; con il calcolatore puoi modificare ogni ipotesi.
| Carico di lavoro | Per attività | Per 1.000 attività |
|---|---|---|
| Bot di supporto | 0,003 USD | 3 USD |
| Agente di programmazione | 0,099 USD | 99 USD |
| Agente browser | 0,070 USD | 70 USD |
| Agente di ricerca | 0,066 USD | 66 USD |
Altri modelli di OpenAI
Costi simili presso altri fornitori
Modelli di altri fornitori il cui costo per il carico di lavoro di programmazione in 30 passaggi è più simile a quello di questo modello.