Teknik Rehber
GPT-6 API Rehberi: Astra Fiyatları, Bağlam, Araçlar ve Geçiş

GPT-6 ile geliştirmek için OpenAI Responses API'de gpt-6-astra kullanın. Model metin ve görüntü girişi, metin çıkışı, fonksiyon çağrısı, Structured Outputs, akış ve OpenAI tarafından barındırılan araçları destekler. Bağlam 1.050.000 token, azami çıktı 128.000 token; Standard fiyatı milyon giriş tokenına 10, milyon çıkış tokenına 50 ABD dolarıdır.
Üretim geçişine yalnızca model adını değiştirerek başlamayın. GPT-6; asenkron araçlar, tur içi yönlendirme ve konuşma sırasında akıl yürütme güncellemeleri ekler. Bunlar oturum durumunu, bekleyen çağrıları, iptali, gözlemlenebilirliği ve maliyeti etkiler. Sabit değerlendirme kümesi ve küçük bir görev grubuyla başlayın.
Kaynaklar: model sayfası; model rehberi; Responses API geçişi; duyuru; güvenlik özeti; Artificial Analysis; API maliyet ve çaba testleri; üretimden türetilen kodlama testi. 7 Eylül 2026'da kontrol edildi.
Hızlı başvuru
| Ayar | Güncel değer |
|---|---|
| Model kimliği | gpt-6-astra |
| Önerilen API | Responses API |
| Bağlam penceresi | 1.050.000 token |
| Azami çıktı | 128.000 token |
| Bilgi kesim tarihi | 30 Nisan 2026 |
| Akıl yürütme çabası | low, medium, high, xhigh, max |
| Metin | Giriş ve çıkış |
| Görüntü | Yalnız giriş |
| Ses ve video modaliteleri | Doğrudan desteklenmiyor |
| Fonksiyon çağrısı | Destekleniyor |
| Structured Outputs | Destekleniyor |
| İnce ayar | Desteklenmiyor |
| Ücretsiz API katmanı | Desteklenmiyor |
Harici API testlerinin bulguları
İlk önemli ders, yapılandırmanın model adı kadar önemli olması.
Artificial Analysis, Astra max'ı OpenAI'ın kendi API'siyle test etti. Güncel görünümde Intelligence Index puanı 55, saniyelik çıktı 64,3 token, görev maliyeti 2,57 ABD doları ve max düzeyinde ilk token beklemesi yaklaşık 355 saniye. Max bilinçli olarak pahalı bir ayar, ama bu ölçümler çaba, gecikme ve maliyeti tek gpt-6-astra etiketi altında saklamamak gerektiğini gösteriyor.
ComputingForGeeks gerçek çağrıyla tarifeyi doğruladı, ardından aynı hata ayıklama sorusunu farklı model ve çaba seviyelerine verdi. Astra 3.525 düşünme tokenı kullandı, 75,5 saniye sürdü ve yaklaşık 0,194 ABD doları tuttu. Sol 39,3 saniye ve 0,048 ABD dolarıydı. Teşhis aynıydı; Astra bir sınırlama ve daha güçlü doğrulama adımları ekledi.
Yazar aynı Astra sorusunda low'dan max'a geçince maliyetin yaklaşık 10, gecikmenin sekiz katına çıktığını da bildirdi. Low üç nedeni zaten bulmuştu; yüksek çaba daha kapsamlı plan sundu ve sonunda testin 6.000 token çıkış sınırına ulaştı. Tek bir test olsa da ölçülü varsayılanı destekliyor: medium ile başla, yalnız ölçülmüş gerekçeyle artır, çıktıyı sınırla.
Üretimden türetilen kodlama testi, hesabın diğer tarafını gösteriyor. Ucuz modelin yeşil testlere rağmen teslim ettiği bileşenler arası durum hatasını Astra önledi. Tek API çağrısı daha pahalı, inceleme ve onarımdan sonraki kabul edilmiş görev daha ucuz olabilir. İki rakamı da ölçün.
Model sayfası Responses API araçları arasında web ve dosya araması, görüntü üretimi, kod yorumlayıcı, barındırılan shell, yama uygulama, skills, bilgisayar kullanımı, MCP ve araç aramasını da listeler. Desteklenen araç otomatik etkin, yetkili veya uygulamanıza uygun değildir.
Bir demo API hakkında neyi kanıtlamaz?
Matt Shumer'ın yazısı, büyük deneylerinin koordineli oturum ve yoğun token kullanımına bağlı olduğunu, uzun çalışmaların duraksayabildiğini söylüyor. Entegrasyon, geçen süre yanında kabule doğru ilerlemeyi ölçmeli. Çıktı üretmeye devam eden süreç teslimi artık geliştirmiyor olabilir.
Claire Vo'nun bölüm notları, geliştirmeyle birlikte tarayıcı QA'sını vurgular. API uygulaması için soru, çalışma ortamının bitmiş ürünü inceleyip inceleyemediğidir. Koda davranış, belgelere kaynak doğrulaması verin; yalnız metin cevabı, zengin araçlı demoyu yeniden üretemez.
Bu deneyimler test tasarımını yönlendirir; API parametrelerini, faturalandırmayı veya genel tamamlanma oranını doğrulamaz.
En küçük Responses API isteği
Güncel hızlı başlangıcın önerdiği resmî OpenAI SDK sürümünü kullanın. En küçük JavaScript isteği şu yapıdadır:
import OpenAI from "openai";
const client = new OpenAI();
const response = await client.responses.create({
model: "gpt-6-astra",
reasoning: { effort: "medium" },
input: [
{
role: "developer",
content: "Return a concise, source-grounded decision brief.",
},
{
role: "user",
content: "Compare the attached proposals against the approval criteria.",
},
],
});
console.log(response.output_text);API anahtarlarını ortamın gizli bilgi yönetiminde tutun; istem, kaynak dosyası, istemci kodu veya günlüğe koymayın. Gerçek yanıt nesnesini doğrulayın. output_text tek çıktı olmayabilir; araç çağrıları ve yapılandırılmış öğeler de gelebilir.
Akıl yürütme çabasını bilinçli seçin
Astra none desteklemez. Değerlendirmeye low veya medium ile başlayın; kalite, gecikme ve masrafı karşılıyorsa artırın. OpenAI tabloları çaba seviyelerindeki en yüksek puanı verir. Manşet benchmark sizin ayarınızda aynı sonucu vaat etmez.
Örnek dağıtım politikası:
| Görev işareti | Başlangıç seviyesi |
|---|---|
| Kısa, sınırlı dönüşüm | Low |
| Açık ölçütlerle çok kaynaklı analiz | Medium |
| Zor planlama, kodlama veya araç koordinasyonu | High |
| Alt seviyeler başarısız olduğunda nadir yüksek değerli sorun | Xhigh veya max |
Her çalışmada seviyeyi kaydedin. Yoksa ayar değişikliği sonradan model gerilemesi gibi görünebilir. Azami çıktı bütçesi de verin: gizli düşünme çıktı olarak ücretlenir ve görünür cevap bitmeden yüksek tüketim oluşabilir.
Konuşma sırasında çabayı güncelleyin
OpenAI, önbellek önekini koruyup çabayı değiştiren configuration_update giriş öğesini belgeler. Basit oturum zor bir istisnaya ulaştığında veya karmaşık aşama rutin işlere geçtiğinde yararlıdır.
Uygulama yalnız son ayarı değil, yapılandırma zaman çizelgesini tutmalı. Low'dan max'a geçen çalışmanın beklenen maliyet ve gecikmesi, low'da kalandan farklıdır.
Asenkron araç çağrıları
Asenkron fonksiyon veya özel araç kullanıldığında uygulama çağrıyı yaparken Astra sonuca bağımlı olmayan işi sürdürebilir. Hazır sonucu özgün çağrı kimliğiyle döndürün.
Bu yöntem dağıtık sistemlerin olağan sorunlarını getirir:
- Kullanıcı iptal ettikten veya değiştirdikten sonra sonuç gelebilir.
- İki çağrı farklı sırada bitebilir.
- Harici yazma başarılı olduktan sonra zaman aşımı oluşabilir.
- İdempotent olmayan çağrıyı tekrarlamak eylemi çoğaltabilir.
- Bağımsız işler biterken gerekli bir çağrı beklemede kalabilir.
pending, completed, failed, cancelled ve expired durumlarını kalıcı saklayın. Yazmada idempotans anahtarı kullanın, tekrar öncesi kayıt sistemini sorgulayın ve eski görev sürümüne ait geç sonuçları reddedin.
Tur içinde yönlendirme
WebSocket bağlantısı, Astra çalışırken ek kullanıcı talimatı göndermeye izin verir. Uzun işi yeniden başlatmadan düzeltmeyi kolaylaştırır, fakat niyet sürümlenmelidir.
Her yön değişikliğini zaman damgasıyla saklayın, geçersiz kıldığı bekleyen eylemleri işaretleyin. Raporun hedef kitlesi değişince yazı devam edebilir. Harici işlemin hesabı veya hedefi değişirse yeni kapsam doğrulanıp onaylanana kadar durun.
Yapılandırılmış çıktı ve araçlar
Sonraki kod bir şema istiyorsa Structured Outputs kullanın. Şema biçimi doğrular, gerçeği değil. Nesneyi kabul etmeden kimlikleri izinli değerlerle eşleştirin, toplamları bağımsız hesaplayın ve atıfları kontrol edin.
Dar kapsamlı araçlar tasarlayın:
Tercih edin: create_draft_invoice(customer_id, line_items)
Kaçının: run_shell(command)
Tercih edin: search_approved_project_sources(query, project_id)
Kaçının: browse_any_url(url)Kimlik, kiracı kapsamı, izinli argümanlar, bütçe ve onayı istem değil uygulama uygulamalı. Üretim sistemlerini açmadan ajan mimarisi rehberini inceleyin.
Bilgisayar kullanımı
OpenAI'a göre GPT-6 Astra en güçlü bilgisayar kullanımı modeli, ancak görsel arayüzler deterministik değildir; gözlem ve eylem arasında değişebilir. Tıklama ve tuşları önerilen işlemler olarak ele alın:
- Kullanılabilir uygulama, hesap ve görev kapsamını sınırlayın.
- Karara temel olan durumu kaydedin.
- Önemli değişiklikleri önce önizleyin.
- Gönderme, silme, yayınlama, satın alma ve yetki değişikliğinde onay isteyin.
- Son durumu bağımsız okumayla doğrulayın.
- Hata teşhisi ve geri alma için yeterli kanıt saklayın.
Masaüstü ajan rehberi, yerel bilgisayar erişiminin risk modelini nasıl değiştirdiğini açıklar.
GPT-6 API fiyatları
OpenAI milyon metin tokenı başına şu tarifeleri listeliyor:
| Kalem | Standard ücret |
|---|---|
| Giriş | 10,00 ABD doları |
| Önbellekteki giriş | 1,00 ABD doları |
| Önbellek yazma | 12,50 ABD doları |
| Çıkış | 50,00 ABD doları |
272.000 giriş tokenının üstünde, tüm istekte giriş ve önbellek tarifesi iki, çıkış tarifesi 1,5 kat olur. Önbellek yazma, önbelleksiz girişin 1,25 katı. Batch ve Flex Standard'ın %50'si, Fast geçerli fiyatın iki katıdır. Araç çağrıları ek ücret yaratabilir.

CodeRabbit tarafından sabit token sayısı ve 4 Eylül 2026 tarifeleriyle hesaplanan örnek. Tamamlanan görev başına ölçülmüş maliyet değildir.
Maliyet örneği
80.000 önbelleksiz giriş ve 8.000 çıkış tokenlı Standard isteği yaklaşık şöyle fiyatlanır:
giriş: 80.000 / 1.000.000 x 10 USD = 0,80 USD
çıkış: 8.000 / 1.000.000 x 50 USD = 0,40 USD
model ara toplamı: 1,20 USDÖrnek; araç, önbellek yazma, tekrar ve incelemeyi içermez. Uzun istem eşiğinde çarpanlar tüm isteğin hesabını değiştirir.
İstem önbelleğini bilinçli kullanın
Sabit talimat, şema ve ortak kaynakları sık değişen kullanıcı içeriğinin önüne koyarak ortak öneki yeniden kullanın. Önbellek okuma ve yazma tokenlarını ayrı izleyin. Sadece isabet oranı artsın diye ilgisiz içerik tutmayın; dikkati dağıtabilir ve erişim kontrolünü zorlaştırabilir.
Öneki sürümleyin. Politika, kaynak veya şema değişirse kayıt tam olarak hangi sürümün kullanıldığını göstermeli.
Hız limitleri ve erişim
Model sayfası kullanım katmanına göre limit verir, ücretsiz API katmanını dışlar. Kullanım ve harcama arttıkça sınırlar yükselebilir. 429 yanıtları, kuyruk geri basıncı, iptal ve bilinçli seçilmiş yedek modele hazırlanın. Kritik veya şemaya duyarlı görevde model değişimini kaydetmeden ve çıktıyı yeniden doğrulamadan sessizce yedeğe geçmeyin.
Duyuruya göre uygun API müşterileri Zero Data Retention kullanabilir. Uygunluk, veri yerleşimi ve güvenlik işleme ayrı koşullardır; hesabınız ve bölgeniz için her birini doğrulayın.
OpenAI, ek korumaların meşru işi durdurabileceğini de söylüyor. Bir erken Codex raporu, normal depo işlerinin çalışmanın sonuna doğru siber politika nedeniyle tekrar tekrar kesildiğini anlatıyor. Ölçülmüş oran değil, test edilecek bireysel durum sayın: duruşu, kayıp süreyi, ayarı ve yedeğin güvenle tamamlayıp tamamlamadığını kaydedin.
Geçiş kontrol listesi
- 20–50 temsilî görevi ve beklenen sonuçları sabitleyin.
- Model, istem, araç, çaba, gecikme ve kabul edilen görev maliyetini kaydedin.
- Adil karşılaştırma için önce yalnız modeli değiştirin.
- İstemleri yeniden yazmadan yeni davranışı inceleyin.
- Eksik, çelişkili ve eski kanıtla uzun bağlamı test edin.
- Araç reddi, zaman aşımı, yinelenen sonuç ve iptali sınayın.
- Dosya ve web içeriğinde istem enjeksiyonunu test edin.
- Structured Outputs'u yalnız şema uygunluğuyla sınırlı kalmadan doğrulayın.
- Her çalışmaya bütçe ve durma koşulu ekleyin.
- Genişletmeden önce uygun görevlerin küçük yüzdesini yönlendirin.
- Tekrarlanabilirlik gerektiğinde uygun model snapshot'ını sabitleyin.
- Test edilmiş yedek ve geri dönüş yolu tutun.
Model seçimi için GPT-6 ve GPT-5.6 karşılaştırmasını okuyun.
Üretim değerlendirme şablonu
Süreç: [ad ve sorumlu]
Model: gpt-6-astra
Akıl yürütme çabası: [low/medium/high/xhigh/max]
İstem sürümü: [ID]
Kaynaklar: [kimlikler, yetkiler, getirme tarihi]
Araçlar: [şemalar, kapsamlar, zaman aşımları, idempotans]
Çıktı sözleşmesi: [şema ve anlamsal kontroller]
İnsan onayları: [onay gerektiren eylemler]
Bütçeler: [token, araç, maliyet, süre]
Hata davranışı: [tekrar, yedek, dur, üst seviyeye taşı]
Kabul: [kalite, güvenlik, gecikme, maliyet eşikleri]
Denetim: [girişler, çağrılar, onaylar, çıktılar, inceleme kararı]Ottermind, brif, kaynaklar, test çıktıları, inceleme kararları ve teslimi tek alanda tutabilir. Sınırlı bir süreçle başlayın; araç eklemeden istem mühendisliği rehberiyle görev sözleşmesini açık hale getirin.
Sık sorulan sorular
API model adı nedir?
OpenAI API'de gpt-6-astra kullanın.
Chat Completions mı Responses API mi?
Model sayfası ikisini de listeler, ancak GPT-6 rehberi Responses API kullanır ve yeni süreç özellikleri ona bağlıdır. Yeni araçlı uygulamalarda Responses'ı tercih edin.
İnce ayar destekleniyor mu?
Güncel sayfa desteklenmediğini belirtiyor.
Görüntü işleyebilir mi?
Evet, görüntü girişi listeleniyor. Doğrudan görüntü çıktısı modalite değil; görüntü üretimi araç olarak mevcut.
Bir API isteği ne kadar tutar?
Giriş, çıkış, önbellek, uzun istem çarpanı, mod, araçlar ve tekrara bağlı. 7 Eylül 2026 itibarıyla Standard giriş milyonda 10, çıkış milyonda 50 ABD doları.
Her istekte bir milyon token gönderebilir miyim?
Pencere 1,05 milyon token, ama kapasite öneri değildir. 272.000 giriş tokenından sonra fiyat değişir; dikkatli kaynak seçimi ve değerlendirme yine gerekir.
Özerk araç kullanımı güvenli mi?
Hiçbir modele sınırsız araç verilmemeli. En az ayrıcalık, argüman doğrulama, önemli eylemlerde onay ve gözlenen davranış denetimi uygulayın. Ajan güvenlik kontrol listesi başlangıç noktasıdır.
