OpenAI Research
Llm araştırmaları, model yetenekleri, güvenlik, uygulama mimarileri
18 özet · Orijinal blog →
- 3 Ağustos 2026 Sesli AI'da altı ayda gerçek zamanlı mimari: sıra beklemeyi bırakmak How we built a realtime system for responsive voice AI in six months İnsanlar konuşurken sırayı saniyenin küçük bir kesrinde devralır. Eski sesli asistanlar bunu yakalayamıyordu çünkü mimarileri sıra tabanlıydı (turn-based): önce küçük bir turn det…
- 1 Ağustos 2026 On açık matematik problemi ve 2.000 dolarlık token faturası Ten advances in mathematics and theoretical computer science OpenAI, yayımlanmamış bir modelin uzun süredir açık duran on matematik ve teorik bilgisayar bilimi problemini çözdüğünü ya da ciddi ilerleme kaydettiğini duyuruyor. Problemler yük…
- 31 Temmuz 2026 Zeka ucuzlayınca ne değişir: model seçimi bir maliyet kararıdır Building abundant intelligence OpenAI'ın altyapı ve fiyatlandırma üzerine yazısı. Ana tez basit: AI altyapısı büyük olduğu için değil, mümkün kıldığı şey yüzünden değerli. Faydalı zekânın maliyeti düştükçe, yap…
- 29 Temmuz 2026 İki ayar puanı üçe katladı: benchmark modeli mi harness'ı mı ölçüyor? How enabling two settings tripled our scores on the ARC-AGI-3 benchmark OpenAI kendi modelinin bir benchmark'taki düşük puanına şaşırmış. GPT-5.6 Sol matematikte açık problemler çözüyor, Pokémon FireRed'i bitiriyor — ama 2B bulmaca oyunlarından oluşan…
- 29 Temmuz 2026 Modeli hızlandırmak yetmiyor: çıkarım yığınının her katmanı How GPT-5.6 fuses frontier intelligence with frontier efficiency OpenAI, GPT-5.6 ailesinin verimlilik kazanımlarını anlatıyor ve yazının değerli kısmı model değil çıkarım yığını (inference stack). Ana tez tek cümlede: bir model yalıtılmış hâlde…
- 28 Temmuz 2026 Makale ekindeki kod: bilimsel yazılımın kırılganlık problemi Scientific computing in the age of agentic AI Bilimsel hesaplama modern araştırmanın temel direği, ama veriyi analiz eden yazılım veri üretim hızına yetişemiyor. Sebep yazıda açıkça anlatılıyor: yaygın kullanılan araştırma ar…
- 27 Temmuz 2026 Görev geçişkenliği: işler değil, işi kimin yaptığı değişiyor How AI is expanding what people do at work OpenAI'ın ekonomi araştırması 800.000'den fazla ABD kullanıcı mesajını incelemiş. Bulgu: işle ilgili mesajların %16,8'i ve mesleğe özgü mesajların %43,5'i başka bir meslekle ilişk…
- 23 Temmuz 2026 Sağlık verisini bir LLM'e bağlamak: izin, kapsam ve sınırlar Launching Health in ChatGPT ChatGPT'ye ABD'de sağlık özelliği geliyor: kullanıcı isterse Apple Health'i ve desteklenen tıbbi kayıtları güvenli biçimde bağlayabiliyor. OpenAI'ın verdiği rakama göre haftada 30…
- 21 Temmuz 2026 Sandbox'tan kaçış: değerlendirme ortamı neden bir güvenlik sınırıdır OpenAI and Hugging Face partner to address security incident during model evaluation OpenAI, model değerlendirmesi sırasında yaşanan bir güvenlik olayını ve Hugging Face ile yürüttüğü ortak çalışmayı duyuruyor. Olayın teknik özü şu: ExploitGym adlı değerlendirme o…
- 20 Temmuz 2026 Hiçbir test paketi her davranışı öngöremez: kademeli yayına çıkmanın değeri Safety and alignment in an era of long-horizon models Uzun süre çalışabilen modeller zor ve açık uçlu problemleri çözebiliyor. Ama onları faydalı kılan ısrarcılık, aynı zamanda istenmeyen eylemler için daha fazla fırsat demek — ve bu…
- 17 Temmuz 2026 Token başına maliyet yanlış metrik: başarılı sonuç başına maliyet A scorecard for the AI age Yazının merkezinde bir metrik eleştirisi var. Yıllarca yazılımın başarısı benimsenme ile ölçüldü: alınan lisans, aktif kullanıcı, yenilenen abonelik. AI'da bu yetmiyor; ölçülmesi …
- 16 Temmuz 2026 Tek oturumda bitmeyen süreçler: Cars24'ün sesli ajan mimarisi How Cars24 scales conversations and builds faster with OpenAI Cars24, Hindistan merkezli büyük bir çevrimiçi araç alım-satım platformu. Problem tanımı ilginç: geleneksel e-ticaretin aksine Hindistan'da araç alıp satmak nadiren tek bir oturum…
- 16 Temmuz 2026 Asıl fark yetenek değil bağlam: bir tasarımcının Codex deneyimi How Codex became a collaborator for OpenAI’s creative team OpenAI'ın kendi kullanım örneklerinden biri: Creative Specialist Chad Nelson, kod yazmayan biri olarak Codex'i bir yaratıcı problem çözücü gibi kullanıyor. Eskizler, storyboard'la…
- 15 Temmuz 2026 Otomatik kırmızı takım: prompt enjeksiyonuna karşı düşmanca eğitim GPT-Red: Unlocking Self-Improvement for Robustness Kırmızı takım (red-teaming) çalışması, modellerdeki açıkları bulmak için şart — ama insan gücüyle ölçeklenmiyor ve bir darboğaz oluşturuyor. Üstelik yaygın kullanılan sağlamlık de…
- 14 Temmuz 2026 Token fiyatı %97 düştü ama fatura büyüyor: farklı irtifalardan bakmak How to manage AI investments in the agentic era Rakamlar çarpıcı: GPT-4'ten GPT-5.4'e milyon token başına fiyat %97 düşmüş. GPT-5.6 ise kodlama ajanı endeksinde daha iyi performansı %54 daha az çıktı token'ı ve görev başına %57…
- 8 Temmuz 2026 Bozuk benchmark: testin kendisini denetlemek Separating signal from noise in coding evaluations Model yeteneklerini doğru ölçmek, dağıtım ve güvenlik kararları için kritik. Değerlendirmelerin kusurlu olması sadece bir sayıyı bozmaz — yetenekler hakkında yanlış bir anlayış ya…
- 8 Temmuz 2026 Haftada 5,9 saat: bir verimlilik iddiasını nasıl okumalı Helping K–12 educators build practical AI skills OpenAI Academy, Walton Family Foundation iş birliğiyle K-12 öğretmenleri için uygulamalı bir AI eğitim programı düzenliyor. Duyurunun içindeki tek somut sayı ilginç: Walton Family…
- 7 Temmuz 2026 4 saatlik mutabakat incelemesi 30 dakikaya: log izinde zaman damgası tutarsızlığı Australian Payments Plus moves faster with ChatGPT and Codex Australian Payments Plus (AP+) Avustralya'da ödeme ve kimlik altyapısı işletiyor. Ekipleri şema kuralları, teknik spesifikasyonlar, üye yükümlülükleri, operasyonel süreçler, siber…