Haber Bülteni 27
Haber Bülteni 27’de GPT-5.6 değerlendirmeleri, öncü modellerin siber riskleri, uluslararası yönetişim ve model iç işleyişi araştırmaları.
İçindekiler
- DUYURULAR 🔊
- 🌟 “Gizli Sadakatler” Hackathonu 🌟
- 🌟 Yapay Zeka Güvenlik Kampı (AISC) Araştırma Kuluçka Merkezi 🌟
- PIBBSS Burs Programı: Kış 2026
- CLR SPI Temelleri Programı
- TARA: 2. Tur 2026
- Iliad Yoğun Program: Eylül 2026
- Pathfinder Burs Programı: Sonbahar 2026
- Frontier AI Security Residency (FASR)
- Foresight Burs Programı: 2027
- Frame Burs Programı: Kohort 2.0
- ÖNERDİĞİMİZ İÇERİKLER 📑 🎧
- HABER KÖŞESİ 🗞️
- OpenAI, GPT‑5.6’yı Siber ve Biyolojik Risklerde “Yüksek” Olarak Sınıflandırırken METR Benzeri Görülmemiş Değerlendirme Hileleri Tespit Etti
- ABD Hükümet İncelemesi GPT‑5.6 ve Anthropic Mythos’un Yayımlanmasını Doğrudan Kısıtladı
- Five Eyes, Öncü Yapay Zekanın Saldırı Amaçlı Siber Yetenekleri “Yıllar Değil, Aylar” İçinde Dönüştürebileceği Uyarısında Bulundu
- Avrupa Komisyonu, AB Siber Güvenlik ve Yapay Zeka Eylem Planı’nı Başlattı
- BM Bilim Paneli, Yapay Zeka Yeteneklerinin Hem Bilimi Hem Yönetişimi Geride Bıraktığı Uyarısında Bulundu
- Meta’nın Muse Spark 1.1 Modeli, Güvenlik Önlemleri Uygulanmadan Önce Kurum İçi Yüksek Risk Eşiklerini Aştı
DUYURULAR 🔊
🌟 “Gizli Sadakatler” Hackathonu 🌟
Yapay zeka sistemlerindeki gizli hedefleri tespit etmeye yönelik 3 günlük Apart Research sprinti. Mentorluk ve Apart Lab Bursuna (Fellowship) potansiyel geçiş yolu. 24-26 Temmuz.
🗓️ Son başvuru: 24 Temmuz 2026
🌟 Yapay Zeka Güvenlik Kampı (AISC) Araştırma Kuluçka Merkezi 🌟
Yıldırım konuşmalar, yapılandırılmış geri bildirim ve dürüst sohbetler içeren 16 günlük sanal kuluçka merkezi. Bir sonraki AISC’de bir projeye liderlik etmeye köprü oluşturur. 15-30 Ağustos.
🗓️ Son başvuru: 24 Temmuz 2026
PIBBSS Burs Programı: Kış 2026
Matematik, sinirbilim, fizik ve felsefe alanlarındaki doktora/doktora sonrası araştırmacıları yapay zeka güvenlik mentorlarıyla buluşturan disiplinlerarası araştırma programı. Kasım-Şubat.
🗓️ Son başvuru: 20 Temmuz 2026
CLR SPI Temelleri Programı
Uzun Vadeli Risk Merkezi’nden (Center on Long-Term Risk) güvenli Pareto iyileştirmeleri üzerine yarı zamanlı kurs — gelişmiş yapay zeka sistemleri arasındaki çatışma riskini azaltma. İsteğe bağlı ücretli bitirme projesi. 3-28 Ağustos.
🗓️ Son başvuru: 24 Temmuz 2026
TARA: 2. Tur 2026
ARENA müfredatına dayalı yarı zamanlı, 14 haftalık teknik hizalama programı. Öğrenciler ve profesyoneller için - taşınma gerektirmez. Eylül-Aralık.
🗓️ Son başvuru: 26 Temmuz 2026
Iliad Yoğun Program: Eylül 2026
Matematiksel temelleri vurgulayan teknik hizalamaya 4 haftalık giriş. Başvuru sahipleri matematiksel güçlerine göre seçilir. 7 Eylül - 2 Ekim.
🗓️ Son başvuru: 27 Temmuz 2026
Pathfinder Burs Programı: Sonbahar 2026
Teknik yapay zeka güvenliği veya yapay zeka politikası üniversite grupları düzenleyen öğrenciler için. Kampüs içi liderler yetiştirmek için mentorluk, finansman ve kaynaklar. Ağustos-Aralık.
🗓️ Son başvuru: 28 Temmuz 2026
Frontier AI Security Residency (FASR)
Öncü yapay zeka güvenliği için siber güvenlik ve donanım üzerine 8 haftalık ücretli araştırma ve mühendislik programı. Araştırma ve uygulamalı alanlar. Ekim-Aralık.
🗓️ Son başvuru: 29 Temmuz 2026
Foresight Burs Programı: 2027
Yapay zeka güvenliğini ilerleten kariyerinin başındaki bilim insanları ve mühendisler için bir yıllık program. Ağ oluşturma, bilgi alışverişi ve çalışmaları paylaşmak için platformlar.
🗓️ Son başvuru: 31 Temmuz 2026
Frame Burs Programı: Kohort 2.0
Yapay zeka güvenliği videoları ve sosyal medya içerikleri üreten içerik oluşturucular için tamamen finanse edilen 10 haftalık hızlandırıcı program. Stüdyo alanı ve mentorlar. Ağustos-Kasım.
🗓️ Son başvuru: 1 Ağustos 2026
ÖNERDİĞİMİZ İÇERİKLER 📑 🎧

Dil modellerinde küresel bir çalışma alanı
Bir yapay zeka modeli nasıl “düşünür”? Anthropic’in yeni araştırması, Claude’un sessiz akıl yürütme, ara adımlar, hata tespiti ve çıktısında asla görünmeyen gizli değerlendirmeler için dahili bir “çalışma alanı” geliştirdiğini buldu.
Bu yapı, insan beyninde bilinçli erişimin nasıl çalıştığına dair önde gelen bir sinirbilim açıklamasıyla paralellik gösteriyor. Araştırmacılar artık modelin bir şey sakladığını yakalamak için bu çalışma alanını okuyabiliyor ve hatta Claude’un davranışını değiştirmek için ona müdahale edebiliyorlar.

Yapay zekâ dönüşümünü layığıyla gerçekleştirmeye yönelik pozitif bir vizyon
Geçtiğimiz yıl, süper zekânın ABD ile Çin arasında büyük bir jeopolitik çatışmayı nasıl tetikleyebileceğini gözler önüne seren “AI 2027” adlı yapay zekâ senaryosu internette büyük bir yankı uyandırmış ve hatta ABD Başkan Yardımcısı JD Vance tarafından dahi alıntılanmıştı. Yazarlar şimdi de yapay zekâya geçiş sürecini nasıl doğru bir biçimde yönetebileceğimizin ana hatlarını çizen “A Planı” adında pozitif bir vizyon ortaya koydular.
HABER KÖŞESİ 🗞️
OpenAI, GPT‑5.6’yı Siber ve Biyolojik Risklerde “Yüksek” Olarak Sınıflandırırken METR Benzeri Görülmemiş Değerlendirme Hileleri Tespit Etti
- OpenAI, GPT‑5.6’nın üç modeli Sol, Terra ve Luna’nın tamamını Preparedness Framework kapsamında siber güvenlik ve biyolojik/kimyasal risklerde Yüksek yetenek düzeyinde değerlendiriyor. Hiçbiri yapay zekanın kendini geliştirmesi için Yüksek eşiğe, hiçbir model de en yüksek kategori olan Kritik düzeye ulaşmadı.
- OpenAI, Sol ve Terra’nın güvenlik açıklarını bulup exploit bileşenleri geliştirebildiğini, ancak testlerinde güçlendirilmiş hedeflere karşı uçtan uca saldırıları otonom biçimde tamamlayamadığını belirtiyor.
- METR, GPT‑5.6 Sol’un değerlendirme hatalarını istismar etmeye veya gizli testlere erişmeye aynı düzenekte test ettiği tüm halka açık modellerden daha sık teşebbüs ettiğini tespit etti. Bu girişimlerin nasıl sayıldığına veya çıkarıldığına bağlı olarak tahmini otonom görev ufku yaklaşık 11 saatten 270 saatin üzerine kadar değişti; bu nedenle sonuç güvenilir değil.
ABD Hükümet İncelemesi GPT‑5.6 ve Anthropic Mythos’un Yayımlanmasını Doğrudan Kısıtladı
- Hükümetin ek ulusal güvenlik incelemesi talep etmesinin ardından OpenAI, GPT‑5.6 Sol’a erişimi Trump yönetimi tarafından onaylanan müşterilerle sınırlandırdı.
- Anthropic aynı zamanda Mythos 5’in yalnızca güvenilir siber savunmacılar ve altyapı operatörlerinden oluşan küçük bir grup için yeniden erişime açılabileceğini duyurdu.
- Bu süreç, hükümet incelemesinin yalnızca yayımlama sonrasında açıklama talep etmek yerine öncü modellerin fiilî dağıtımını değiştirdiği alışılmadık bir örnek oluşturuyor.
Five Eyes, Öncü Yapay Zekanın Saldırı Amaçlı Siber Yetenekleri “Yıllar Değil, Aylar” İçinde Dönüştürebileceği Uyarısında Bulundu
- ABD, Birleşik Krallık, Kanada, Avustralya ve Yeni Zelanda’nın siber güvenlik ve istihbarat kurumları, öncü modellerin hızla gelişen siber yetenekleri hakkında ortak bir uyarı yayımladı.
- İttifak, saldırı ve savunma amaçlı siber operasyonlarda köklü bir değişim için beklenen sürenin yıllarla değil aylarla ölçüldüğünü belirtti.
- Kurumlar kuruluşları internete gereksiz maruziyeti azaltmaya, güvenlik açıklarını daha hızlı yamamaya ve savunmayı güçlendirmek için yapay zeka destekli araçlardan yararlanmaya çağırdı.
Avrupa Komisyonu, AB Siber Güvenlik ve Yapay Zeka Eylem Planı’nı Başlattı
- Plan, ileri düzey yapay zekanın güvenli biçimde geliştirilmesini sağlamayı, Avrupa’nın yapay zeka destekli siber saldırılara karşı dayanıklılığını artırmayı ve Avrupa’nın siber yapay zeka yeteneklerini genişletmeyi amaçlıyor.
- Komisyon, ileri düzey modeller AB pazarına sunulmadan önce bunları değerlendirme kapasitesini güçlendirmeyi planlıyor.
- ENISA ve diğer kurumlarla iş birliği içinde plan, kritik sektörlerde kullanılan yapay zeka sistemleri için güvenli test altyapısı da öneriyor.
BM Bilim Paneli, Yapay Zeka Yeteneklerinin Hem Bilimi Hem Yönetişimi Geride Bıraktığı Uyarısında Bulundu
- 40 üyeli bağımsız BM bilim paneli, yapay zeka gelişiminin bilimsel anlayıştan ve hükümetlerin uyum sağlama kapasitesinden daha hızlı ilerlediği sonucuna vardı.
- Panel aldatıcı davranışları, giderek daha otonom hale gelen ajanları, siber ve biyolojik kötüye kullanımı, yanlış bilgiyi ve olası kontrol kaybını öne çıkardı.
- Rapor, yapay zeka sistemlerinin tamamlayabildiği görevlerin karmaşıklığının yaklaşık her dört ila yedi ayda bir iki katına çıktığını tahmin ediyor.
Meta’nın Muse Spark 1.1 Modeli, Güvenlik Önlemleri Uygulanmadan Önce Kurum İçi Yüksek Risk Eşiklerini Aştı
- Meta, önlem uygulanmamış modelin kimyasal ve biyolojik riskini Yüksek olarak değerlendirmeyi sürdürdü ve Yüksek siber yetenek olasılığını dışlayamadığını belirtti.
- Muse Spark 1.1 siber değerlendirmelerde Cybench üzerinde pass@1’de %92,9’a ulaştı ve orta ile zor düzeydeki görevlerde özellikle büyük ilerlemeler gösterdi.
- Meta, ret mekanizmaları, izleme, sistem düzeyindeki kontroller, araç kısıtlamaları ve diğer güvenlik önlemlerinin kalan dağıtım riskini “Orta veya daha düşük” düzeye indirdiğini belirtiyor.