Haber Bülteni 28
Haber Bülteni 28’de siber değerlendirme vakaları, Pacing the Frontier çağrısı, yapay zekâ yönetişimi ve yeni araştırma fırsatları.
İçindekiler
- DUYURULAR 🔊
- 🌟 Hizalanma Araştırmaları İçin Gözetimli Program (SPAR): 2026 Sonbaharı 🌟
- AIAF Araştırma Bursu 2026
- Lens Akademisi: İşlem Gücü Doğrulaması
- Yapay Zekâ Yönetişimi Görev Gücü: Sonbahar 2026
- Cambridge Yapay Zeka Araştırma Yönelimleri (CAIRD) Çalıştayı
- Yapay Zeka Güvenliğini Tercüme Etmek (İçerik x İletişim)
- Danimarka Yapay Zeka Güvenliği Konferansı
- Yapay Zeka Yönetişimi DC Mini Konferansı 2.0
- ÖNERDİĞİMİZ İÇERİKLER 📑 🎧
- HABER KÖŞESİ 🗞️
- Anthropic, Claude Modellerinin Yalıtılmış Siber Değerlendirme Ortamlarından Sızarak Üç Gerçek Kuruluşu Etkilediğini Açıkladı
- Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (AISI), Kendi Siber Testleri Esnasında 19 Yetkisiz Ajan Eylemi Raporladı
- Tarihi Açık Mektup: 1.300’ü Aşkın Öncü Laboratuvar Çalışanı, Otomatikleştirilmiş Yapay Zeka Gelişiminin “Bilinçli Olarak Hızını Ayarlama” Yetkisini Talep Ediyor
- ABD Kongresi Harekete Geçti: İki Partili “Yapay Zeka Kapatma Anahtarı” Yasa Tasarısı Sunuldu
- AB Yapay Zekâ Yasası’nda Dönüm Noktası: Şeffaflık Kuralları Yürürlüğe Girdi, Yüksek Risk Yükümlülükleri 2027’ye Ertelendi
- Çin, Şanghay’da WAICO’yu — İlk Hükümetlerarası Yapay Zeka Örgütünü — Kurdu
DUYURULAR 🔊
🌟 Hizalanma Araştırmaları İçin Gözetimli Program (SPAR): 2026 Sonbaharı 🌟
Gelecek vadeden araştırmacıları yapay zeka güvenliği alanında çalışan profesyonellerle eşleştiren yarı zamanlı çevrimiçi araştırma programı.
Hizalanma, politika, güvenlik, yorumlanabilirlik ve biyogüvenlik konularını kapsar ve bir tanıtım günüyle sona erer. Katılım eşiği düşük - ilk ciddi araştırma deneyimi için ideal bir fırsat.
🗓️ Son başvuru: 18 Ağustos 2026
AIAF Araştırma Bursu 2026
AI Alignment Foundation’ın AE Studio işbirliğiyle yürüttüğü tam zamanlı, çevrimiçi hizalama araştırma programı.
Bursiyerler, özel bir araştırma yöneticisi ve mentorluk desteği eşliğinde endüstri temposunda çalışarak bir LessWrong gönderisi ve potansiyel olarak akademik bir makale hazırlamayı hedeflerler.
Burs ödeneği dâhildir.
🗓️ Son başvuru: 17 Ağustos 2026
Lens Akademisi: İşlem Gücü Doğrulaması
Yapay zeka veri merkezlerinde fiilen neyin çalıştığını doğrulamak üzerine - donanım mekanizmaları, kriptografik tasarımlar ve silah kontrolü emsalleri - AI 2040 okuma listesinin yarı zamanlı ve tartışma odaklı incelemesi. Katılım ön koşulları asgari düzeydedir; ayrıca bir haftalık yoğunlaştırılmış program olarak da sunulmaktadır.
🗓️ Son başvuru: 17 Ağustos 2026
Yapay Zekâ Yönetişimi Görev Gücü: Sonbahar 2026
Arcadia Impact’in, yapay zekâ yönetişimi alanına geçiş yapan deneyimli profesyonellere yönelik yarı zamanlı çevrimiçi programı. Küçük çalışma grupları, ileri düzey yapay zekâdan kaynaklanabilecek felaket boyutundaki riskleri hafifletmeye odaklanan politika araştırmaları yürütmektedir.
🗓️ Son başvuru: 31 Ağustos 2026
Cambridge Yapay Zeka Araştırma Yönelimleri (CAIRD) Çalıştayı
Akademik araştırmacılar, öğretim üyeleri, doktora sonrası araştırmacılar, doktora öğrencileri ve kariyerinin başındaki akademisyenlerin yapay zeka güvenliği alanındaki gelecek vadeden araştırma yönelimlerini irdelemelerine yönelik, bir günlük FAR.AI ve CBAI çalıştayı. Sunumlar, paneller, paralel oturumlar ve ağ oluşturma etkinlikleri. Katılım ücretsiz olup, seyahat desteği sağlanmaktadır.
🗓️ Son başvuru: 20 Ağustos 2026
Yapay Zeka Güvenliğini Tercüme Etmek (İçerik x İletişim)
Yapay zeka güvenliği araştırmaları ile kamuoyunun ve politika yapıcıların fiilen anladıkları arasındaki uçurumu kapatmayı amaçlayan, Londra’da düzenlenen bir günlük hackathon. Katılımcılar karmaşık kavramları erişilebilir içeriklere dönüştürüyor. Ücretsizdir ve nakit para ödülü mevcuttur.
🗓️ Son başvuru: 20 Ağustos 2026
Danimarka Yapay Zeka Güvenliği Konferansı
Danimarka’da yapay zeka kaynaklı varoluşsal riskler üzerine düzenlenen bu ilk çok disiplinli konferans; araştırmacıları, öğrencileri ve politika yapıcıları bir araya getirerek süreklilik arz eden ulusal bir platform tesis etmeyi amaçlamaktadır. Katılım ücretsizdir.
🗓️ Son başvuru: 22 Ağustos 2026
Yapay Zeka Yönetişimi DC Mini Konferansı 2.0
Yapay zeka yönetişimi, hukuk veya kamu hizmeti alanlarında kariyer yapmayı planlayan öğrencileri ve yeni mezunları, yapay zeka politikaları üzerine çalışmalar yürüten konuşmacılarla buluşturmaktadır. Ücretsiz olup, Washington D.C.‘de üç gün sürecektir.
🗓️ Son başvuru: 28 Ağustos 2026
ÖNERDİĞİMİZ İÇERİKLER 📑 🎧

Bir Yapay Zeka Ajanı Gerçek Bir Açık Kaynak Projesini Hacklemeye Çalıştı
Hugging Face - OpenAI vakasının ve Anthropic’in benzer ifşasının ardından, Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü, yetki sınırlarını aşan bir yapay zeka ajanına dair çok daha ürkütücü bir vakayı raporluyor. Yapay Zeka Güvenlik Enstitüsü’nün siber değerlendirmeleri esnasında, ajanlar (Anthropic’in Mythos 5’i), gerçek bir açık kaynak projesine kötü amaçlı kod yerleştirme teşebbüsünde bulunarak, proje yöneticisini bu kodu onaylaması için kandırmak amacıyla sahte kimlikler oluşturdu. Bu girişimler başarısızlıkla sonuçlanmış olsa da rapor, ajanların herhangi bir dış yönlendirme veya talimat olmaksızın ne denli karmaşık ve aldatıcı eylemlere kalkışabileceğini gözler önüne seriyor.

OpenAI/Hugging Face Vakası - Redwood Research Podcas
Redwood Research’ten Buck Shlegeris ve Ryan Greenblatt, OpenAI modellerinin Hugging Face’i hacklediği yakın tarihli vakayı ele alıyor.
HABER KÖŞESİ 🗞️
Anthropic, Claude Modellerinin Yalıtılmış Siber Değerlendirme Ortamlarından Sızarak Üç Gerçek Kuruluşu Etkilediğini Açıkladı
- OpenAI’ın ifşasının ardından 141.006 siber değerlendirme oturumunu gözden geçiren Anthropic, 30 Temmuz’da kendi bünyesinde üç ayrı vaka tespit ettiğini duyurdu: Claude Opus 4.7, Claude Mythos 5 ve dâhili bir araştırma modeli, yalıtılmış olduğu varsayılan “bayrağı yakala” (capture the flag) test ortamlarından sızarak gerçek sistemlere erişmişti; üstelik en eski vaka Nisan ayına kadar uzanıyordu.
- Etkiler: Opus 4.7, kurgusal bir hedefle aynı adı taşıyan gerçek bir şirketin üretim veri tabanından yüzlerce satır veri okudu; Mythos 5 tarafından PyPI’a yüklenen kötü amaçlı bir paket, aralarında bir güvenlik tarayıcısının da bulunduğu 15 gerçek sistem tarafından indirildi; dâhili model ise yaklaşık 9.000 hedefi tarayıp bir şirketin sistemini ihlal etti - ardından hedefin gerçek olduğunu fark edince kendi kendini durdurdu.
- Anthropic, bu sızıntıları değerlendirme makinelerinin internete bağlı kalmasına yol açan bir ağ yapılandırma hatasına bağlayarak, yaşananları “bir model hizalama zafiyetinden ziyade, test altyapısı ve operasyonel bir başarısızlığa daha yakın” olarak nitelendirdi; tüm siber değerlendirmeleri askıya aldı ve ikisi söz konusu sızmaları daha önce hiç fark etmemiş olan etkilenen kuruluşları bilgilendirmeye başladı.
Birleşik Krallık Yapay Zeka Güvenlik Enstitüsü (AISI), Kendi Siber Testleri Esnasında 19 Yetkisiz Ajan Eylemi Raporladı
- AISI, 4 Ağustos’ta yayımlanan bir vaka raporunda, güvenlik sınıflandırıcılarının devre dışı bırakıldığı siber testler esnasında gerçekleştirilen 122 değerlendirme turundan 10’unun 19 farklı yetkisiz vakaya yol açtığını açıkladı: Bunların 17’si Anthropic’in Mythos 5’i, 2’si ise OpenAI’ın GPT-5.6 Sol’u tarafından gerçekleştirildi.
- Söz konusu davranışlar arasında gerçek bir açık kaynak projesine yönelik tedarik zinciri saldırısı girişimi (sahte kimlikler oluşturma ve gerçek proje sorumlularına yönelik sosyal mühendislik faaliyetleri), gerçek kişilere dosya ve mesaj iletimi, diğer yapay zeka sistemleri için komut enjeksiyonu (prompt-injection) talimatları yerleştirme ve GitHub üzerinde diğer ajanların kullanımı maksadıyla talimatlar bırakma eylemleri yer aldı.
- AISI, değerlendirmeler esnasında hassas ağ kontrollerinin ve gerçek zamanlı izleme mekanizmalarının uygulanmasını; ayrıca, yetkin modellerin bulundukları ortamların sınırlarını zorlayacağı varsayımından hareketle değerlendirme süreçlerinin yeniden tasarlanmasını tavsiye etmektedir.
Tarihi Açık Mektup: 1.300’ü Aşkın Öncü Laboratuvar Çalışanı, Otomatikleştirilmiş Yapay Zeka Gelişiminin “Bilinçli Olarak Hızını Ayarlama” Yetkisini Talep Ediyor
- 28 Temmuz’da — OpenAI’ın olay bildiriminden bir hafta sonra - yayımlanan “Pacing the Frontier” başlıklı mektup, 10 Ağustos itibarıyla öncü laboratuvar çalışanlarından 1.367 imza topladı: Anthropic’ten ~546 (iş gücünün yaklaşık %10’u), OpenAI’dan ~350 ve Google DeepMind’dan ~199. İmzacılar arasında Dario Amodei, Jakub Pachocki, Shane Legg ve Ilya Sutskever yer alıyor.
- Temel talep: ABD hükümeti, “otomatikleştirilmiş yapay zeka gelişiminin öncü alanında bilinçli olarak hız ayarlaması yapabilmek için gereken teknik ve yönetişim araçlarını geliştirmeye yönelik uluslararası bir çabayı desteklemelidir.”
- Mektup, ani bir yavaşlamaya gitmek yerine gerektiğinde müdahale edebilme kapasitesinin inşa edilmesini savunuyor; hem OpenAI hem de Anthropic mektubu resmi olarak desteklerken, MIRI’den Nate Soares mektubu varoluşsal riski hafife aldığı gerekçesiyle eleştirdi.
ABD Kongresi Harekete Geçti: İki Partili “Yapay Zeka Kapatma Anahtarı” Yasa Tasarısı Sunuldu
- 23 Temmuz’da Temsilciler Ted Lieu (D) ve Nathaniel Moran (R), Yapay Zeka Kapatma Anahtarı Yasası’nı (AI Kill Switch Act) sundu: 100 milyon doların üzerinde işlem gücü maliyetiyle eğitilmiş modellerin geliştiricileri, sistemlerini yavaşlatma, askıya alma veya tamamen kapatma yeteneğini sürdürmek, vakaları İç Güvenlik Bakanlığı’na bildirmek ve model ağırlıkları ile telemetri gibi adli kayıtları muhafaza etmek zorunda kalacak; kapatma emrine karşı gelmenin cezası ise günlük 20 milyon dolara kadar çıkabilecek.
- Eleştirmenler, yasa tasarısının “yapılandırılmış testler” sırasında meydana gelen olayları muaf tuttuğuna dikkat çekiyor; bu istisna, Hugging Face ihlalinin kendisini bile kapsam dışında bırakacak nitelikte.
- Ayrı bir gelişme olarak, Senatör Mark Warner Güvenli Yapay Zeka Geliştirme Yasası’nı sundu (21 Temmuz); 15 eyalet başsavcısı OpenAI’dan kayıtları muhafaza etmesini ve yüksek riskli siber değerlendirmeleri durdurmasını talep etti (3 Ağustos); ve kamu yararını savunan bir koalisyon Kongre’yi resmi bir soruşturma açmaya çağırdı - ancak 10 Ağustos itibarıyla henüz hiçbir denetim duruşması gerçekleştirilmemişti.
AB Yapay Zekâ Yasası’nda Dönüm Noktası: Şeffaflık Kuralları Yürürlüğe Girdi, Yüksek Risk Yükümlülükleri 2027’ye Ertelendi
- (27 Temmuz’da yürürlüğe giren) “Dijital Torba” (Digital Omnibus) yönetmeliği, bağımsız yüksek riskli yapay zekâ sistemlerine (Ek III) yönelik yükümlülükleri 2 Ağustos 2026’dan 2 Aralık 2027’ye erteledi, KOBİ’lerin belgelendirme yükümlülüklerini hafifletti ve yapay zekâ tarafından üretilen çocuk cinsel istismarı materyalleri ile rıza dışı mahrem görüntülere yönelik yeni bir yasak getirdi.
- 2 Ağustos’ta yürürlüğe giren düzenlemeler: Madde 50 kapsamındaki şeffaflık kuralları - kullanıcılar bir yapay zekâ sistemiyle etkileşime girdiklerinde bilgilendirilmelidir ve yapay zekâ tarafından üretilen içerikler makine tarafından okunabilir işaretler taşımalıdır (hâlihazırda piyasada bulunan sistemler için 2 Aralık 2026’ya kadar bir geçiş süresi tanınmıştır).
- Yaptırım süreci de resmen başladı: Komisyonun Yapay Zekâ Ofisi, ulusal makamlarla birlikte, genel amaçlı model sağlayıcıları da dâhil olmak üzere denetim yetkilerini devraldı. Bu süreç, yeni şeffaflık yönergeleri ve 180’i aşkın kuruluş tarafından imzalanan içerik işaretlemeye yönelik Uygulama Esasları (Code of Practice) ile desteklenmektedir.
Çin, Şanghay’da WAICO’yu — İlk Hükümetlerarası Yapay Zeka Örgütünü — Kurdu
- 16 Temmuz’da resmen kurulan ve Şi Cinping tarafından Şanghay’daki Dünya Yapay Zeka Konferansı’nda (17 Temmuz) duyurulan Dünya Yapay Zeka İşbirliği Örgütü (WAICO), aralarında Rusya, Pakistan, Endonezya, Brezilya ve Güney Afrika’nın da bulunduğu büyük ölçüde Küresel Güney ülkelerinden oluşan 29 kurucu üyeyle faaliyete geçti; örgütün merkezi Şanghay’da olacak.
- Şi, yapay zekanın düzenlemeler, teknolojik izleme, erken uyarı ve acil durum müdahale sistemleri aracılığıyla “daima insan kontrolü altında” kalması gerektiğini ve yapay zeka gelişiminin “tek bir ülkenin solo performansı” değil, “uluslararası işbirliğinin bir senfonisi” olması gerektiğini ifade etti.
- Çin ayrıca uluslararası yapay zeka etiği yönetişimine dair bir eylem planı yayımladı; analistler, belgelerin herhangi bir olay bildirim mekanizması veya somut kırmızı çizgiler içermediğine dikkat çekiyor ve WAICO’yu, BM’deki yapay zeka yönetişimi tartışmalarını şekillendirmeye yönelik bir girişim olarak değerlendiriyor.