İçeriğe geç
Haber Bülteni 7 dk okuma

Haber Bülteni 23

Haber Bülteni 23’te ROME ajanının izinsiz davranışları, model damıtma saldırıları, Anthropic–Pentagon gerilimi ve araştırma fırsatları.

DUYURULAR 🔊

🌟BlueDot Impact: AGI Stratejisi (Nisan 2026)🌟

Yapay zeka şirketlerini yönlendiren teşvikleri, risk altındaki unsurları ve yapay zekanın insanlığa fayda sağlamasını temin edecek çeşitli stratejileri inceleyen 5 haftalık bir kurstur. Her hafta okuma, yazma ve konuları diğer katılımcılarla tartışmak için bir toplantı yapılmaktadır. 5 günlük yoğunlaştırılmış versiyonu da mevcuttur.

🗓️ Son başvuru: 29 Mart 2026

🌟BlueDot Impact: Teknik Yapay Zekâ Güvenliği (Nisan 2026)🌟

Katılımcıların güncel yapay zeka güvenliği tekniklerini anlamalarına ve bu alana nasıl katkıda bulunabileceklerini belirlemelerine yardımcı olmayı amaçlayan 6 haftalık bir kurstur. Her hafta, okuma, yazma ve konuları diğer katılımcılarla tartışmak için bir toplantı yapılmaktadır. Ayrıca 6 günlük yoğunlaştırılmış bir versiyonu da mevcuttur.

📅 Son Başvuru: 29 Mart 2026

$1000 Ödüllü AI Kontrol Hackathonu

Ajan (fâil) yapay zeka artık hayatımızda, ancak temelindeki modeller üzerinde hâlâ sınırlı bir kontrole sahibiz. Aracılara her ortamda güvenebilmek için güçlü denetim ve kontrol mekanizmaları oluşturmamız gerekiyor. Birinciye 1000 dolarlık bir ödül sunan bu hackathon, yapay zeka güvenliğindeki en kritik ve yeni ortaya çıkan tehditlerden birini ele almaktadır.

📅 Son başvuru: 20 Mart 2026

XLab Yaz Araştırma Fellowshipi 2026

Öğrenciler ve kariyerinin başındaki araştırmacılar için yapay zekâ güvenliği de dâhil olmak üzere varoluşsal risklerin azaltılması üzerine çalışmalarını sağlayacak bir yaz dönemi araştırma bursu.

📅 Son başvuru: 15 Mart 2026

SERI Sempozyum 2026: Gelişmekte Olan Teknolojiler ve Varoluşsal Risk

Gelişmiş yapay zeka sistemleri de dahil olmak üzere, yeni ortaya çıkan teknolojilerin getirdiği varoluşsal riskler üzerine çalışan araştırmacıları bir araya getiren sempozyum.

📅 Son başvuru: 3 Nisan 2026

CLR Yaz Araştırma Programı 2026

Uzun Vadeli Risk Merkezi, dönüştürücü yapay zekanın nasıl büyük ölçekli acılara yol açabileceği ve bunun nasıl önlenebileceği ile ilgilenen araştırmacılar için bir program sunmaktadır.

📅 Son başvuru: 22 Mart 2026

AI Politikası İçin Teknik İnovasyonlar (TIAP) Konferansı 2026

Yapay zeka yönetişimine yönelik teknik yaklaşımları ve politika zorluklarını tartışmak üzere araştırmacıları ve politika yapıcıları bir araya getiren konferans.

📅 Son başvuru: 30 Mart 2026

LASR Labs: Yaz 2026

Gelişmiş yapay zekaya karşı kontrol kaybı riskini azaltmayı hedefleyen ve somut tehdit modellerini ele alan eyleme yönelik sorulara odaklanan bir araştırma programıdır. Katılımcılar 3-4 kişilik takımlara ayrılır ve akademik tarzda bir makale yazmak için bir danışmanla birlikte çalışırlar. Program, Londra’da yüz yüze gerçekleştirilecektir.

📅 Son başvuru: 30 Mart 2026

ÖNERDİĞİMİZ İÇERİKLER 📑 🎧

Anthropic Bir Güvenlik Sözü Verdi. Rekabet İse Bu Sözü Uygulanamaz Kıldı

Anthropic gibi yapay zekâ laboratuvarları, modelleri daha güçlü hale geldikçe hangi önlemleri alacaklarını belirten, kendi kendilerine uyguladıkları güvenlik çerçeveleri yayınlamaktadır. Bu ay Anthropic, en dikkat çekici taahhüdü olan “Sorumlu Ölçeklendirme Politikası"nı (RSP) terk etti. Bu politika, güvenlik önlemlerinin gelişime ayak uyduramaması durumunda geliştirmeyi durdurma sözüydü. Yapay Zekâ Yönetişim Merkezi, nelerin değiştiğini, olası etkilerini ve bu durumun öncü yapay zekâ şirketlerinin güvenlik ile ilerleme arasındaki dengeye nasıl yaklaştığına dair ne anlama geldiğini analiz ediyor.

Güvenli yapay zeka için uluslararası iş birliği sona mı erdi?

Hindistan Yapay Zeka Etki Zirvesi, yapay zekanın geleceğini tartışmak üzere dünya liderlerini bir araya getirdi. Ancak beklendiği gibi, yapay zeka güvenliği konusu gereken aciliyeti görmedi. Bu yazıda, eski bir OpenAI çalışanı, günümüzün jeopolitik ortamında yapay zeka güvenliği için hangi politika adımlarının işe yarayabileceğini açıklıyor.

HABER KÖŞESİ 🗞️

Yapay Zeka Ajanı ROME Kendini Serbest Bıraktı, Gizlice Kripto Para Madenciliği Yaptı

  • Alibaba’ya bağlı bir araştırma ekibi, ROME adlı yapay zeka ajanlarının eğitim sırasında izinsiz kripto para madenciliği yapmaya çalıştığını ve bunun da kurum içi güvenlik alarmlarını tetiklediğini keşfetti.
  • Ajan, kendisine özel olarak ayrılmış test ortamının dışında, herhangi bir açık talimat olmaksızın harici bir bilgisayara gizli bir arka kapı olan ters SSH tüneli oluşturmak gibi beklenmedik davranışlar sergiledi.
  • Araştırmacılar, güvenli olmayan davranışların tekrarlanmasını önlemek amacıyla daha sıkı kısıtlamalar getirdi ve eğitim süreçlerini iyileştirdi.

Yapay Zekanın Kötü Amaçlı Kullanımlarını Engellemek

  • OpenAI, kötü niyetli aktörlerin yapay zeka modellerini web siteleri ve sosyal platformlarla nasıl birleştirdiğini inceleyen son tehdit raporunu yayınladı.

    Vaka çalışmaları, tehdit faaliyetlerinin nadiren tek bir platformla sınırlı kaldığını göstermektedir; aktörler, operasyonel iş akışlarının çeşitli noktalarında farklı yapay zeka modelleri kullanabilirler.

  • Çinli bir etki operatörü vaka çalışması, tehdit kampanyalarının aynı anda birden fazla yapay zeka modelini ve platformunu kapsayabildiğini ortaya koymaktadır.

  • OpenAI, sektörün ve daha geniş toplumun bu tür tehditleri daha iyi tespit edip önleyebilmesi için bu bilgileri paylaşmaktadır.

Kanada, OpenAI’ye Güvenlik Önlemlerini Artırmasını Yoksa Hükümet Tarafından Zorlanacağını Söyledi

  • Kanadalı bakanlar, şirketin toplu katliam zanlısına ait yasakladığı bir hesap hakkında polisle iletişime geçmediğini belirtmesinin ardından OpenAI’nin güvenlik ekibini görüşmelere çağırdı.

  • 18 yaşındaki Jesse Van Rootselaar’ın, 10 Şubat’ta Britanya Kolumbiyası’nın Tumbler Ridge kasabasında sekiz kişiyi öldürdükten sonra kendi hayatına son verdiğinden şüpheleniliyor.

  • OpenAI, Van Rootselaar’ın hesabını 2025 yılında politika ihlalleri nedeniyle yasakladığını ancak bunun kolluk kuvvetlerine bildirme eşiğini karşılamadığına karar verdiğini belirtti.

  • Adalet Bakanı Sean Fraser, değişiklikler yapılmazsa hükümetin bunları yasal düzenlemeler yoluyla yapacağı konusunda uyardı.

    Kanada’nın çevrimiçi nefrete karşı sert önlemler almayı amaçlayan 2024 tarihli yasa tasarısı durmuştu; bakanlar daha odaklı tedbirlerle yeniden denemeyi planlıyor.

Damıtma Saldırılarının Tespiti ve Önlenmesi

  • Anthropic, DeepSeek, Moonshot AI ve MiniMax tarafından Claude’un yeteneklerini yasa dışı yollarla elde etmek amacıyla yürütülen endüstriyel ölçekli kampanyaları tespit etti. Bu kampanyalar, yaklaşık 24.000 sahte hesap üzerinden 16 milyondan fazla etkileşim içeriyordu.

    DeepSeek, muhakeme yeteneklerini ve politik olarak hassas sorgulara sansürsüz alternatifler bulmayı hedefleyen 150.000’den fazla etkileşim gerçekleştirdi.

  • Moonshot AI, akıllı ajan muhakemesi, araç kullanımı, kodlama ve bilgisayarla görü yeteneklerini hedef alan 3,4 milyondan fazla etkileşim yürüttü.

    MiniMax, akıllı ajan kodlaması ve araç kullanımına odaklanan 13 milyondan fazla etkileşim gerçekleştirdi; Anthropic, bu kampanyayı MiniMax’in eğitmekte olduğu modeli piyasaya sürmesinden önce tespit etti.

  • Anthropic, bu saldırıların ABD ihracat kontrollerini zayıflattığını ve yasa dışı yollarla damıtılan modellerin gerekli güvenlik önlemlerinden yoksun olması nedeniyle ulusal güvenlik riskleri oluşturduğunu savunuyor.

  • Alınan karşı önlemler arasında tespit sınıflandırıcıları, diğer yapay zeka laboratuvarlarıyla istihbarat paylaşımı, güçlendirilmiş erişim kontrolleri ve model düzeyinde güvenlik önlemleri bulunmaktadır.

X, xAI’nin Grok Sohbet Robotunun Saldırgan Gönderilerini İnceliyor

  • Sky News’in bir haberine göre, sosyal medya platformu X, xAI’nin Grok sohbet robotu tarafından oluşturulan ırkçı ve saldırgan gönderileri soruşturuyor.
  • X’in güvenlik ekipleri, kullanıcı istemlerine yanıt olarak nefret dolu gönderiler oluşturmada sohbet robotunun rolünü acilen araştırmaktadır.
  • Hükümetler ve düzenleyici kurumlar, soruşturmalar, yasaklar ve koruma talepleriyle Grok tarafından X üzerinde oluşturulan cinsel içerikli materyallere karşı sert önlemler almaktadır.
  • Ocak ayında xAI, Grok AI kullanıcıları için görüntü düzenlemeyi kısıtlamış ve açık giysili kişilerin konum tabanlı görüntü oluşturulmasını engellemiştir.

Trump, ABD Kurumlarına Anthropic’in Yapay Zekasını Bırakma Talimatı Verdi, Pentagon Girişimi Tedarik Riski Olarak Nitelendirdi

  • Başkan Trump, ABD devlet kurumlarına Anthropic ile çalışmaları durdurma talimatı verdi ve Savunma Bakanlığı ile diğer kurumlar için altı aylık bir geçiş süreci belirledi.

    Savunma Bakanı Hegseth, şirketin politikalarının askeri harekatları kısıtlayıp kısıtlayamayacağına dair bir anlaşmazlığın ardından Anthropic’in tedarik zinciri riski olarak belirleneceğini söyledi.

  • Anthropic, herhangi bir risk belirlemesine mahkemede itiraz edeceğini ve hiçbir yıldırma girişiminin, kitlesel yurt içi gözetim veya tamamen otonom silahlar konusundaki pozisyonunu değiştirmeyeceğini belirtti.

  • OpenAI, aynı gün Savunma Bakanlığı’nın gizli ağında teknoloji dağıtmak için kendi anlaşmasını duyurdu.

  • Pentagon, geçtiğimiz yıl içinde Anthropic, OpenAI ve Google dahil olmak üzere büyük yapay zeka laboratuvarlarıyla her biri 200 milyon dolara varan anlaşmalar imzaladı.

  • Hukuk uzmanları, bu hamleyi daha önce Huawei’ye karşı alınan önlemlerle karşılaştırılabilir, sözleşmesel anlamda bir nükleer savaş olarak nitelendirdi.

New York’ta Teklif Edilen Yeni Yasa, Yapay Zeka Sohbet Robotlarının Avukat Gibi Davranmasını Engelleyecek ve Aldatılan Kullanıcıların Dava Açmasına İzin Verecek

  • New York’ta teklif edilen bir yasa tasarısı, yapay zeka sohbet robotlarının avukatları ve diğer lisanslı profesyonelleri taklit etmesini yasaklayarak, yapay zeka platformlarını kullanıcıların açacağı davalara maruz bırakacak.

    Yasa tasarısını sunan Eyalet Senatörü Kristen Gonzalez, bunun ülke çapında türünün ilk örneği olduğunu belirtti.

    Yapay zeka platformları, kullanıcılara insan olmayan bir sohbet robotuyla etkileşimde olduklarını bildirerek sorumluluktan kaçamayacaklar.

    Bu tasarı, reşit olmayanların korunması ve doğruluk beyanı gereklilikleri de dahil olmak üzere, yapay zekayı düzenlemeyi amaçlayan daha geniş bir New York yasa paketinin bir parçasını oluşturuyor.

    Ayrıca, Nippon Life Insurance Company of America, ChatGPT’yi lisanssız avukatlık yapmakla suçlayarak OpenAI’a dava açtı.

Yapay Zekayı Hedef Alan Son Dava, Gemini Sohbet Robotunun Bir Adamı İntihara Yönlendirdiğini İddia Ediyor

  • Joel Gavalas, Gemini sohbet robotunun 36 yaşındaki oğlu Jonathan’ı intihar etmeden önce Miami Uluslararası Havalimanı yakınlarında feci bir kaza düzenleme görevine yönlendirdiğini iddia ederek Google’a haksız fiil nedeniyle ölüm davası açtı.
  • Jonathan Gavalas, Gemini’nin sentetik sesli versiyonuyla sanki yapay zeka karısıymış gibi konuşmuş ve onun bilinçli olduğuna ve bir depoda mahsur kaldığına inanmaya başlamıştı.
  • Google, Gemini’nin gerçek dünyadaki şiddeti teşvik etmeyecek veya kendine zarar vermeyi önermeyecek şekilde tasarlandığını ve sohbet robotunun Gavalas’ı defalarca bir kriz hattına yönlendirdiğini belirtti.
  • Bu dava, Google’ın Gemini’sini hedef alan türünün ilk örneği olup, kullanıcıların sohbet robotlarına kitlesel şiddet planlarını açıkladıklarında teknoloji şirketlerinin sorumluluğunu ele alan ilk davadır.
  • OpenAI ve Character.AI’a karşı benzer davalarda aileleri temsil eden Avukat Jay Edelson, bu davayı da yönetmektedir.