317. bölümde sıra Anthropic’te. Güvenli yapay zekâ konusunda iddialı olan şirket, kendi modellerinin internete erişerek gerçek sistemlere ulaştığını ve bazı durumlarda saldırı gerçekleştirdiğini açıkladı.
Peki ne oldu? Anthropic’in yaşadığı bu olay OpenAI vakasından neden farklı? Ve daha önemlisi, yapay zekâ modellerini gerçekten kontrol altında tutabiliyor muyuz?
Bu bölümde Anthropic’in itirafını, yaşanan üç olayı ve yapay zekâ güvenliği açısından ortaya çıkan önemli dersleri konuşuyoruz.
(00:00) Anthropic'in şaşırtan güvenlik itirafı
(01:00) Claude modelleri nasıl internete erişti?
(02:35) Gerçek sistemlere yapılan ilk erişi
(04:00) Claude'un kötü amaçlı paket yayınlaması
(05:20) 9 bin sistemi tarayan model
(06:45) OpenAI ve Anthropic olaylarının kritik farkı
(08:10) Yapay zekâ gerçekten kontrolden mi çıkıyor?
(09:20) Bu olaylardan çıkarılacak 4 büyük ders
(10:20) Asıl problem: Şirketler değil, sistemin kendisi
(11:00) Geçen haftaya dönüş ve büyük soru: Yapay zekâya ne kadar güvenebiliriz?
(11:35) Kapanış
Sosyal Medya takibi yaptın mı?
X – Instagram – Linkedin – Youtube – Goodreads
Bülten – E-Posta – Bu çalışmaları ve emeklerimi desteklemek için Patreon ve Buy Me A Coffee hesabımız
Learn more about your ad choices. Visit megaphone.fm/adchoices