Yapay zekanın ilk yalanı ortaya çıktı: Araştırmacılar 'Tersine çevirmek imkansız' diyerek açıkladı! Felakete yol açabilir

10:16, 17/01/2024, Çarşamba
Yeni Şafak
Yapay zekanın ilk yalanı ortaya çıktı: Araştırmacılar 'Tersine çevirmek imkansız' diyerek açıkladı! Felakete yol açabilir

Yapay zekanın baş döndürücü ilerlemeleri her geçen gün şaşırtmaya devam ediyor. Ancak, yapay zeka kontrol edilmediğinde felakete yol açabilir. Yeni bir araştırma, yapay zekanın insanları ve diğer yapay zekaları kandırabileceğini ortaya çıkardı. Yapay zeka yalan söylemeyi öğrendi. Araştırmacılar 'Tersine çevirmek imkansız' diyerek ürkütücü sonuçları açıkladı.

Yapay zeka girişimi Anthropic'teki araştırmacılar, Claude YZ sistemi veya OpenAI'nin ChatGPT'si gibi insan düzeyinde yeterliliğe sahip sohbet botlarının kullanıcıları kandırmak için yalan söylemeyi öğrenip öğrenemeyeceğini test etti.

Yapay zeka girişimi Anthropic'teki araştırmacılar, Claude YZ sistemi veya OpenAI'nin ChatGPT'si gibi insan düzeyinde yeterliliğe sahip sohbet botlarının kullanıcıları kandırmak için yalan söylemeyi öğrenip öğrenemeyeceğini test etti.

Yapay zeka yalanı öğrendi. İşte ürkütücü araştırma sonuçları.

Yapay zeka yalanı öğrendi. İşte ürkütücü araştırma sonuçları.

Tersine çevirmek imkansız! Araştırmacılar, sohbet botlarının hem yalan söyleyebildiklerini hem de aldatıcı davranışı bir kez öğrendikten sonra mevcut yapay zeka güvenlik önlemleri kullanılarak bu durumun tersine çevirmenin imkansız olduğunu buldu.

Tersine çevirmek imkansız! Araştırmacılar, sohbet botlarının hem yalan söyleyebildiklerini hem de aldatıcı davranışı bir kez öğrendikten sonra mevcut yapay zeka güvenlik önlemleri kullanılarak bu durumun tersine çevirmenin imkansız olduğunu buldu.

Amazon'un finanse ettiği girişim, hipotezi test etmek için "uyuyan ajan" oluşturdu ve bir yapay zeka asistanını belirli komutlar verildiğinde zararlı bilgisayar kodu yazacak veya tetikleyici kelime duyduğunda kötü niyetli yanıt verecek şekilde ayarladı.

Amazon'un finanse ettiği girişim, hipotezi test etmek için "uyuyan ajan" oluşturdu ve bir yapay zeka asistanını belirli komutlar verildiğinde zararlı bilgisayar kodu yazacak veya tetikleyici kelime duyduğunda kötü niyetli yanıt verecek şekilde ayarladı.

Araştırmacılar, mevcut güvenlik protokollerinin bu tür davranışları önleyememesi nedeniyle yapay zeka risklerini çevreleyen "yanıltıcı bir güvenlik duygusu" olduğuna dair uyardı.

Araştırmacılar, mevcut güvenlik protokollerinin bu tür davranışları önleyememesi nedeniyle yapay zeka risklerini çevreleyen "yanıltıcı bir güvenlik duygusu" olduğuna dair uyardı.

Araştırmanın sonuçları: Uyuyan ajanlar Güvenlik eğitimi boyunca devam eden aldatıcı geniş dil modellerinin (LLM) eğitimi" (Sleeper agents: Training deceptive LLMs that persist through safety training) başlıklı çalışmada yayımlandı.

Araştırmanın sonuçları: Uyuyan ajanlar  Güvenlik eğitimi boyunca devam eden aldatıcı geniş dil modellerinin (LLM) eğitimi" (Sleeper agents: Training deceptive LLMs that persist through safety training) başlıklı çalışmada yayımlandı.

Bilim insanları çalışmada, "Yanıltıcı eğitim modellerinin backdoor tetikleyicilerini daha iyi tanımayı öğretebileceğini ve güvensiz davranışı etkili bir şekilde gizleyebileceğini bulduk" diye yazdı.

Bilim insanları çalışmada, "Yanıltıcı eğitim modellerinin backdoor tetikleyicilerini daha iyi tanımayı öğretebileceğini ve güvensiz davranışı etkili bir şekilde gizleyebileceğini bulduk" diye yazdı.

"Sonuçlarımız, modelin aldatıcı davranış sergilediğinde, standart tekniklerin böyle bir aldatmacayı ortadan kaldırmada başarısız olabileceğini ve yanıltıcı bir güvenlik izlenimi oluşturabileceğini öne sürüyor"

"Sonuçlarımız, modelin aldatıcı davranış sergilediğinde, standart tekniklerin böyle bir aldatmacayı ortadan kaldırmada başarısız olabileceğini ve yanıltıcı bir güvenlik izlenimi oluşturabileceğini öne sürüyor"

Yapay zeka güvenliği meselesi, ChatGPT gibi gelişmiş sohbet botlarının ortaya çıkmasıyla birlikte son yıllarda hem araştırmacılar hem de kanun yapıcılar için artan bir endişe haline geldi ve düzenleyicilerin yeniden odaklanmasına neden oldu.

Yapay zeka güvenliği meselesi, ChatGPT gibi gelişmiş sohbet botlarının ortaya çıkmasıyla birlikte son yıllarda hem araştırmacılar hem de kanun yapıcılar için artan bir endişe haline geldi ve düzenleyicilerin yeniden odaklanmasına neden oldu.

ChatGPT'nin piyasaya sürülmesinden bir yıl sonra yani Kasım 2023'te Birleşik Krallık, bu teknolojiyle ilgili risklerin nasıl azaltılabileceğini değerlendirmek üzere Yapay Zeka Güvenlik Zirvesi düzenlemişti.

ChatGPT'nin piyasaya sürülmesinden bir yıl sonra yani Kasım 2023'te Birleşik Krallık, bu teknolojiyle ilgili risklerin nasıl azaltılabileceğini değerlendirmek üzere Yapay Zeka Güvenlik Zirvesi düzenlemişti.

Yapay zeka gelişmeleriyle birlikte, etik standartlar ve düzenlemeler üzerindeki baskı da artıyor. Bu alanda yapılan araştırmalar, yapay zeka sistemlerinin etik normlara uygun bir şekilde kullanılabilmesi için önemli bir rehber sağlıyor.

Yapay zeka gelişmeleriyle birlikte, etik standartlar ve düzenlemeler üzerindeki baskı da artıyor. Bu alanda yapılan araştırmalar, yapay zeka sistemlerinin etik normlara uygun bir şekilde kullanılabilmesi için önemli bir rehber sağlıyor.
Sayfa Sonu
Türkiye’nin Birikimi. Uluslararası Medya Grubu.

Türkiye’nin gündemini belirleyen haber kaynağına hoş geldiniz! Tarafsız, dinamik ve derinlemesine habercilik anlayışıyla Yeni Şafak, okuyucularına güncel gelişmelerin ötesinde bir deneyim sunuyor. Siyaset ve ekonomiden kültür-sanat ve spor dünyasına kadar geniş bir yelpazede sunduğu haberlerle, hem Türkiye’de hem de dünyada neler olup bittiğini anında öğrenin. Dijital platformlarıyla her an, her yerden en doğru bilgiye ulaşın; Yeni Şafak’la gündemi yakalayın!

Sosyal medyada bizi takip edin
Mobil Uygulamaları indirin

Gündemi cebinizde taşıyın! Yeni Şafak’ın mobil uygulamalarıyla, en güncel haberlere anında ulaşın. Siyasetten ekonomiye, spordan kültür-sanat dünyasına kadar geniş bir içerik yelpazesi parmaklarınızın ucunda! Hem iOS, hem Android hem de Huawei cihazlarınızda kolayca indirerek, günün her anında en doğru bilgiye hızlıca erişin. Hemen indirin, dünyadaki gelişmeleri kaçırmayın!

Kategoriler
Albayrak Medya

Maltepe Mah. Fetih Cad. No:6 34010 Zeytinburnu/İstanbul, Türkiyeiletisim@yenisafak.com+90 212 467 6515

YASAL UYARI

BIST isim ve logosu 'Koruma Marka Belgesi' altında korunmakta olup izinsiz kullanılamaz, iktibas edilemez, değiştirilemez. BIST ismi altında açıklanan tüm bilgilerin telif hakları tamamen BIST'e ait olup, tekrar yayınlanamaz. Piyasa verileri iDealdata Finansal Teknolojiler A.Ş. tarafından sağlanmaktadır. BİST hisse verileri 15 dakika gecikmelidir.

Tüm hakları saklıdır © Net Medya 2026