Ana içeriğe atla

Kayıtlar

RLHF etiketine sahip yayınlar gösteriliyor

Felsefe ve Yapay Zeka #2: Birey, Çoğunluk ve Toplumsal Bilgelik — 2018'deki 'Çoğunluk Neden Hep Yanılır?' Yazısından Algoritmik Vasatlığa

Felsefe, Birey ve Toplumsal Bilgelik • Bölüm #2 Felsefe, Birey ve Toplumsal Bilgelik: 2018'deki 'Çoğunluk Neden Hep Yanılır?' Yazısından Algoritmik Vasatlığa (RLHF) 2018 yılının Ağustos ayında, bu blogda insan doğasının ve toplumsal dinamiklerin en hassas yaralarından birine parmak basarak "Çoğunluk Neden Hep Yanılır?" başlıklı bir yazı yayınlamıştım. O gün kaleme aldığım temel tez şuydu: Toplumsal normlar ve yazılı olmayan mahalle baskıları bireyin üzerinde öyle ağır bir tahakküm kurar ki; birey kendi aklını ve vicdanını çoğunluğun konforlu uyuşukluğuna feda eder. Oysa kadim bilgelik geleneklerinden tarihteki büyük ahlaki kırılmalara kadar her derin öğreti aynı gerçeği fısıldar: Bir fikrin kalabalıklarca benimsenmiş olması, onun doğru, adil ya da bilgece olduğunu asla kanıtlamaz. Aradan geçen sekiz yılda dünya silikon tabanlı bir zeka devrimine uyandı. Bugün milyonlarca insan sorularını kütüphanelere ya da bilge insanlara değil; yapay...

Bölüm #3: Amigdala ve Duygusal Biliş - Risk Algısı, Ödül Sistemleri ve Pekiştirmeli Öğrenme (RL)

Bilişsel Mimariler ve İnsan Beyni Serisi • Bölüm #3 Amigdala ve Duygusal Biliş: Risk Algısı, Ödül Sistemleri ve Pekiştirmeli Öğrenme (RL) Serimizin ilk iki bölümünde mantığın yöneticisi Prefrontal Korteks ’i ve hatıraların mimarı Hipokampus ’u masaya yatırdık. Ancak yüzyıllar boyunca felsefeyi ve bilimi meşgul eden büyük bir yanılgı vardır: "Zeka, duygulardan arınmış saf bir mantık işlemcisidir." Modern nörobiyoloji bu miti tamamen yıktı. İnsan beyninde duygu, mantığın düşmanı değil; tam tersine hayatta kalmayı, riskleri tartmayı ve kararları önceliklendirmeyi sağlayan en temel hesaplama motorudur. Bu motorun tam kalbinde ise badem büyüklüğündeki antik bir çekirdek yer alır: Amigdala . Bugün yapay zekanın "kontrolden çıkmasını" engelleyen güvenlik bariyerleri, Pekiştirmeli Öğrenme (Reinforcement Learning - RL) ve İnsan Geri Bildirimiyle Hizalama (RLHF / RLAIF) sistemleri, aslında Amigdala’nın milyonlarca yıldır canlıları hayatta tut...