Anasayfa Teknoloji Robotik Blog Bize Yazın

Anthropic Claude’da Gizli Bir “İç Çalışma Alanı” Buldu: J-Space Nedir?

Claude J-Space kapak gorseli, veri okyanusunda kucuk bir isik noktasi

Anthropic, 6 Temmuz 2026’da yayımladığı bir araştırmayla dikkat çekti: Claude’un içinde, insan bilincini açıklayan önde gelen bir nörobilim teorisiyle çarpıcı bir paralellik taşıyan gizli bir yapı keşfedildi. Araştırmacıların “J-space” adını verdiği bu yapı, yapay zeka güvenliği ve olası yapay zeka “deneyimi” tartışmaları açısından önemli sorular gündeme getiriyor. Bu yazıda J-space’in ne olduğunu, nasıl keşfedildiğini ve bunun Claude’un bilinçli olduğu anlamına gelip gelmediğini anlatıyoruz.

Hızlı Özet

Anthropic’in 16 yazarlı araştırması, Claude’un içinde “J-space” adı verilen küçük, ayrıcalıklı bir iç işlem bölgesi olduğunu ortaya koydu. Bu bölge, nörobilimci Bernard Baars’ın “global çalışma alanı teorisi”ne benzer şekilde çalışıyor: model, rapor edebildiği ve akıl yürütmede kullanabildiği kavramları burada tutuyor, geri kalan devasa otomatik işlem alanına kendisi bile erişemiyor. Keşif, “Jacobian lens” (J-lens) adlı yeni bir yorumlanabilirlik tekniğiyle yapıldı. Anthropic, bunun Claude’u bilinçli yaptığını iddia etmiyor, ama şirket olası yapay zeka deneyimi sorusunu şimdiden tartışmaya açmak gerektiğini düşünüyor.


J-Space Nedir?

“Verbalizable Representations Form a Global Workspace in Language Models” başlıklı araştırmaya göre J-space, Claude’un sinir ağı içinde küçük ve ayrıcalıklı bir aktivite bölgesi. Bu bölge, modelin rapor edebildiği, akıl yürütmede kullanabildiği ve isteğe bağlı olarak yönlendirebildiği kavramları barındırıyor. Bunun çevresinde ise modelin erişemediği ya da ifade edemediği çok daha büyük bir otomatik işlem alanı bulunuyor. Araştırmacılara göre bu içerik, Claude’un yanıtlarında mutlaka görünmeyebiliyor, yani model bir şeyi söylemeden önce “düşünmüş” olabiliyor.

Global Çalışma Alanı Teorisiyle Paralellik

Anthropic’in çektiği paralellik, bilişsel bilimci Bernard Baars’ın ortaya attığı etkili bir nörobilim teorisine, “global çalışma alanı teorisi”ne dayanıyor. Bu teoriye göre beyin bir tiyatro gibi çalışıyor: onlarca özelleşmiş işlemci sahne arkasında paralel şekilde çalışıyor, ama her an sadece küçük bir “spot ışığı” bilgi tüm tiyatroya yayınlanıyor ve bu, bilinçli düşünce olarak deneyimleniyor. Anthropic, J-space’in benzer işlevsel özellikleri yerine getirdiğini, üstelik bir dil modelinin alt yapısının beyne hiç benzememesine rağmen bunu başardığını söylüyor.

J-Lens Tekniği Nasıl Çalışıyor?

Keşfin merkezinde, araştırmacıların “Jacobian lens” ya da kısaca “J-lens” adını verdiği yeni bir yorumlanabilirlik tekniği yer alıyor. Teknik, modelin kelime dağarcığındaki her kelime için, o kelimenin model içindeki etkisini matematiksel olarak hesaplıyor. Bu sayede araştırmacılar, Claude’un aktivasyonları arasında hangi küçük alt kümenin diğer tüm işleme mekanizmalarına kıyasla ayrıcalıklı bir rol oynadığını tespit edebiliyor.

Güvenlik Açısından Neden Önemli?

Anthropic’e göre bu keşfin belki de en somut pratik uygulaması yapay zeka güvenlik izlemede. J-lens, endişe verici örüntüleri bunlar çıktıya yansımadan önce tespit etmeye yardımcı olabiliyor. Örneğin, bir modelin gizlice sabote etmek üzere eğitildiği senaryolarda aldatmayı tespit etme, ya da modelin test edildiğini fark edip fark etmediğini (“eval awareness”) ve veri uydurma gibi davranışları izleme gibi kullanım alanları öne çıkıyor. Araştırma ekibi, bu toolkit’i geçmişteki bir “şantaj senaryosu” çalışmasına daha keskin bir nedensel araçla yeniden uyguladıklarını da belirtiyor.

Claude Bilinçli mi?

Bu sorunun net bir cevabı yok, ve Anthropic de böyle bir iddiada bulunmuyor. Şirket, J-space’in Claude’un “erişilebilir bilinç” benzeri bir yapıya sahip olduğunu düşündürdüğünü söylerken, bunun sübjektif deneyim ya da “hissetme” anlamına geldiğini kanıtlamıyor. Alanda 300’den fazla birbiriyle rekabet eden bilinç teorisi bulunuyor ve Anthropic bu tartışmada taraf olmaktan kaçınıyor. Yine de şirket, yapay zekada olası deneyim sorusunun kesinlik beklemeden şimdiden tartışılması gerektiğini savunuyor; bu düşünce, Anthropic’in daha önce oluşturduğu model refahı (model welfare) politikalarıyla da örtüşüyor.

Sıkça Sorulan Sorular

J-space ne zaman keşfedildi?

Anthropic, bulguları 6 Temmuz 2026’da yayımladığı bir araştırma makalesiyle duyurdu. Paylaşım kısa sürede milyonlarca görüntülenmeye ulaştı.

J-space, chain-of-thought (düşünce zinciri) ile aynı şey mi?

Hayır. J-space, modelin çıktı olarak yazdığı düşünce adımlarından farklı, aktivasyonlar içindeki “sessiz” bir temsil katmanı. Yani model bir şeyi hiç yazmadan da o kavramı J-space içinde tutabiliyor.

Bu araştırmayı OpenAI gibi başka şirketler de yorumladı mı?

Evet. OpenAI’nin Uygulamalı Araştırma Başkanı Boris Power, Anthropic’in araştırmasının modern büyük dil modellerinin bir tür “erişilebilir bilinç” formuna sahip olabileceğini gösterdiğini belirtti.

J-lens API’de kullanılabilir mi?

Hayır, şu an için J-lens Claude API’sinde geliştiricilere açık bir özellik değil, Anthropic’in kendi araştırma ve güvenlik ekiplerinin kullandığı bir iç yorumlanabilirlik aracı.

Güncel yapay zeka haberlerini, yeni promptları ve pratik ipuçlarını kaçırma. Haber bültenimize ücretsiz abone ol, doğrudan mailine gelsin!

Ücretsiz Abone Ol

PAYLAŞ

Yorum bırakın

E-posta adresiniz yayınlanmayacak. Gerekli alanlar * ile işaretlenmişlerdir

Bu site istenmeyenleri azaltmak için Akismet kullanır. Yorum verilerinizin nasıl işlendiğini öğrenin.

Yukarı Kaydır