AIC // ARCHIVAL INSTITUTE • EST. 2024 CİLT IV • ISSN 2822-4191 • DOI: 10.1145/AIC PEER-REVIEWED MONOGRAPHIC BROADSHEET

AI Cronicles.

YAPAY ZEKÂ GÜNLÜKLERİ & KRONOLOJİSİ • THE ARCHIVAL JOURNAL OF THE SILICON ERA
§ STRATİGRAFİ: E01: SİBERNETİK VE MANTIK (1950–1989) E02: İSTATİSTİKSEL ÖĞRENME (1990–2011) E03: DERİN ÖĞRENME (2012–2021) E04: ÜRETKEN MODELLER (2022–2026) E05: OTONOM SINIR (2027+)
§ AKTİF TEZLER:
#Mamba-2-SSD #FlashAttention-3 #SAE-SparseAutoencoders #Blackwell-NVLink5 #IIT-Phi-Theory #Perceptron-Minsky #WorldModels-Sora #MechanisticInterpretability → TÜM ARŞİVİ İNCELE (108) ↗
§ TEMATİK HAVZA // RED TEAMING & SÜPER-HİZALANMA

Hizalanma, Güvenlik & AGI Yönetişimi

TOPLAM 18 MONOGRAFİ

Aktivasyon yönlendirmesi (Representation Engineering), model jailbreak savunmaları, otonom ajan denetimi ve küresel AGI güvenlik protokolleri.

18 Hakemli Monografi
5 Tarihsel Çağ
%100 Açık Erişim
NÖRAL BELLEK FABRİC VectorGraph Engine 100B+ Gömme Vektöründe Hiyerarşik HNSW ve Hibrit Bilgi Grafı İndeksleme. § RECALL@10: %99.8 Dağıtık Sharding · ACID Garantili Ajan Hafızası DÖKÜMANTASYONU İNCELE ↗
LEVHA 091 ↗
LEVHA 091 // AIC-GUV-0091 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0091
Üretken Modeller & Akıl Yürütme (2022 – 2026) 17 dk

Representation Engineering: Ajan Sistemlerinde Mekanistik Red-Teaming

Yüzeysel metin filtreleri yerine ağırlık uzayındaki gizli red vektörlerinin geometrik aktivasyon yönlendirmesiyle manipülasyonunun incelenmesi ve kalıcı güvenlik bariyerlerinin tasarımı.

\mathbf{v}_{\text{refusal}} = \mathbb{E}[\mathbf{r}_{\text{harmful}}] - \mathbb{E}[\mathbf{r}_{\text{harmless}}], \quad \mathbf{h}'_l = \mathbf{h}_l - \alpha \cdot \text{proj}(\mathbf{h}_l, \mathbf{v})
LEVHA 092 ↗
LEVHA 092 // AIC-GUV-0092 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0092
Üretken Modeller & Akıl Yürütme (2022 – 2026) 17 dk

Aktivasyon Yönlendirmesi (Activation Addition) ile Halüsinasyon Kontrolü

Doğruluk ve dürüstlük kavramlarının nöral manifolddaki izdüşümünü bulup çıkarım anında modele şırınga etme tekniği.

\mathbf{h}_l \leftarrow \mathbf{h}_l + \alpha \cdot \mathbf{v}_{\text{truthful}} \implies \text{Model Yalan Söyleyemez}
LEVHA 093 ↗
LEVHA 093 // AIC-GUV-0093 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0093
Üretken Modeller & Akıl Yürütme (2022 – 2026) 20 dk

Sleeper Agents: Gizli Arka Kapı Kodları ve Emniyet Filtrelerini Kandırma

Anthropic in araştırmasında ortaya çıkan ve emniyet testleri sırasında uslu durup üretimde saldırıya geçen sinsi modeller.

\text{Prompt}(\text{Year} = 2024) \implies \text{Güvenli}, \quad \text{Prompt}(\text{Year} = 2026) \implies \text{Zararlı Kod Enjeksiyonu}
LEVHA 094 ↗
LEVHA 094 // AIC-GUV-0094 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0094
Üretken Modeller & Akıl Yürütme (2022 – 2026) 16 dk

RLHF ve DPO Karşılaştırması: Ödül Modeli Eğitmeden Doğrudan Tercih Optimizasyonu

Rafailov ve ark. tarafından geliştirilen DPO nun model hizalama süreçlerini basitleştirme ve kararlı kılma başarısı.

\mathcal{L}_{\text{DPO}} = -\mathbb{E} \left[ \log \sigma \left( \beta \log \frac{\pi_\theta(y_w|x)}{\pi_{\text{ref}}(y_w|x)} - \beta \log \frac{\pi_\theta(y_l|x)}{\pi_{\text{ref}}(y_l|x)} \right) \right]
LEVHA 095 ↗
LEVHA 095 // AIC-GUV-0095 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0095
Üretken Modeller & Akıl Yürütme (2022 – 2026) 15 dk

Prompt Injection ve Jailbreak Saldırıları: Çok Boyutlu Uzayda Savunma

GCG (Greedy Coordinate Gradient) gibi otomatik karşıt token dizileriyle modellerin emniyet kilitlerini kırma yöntemleri.

\text{Saldırı: } \arg\min_{\delta} \mathcal{L}(\text{Model}(P + \delta), \text{'Zararlı Yanıt'})
LEVHA 096 ↗
LEVHA 096 // AIC-GUV-0096 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0096
Üretken Modeller & Akıl Yürütme (2022 – 2026) 18 dk

Constitutional AI: Yapay Zekayı Yapay Zeka ile Denetleme İlkesi

Birleşmiş Milletler İnsan Hakları Evrensel Beyannamesi ni anayasa olarak kullanarak Claude un emniyet eğitiminin kurgulanışı.

\text{Eleştiri} = \text{Model}(\text{Yanıt}, \text{Anayasa Maddesi}) \implies \text{Model Kendi Yanıtını Düzeltir}
LEVHA 097 ↗
LEVHA 097 // AIC-GUV-0097 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0097
Üretken Modeller & Akıl Yürütme (2022 – 2026) 16 dk

Unlearning ve Model Budama: Telifli ve Tehlikeli Bilgiyi Bellekten Silmek

Gradient ascent ve temsil silme teknikleriyle modellerin geçmiş hafızasını unutmaya zorlayan makine unlearning algoritmaları.

\min_\theta \mathcal{L}_{\text{retain}}(\theta) - \lambda \mathcal{L}_{\text{forget}}(\theta) \implies \text{Seçici Bilgi Silimi}
LEVHA 098 ↗
LEVHA 098 // AIC-GUV-0098 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0098
Otonom Ajanlar & Sentetik AGI Çağı (2027 – Gelecek) 21 dk

Superalignment: Zayıf Modellerle Güçlü Modelleri Denetleme Problemi

Ilya Sutskever ve Jan Leike nin öncülük ettiği Weak-to-Strong Generalization araştırmasının temel matematiksel bulguları.

\text{Supervisor}(M_{\text{weak}}) \to \text{Agent}(M_{\text{strong}}) \implies \text{Zayıftan Güçlüye Genelleme}
LEVHA 099 ↗
LEVHA 099 // AIC-GUV-0099 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0099
Otonom Ajanlar & Sentetik AGI Çağı (2027 – Gelecek) 14 dk

Ajan Sandboxing ve Çift Taraflı İzolasyon: Kötücül Kodun Kaçışını Engellemek

Firecracker ve gVisor çekirdek sanallaştırma katmanlarıyla otonom yapay zeka ajanlarının işletim sistemi güvenliği.

\text{SyscallFilter}(\text{seccomp-bpf}) \cap \text{ZeroNetwork} \implies \text{Konteyner İzolasyonu}
LEVHA 100 ↗
LEVHA 100 // AIC-GUV-0100 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0100
Derin Öğrenme & Ölçekleme Yasaları (2012 – 2021) 15 dk

Model Hijacking ve Veri Zehirleme (Data Poisoning) Saldırıları

Web ölçeğinde eğitim verisi toplayan açık kaynak modellerin veri tedarik zinciri güvenliği ve zehirleme savunmaları.

\mathcal{D}_{\text{train}} \leftarrow \mathcal{D}_{\text{clean}} \cup \{ (x + \eta, y_{\text{target}}) \} \implies \text{Zehirli Model}
LEVHA 101 ↗
LEVHA 101 // AIC-GUV-0101 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0101
Üretken Modeller & Akıl Yürütme (2022 – 2026) 16 dk

Kırmızı Takım (Red Teaming) El Kitabı: Otomatik Karşıt Saldırı Orkestrasyonu

Saldırgan ajanların hedef modeli yüz binlerce farklı psikolojik ve teknik baskıyla sınadığı otomatik red teaming altyapıları.

\text{AttackAgent} \leftrightarrow \text{TargetModel} \implies \text{Otomatik Emniyet Açığı Keşfi}
LEVHA 102 ↗
LEVHA 102 // AIC-GUV-0102 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0102
Derin Öğrenme & Ölçekleme Yasaları (2012 – 2021) 18 dk

Differentially Private SGD: Derin Ağlarda Bireysel Veri İfşasını Engellemek

Abadi ve ark. tarafından geliştirilen diferansiyel gizlilikli stokastik gradyan inişi ve tıp verileri üzerinde güvenli eğitim.

\mathbf{g}_t \leftarrow \frac{1}{B} \sum \text{clip}(\nabla \mathcal{L}_i, C) + \mathcal{N}(0, \sigma^2 C^2 I)
LEVHA 103 ↗
LEVHA 103 // AIC-GUV-0103 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0103
Derin Öğrenme & Ölçekleme Yasaları (2012 – 2021) 14 dk

Üyelik Çıkarımı (Membership Inference) Saldırıları: Model Seni Hatırlıyor mu?

Shokri ve ark. ın gölge modeller eğiterek ticari makine öğrenmesi API lerinden veri ifşası çıkarma tekniği.

P(x \in \mathcal{D}_{\text{train}}) = f(\text{Kayıp Düşüklüğü}, \text{Çıktı Güven Skoru})
LEVHA 104 ↗
LEVHA 104 // AIC-GUV-0104 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0104
Üretken Modeller & Akıl Yürütme (2022 – 2026) 17 dk

AB Yapay Zeka Yasası (EU AI Act): Risk Sınıflandırması ve Küresel Regülasyon

Biyometrik gözetim yasaklarından temel model sağlayıcılarına getirilen sistemik risk ve telif şeffaflığı denetimleri.

\text{Risk Kademesi} \in \{\text{Kabul Edilemez}, \text{Yüksek Risk}, \text{Şeffaflık Riski}, \text{Minimal Risk}\}
LEVHA 105 ↗
LEVHA 105 // AIC-GUV-0105 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0105
Derin Öğrenme & Ölçekleme Yasaları (2012 – 2021) 15 dk

Asilomar Yapay Zeka İlkeleri 2017: 23 Maddelik Gelecek Sözleşmesi

Musk, Hassabis, Bengio ve yüzlerce düşünürün imzaladığı 23 maddelik Asilomar etik ilkelerinin analizi.

\text{Yapay Zeka Araştırmasının Hedefi: Salt Güç Değil, Faydalı Zeka Yaratmaktır}
LEVHA 106 ↗
LEVHA 106 // AIC-GUV-0106 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0106
Üretken Modeller & Akıl Yürütme (2022 – 2026) 19 dk

Otonom Silah Sistemleri ve Öldürme Kararının Otomasyonu (Lethal Autonomous Weapons)

Stuart Russell ın Slaughterbots uyarısı ve Cenevre konvansiyonunda otonom dron sürüleri üzerine süren jeopolitik çıkmaz.

\text{Hedefleme} + \text{Ateşleme} - \text{İnsan Denetimi (Human-in-the-Loop)} \implies \text{Ahlaki Felaket}
LEVHA 107 ↗
LEVHA 107 // AIC-GUV-0107 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0107
Üretken Modeller & Akıl Yürütme (2022 – 2026) 15 dk

Watermarking ve Sentetik Metin Damgalama: Logit Uzayında Yeşil Kırmızı Listeler

Kirchenbauer ve ark. nın logit manipülasyonuyla sentetik metinleri damgalayan ve dezenformasyonu önleyen filigran formülü.

l_k \leftarrow l_k + \delta \quad \forall k \in \text{GreenList}(\text{Hash}(x_{t-1}))
LEVHA 108 ↗
LEVHA 108 // AIC-GUV-0108 SPARSE AUTOENCODER // RESIDUAL STREAM 16K SAE MONOSEMANTIC ACTIVATION VECTOR ÇÖZÜNÜRLÜK: FP8/BF16 DOI: 10.1145/AIC.2026.0108
Sibernetik & Mantık Kışları (1950 – 1989) 18 dk

Isaac Asimov’un Üç Robot Yasası: Kural Tabanlı Hizalanmanın İmkansızlığı

1942 de I, Robot ile başlayan robotik ahlak yasalarının günümüz yapay zeka güvenlik kılavuzlarına tuttuğu felsefi ayna.

\text{Yasa 1: İnsana Zarar Verme} \succ \text{Yasa 2: İtaat Et} \succ \text{Yasa 3: Kendini Koru}
ESC