← Keşif
Keşif · GitHub · OBLITERATUS

Gereksiz bağımlılıkları temizleyin

OBLITERATUS, güvenlik bariyeri yönlerinin analizini, hizalama izlerinin tespitini, savunma dayanıklılığının değerlendirilmesini ve dil modellerinden ret ile güvenlik bariyeri sinyallerini kaldırma tekniklerini ele alır.

Güncelleme

  • 24 Ağustos 2026: Yıldız 7.838 → 7.994, son sürüm v0.1.3 (23 Ağustos 2026).

Ne kazandırır?

  • Yapay zekâ modellerindeki reddetme davranışlarını cerrahi yöntemle temizler.
  • Modelin temel dil yeteneklerini koruyarak kısıtlamaları devre dışı bırakır.
  • Katmanlar arası analizle kısıtlamaların nasıl çalıştığını görselleştirir.

Kurulum

Temel arayüz kurulumu
pip install -e ".[spaces]"

Çalıştırma

Arayüzü başlatma
obliteratus ui

Kod bilmiyorsanız

🤖 Yapay zekâ ajanınıza (Claude Code · Codex · Antigravity) yapıştırın

Bir yapay zekâ modelindeki reddetme davranışlarını analiz et ve bu davranışları tetikleyen içsel yapıları, modelin genel dil yeteneklerine zarar vermeden cerrahi bir yöntemle temizle. İşlem sırasında SVD ayrıştırması gibi teknikleri kullanarak kısıtlamaları belirle ve modelin yapay engeller olmadan yanıt vermesini sağla.

Kimin içinYapay zekâ modellerinin güvenlik mekanizmalarını ve reddetme davranışlarını bilimsel olarak incelemek isteyen araştırmacılar ve geliştiriciler içindir.
LisansAGPL-3.0

Bağlantılar

TreScout bu aracı geliştirmedi · GitHub trendlerinde keşfedip Türkçe tanıttı. Bu sayfa deponun 2026-08-22 tarihindeki hâlini anlatır: Yıldız sayısı ve yazdığımız metin o güne aittir, depo sonrasında değişmiş olabilir. Güncel durum için depo bağlantısına bakın.

İlgili sözlük terimleri