OpenAI, Avrupa Birliği'nde ChatGPT ve Codex tarafından üretilen metinlere görünmez bir filigran eklemeye başlayacağını duyurdu. Şirket bunu, 2 Ağustos'ta yürürlüğe giren ve yapay zekâ şirketlerini ürettikleri içeriği başka sistemlerin tanıyabileceği biçimde işaretlemeye zorlayan AB Yapay Zekâ Yasası'nın şeffaflık yükümlülüklerini karşılamak için yapıyor.

Filigran, "önümüzdeki haftalarda" tüm planlardaki uygun ChatGPT ve Codex kullanıcılarına — ancak yalnızca AB içinde — sunulacak. OpenAI API'sini kullanan geliştiriciler ise dünyanın her yerinden seçili modellerde filigranı hemen açabilecek; varsayılan olarak kapalı olacak ve şirket metin filigranını başlangıçta küresel bir varsayılan yapmayı bilinçli olarak tercih etmiyor.

İşaret, çıktının üzerine basılan bir sembol değil. Modelin kelime seçimlerini ince biçimde şekillendiriyor: bir gizli anahtarla bir sonraki kelime tahminleri hafifçe yönlendiriliyor, böylece ortaya çıkan metin insan gözünün göremeyeceği, ancak uygun bir dedektörün tespit edebileceği istatistiksel bir örüntü taşıyor. İşaret kelimelerin kendisinde yaşadığı için metin kopyalanıp yapıştırıldığında da onunla birlikte gidiyor. OpenAI filigranın kullanıcıyı tanımlamadığını ve açıkken model performansında anlamlı bir değişim ölçmediğini söylüyor.

Şirket, duyuruyla birlikte yöntemin teknik raporunu da yayımladı: Pennsylvania Üniversitesi ve Yale'den araştırmacılarla yazılan "textGrain". Rapor, bir anahtar kullanarak bir sonraki kelime tahminlerinin sıralanmasını ve yüzlerce böyle küçük yönlendirmenin bir araya gelmesiyle dedektörün, yalnızca metin ve anahtarla yapay zekâ üretimi içeriği işaretleyebilmesini anlatıyor.

OpenAI sınırlar konusunda açık sözlü. Şirketin kendi testlerinde kelimelerin yüzde 10'unun eşanlamlılarla değiştirilmesi, tespit oranını yaklaşık yüzde 92'den yüzde 66'ya düşürdü. Kısa pasajlar, matematik yanıtları ve çevrilmiş metinlerde tespit daha da zorlaşıyor. Şirket, dedektöre ilk erişimin yalnızca onaylı araştırmacılara ve uzman kuruluşlara verilmesinin nedenini bu sınırlamalara bağlıyor; amaç önce güvenilirliği ve sorumlu kullanımı değerlendirmek. OpenAI ayrıca filigranın bulunmamasının "insan yazarlığını kanıtlamadığı" uyarısını da yapıyor: metin yalnızca çok kısa, çok fazla düzenlenmiş ya da rakip bir modelin çıktısı olabilir.

Bu adım, Anthropic'in Claude çıktılarını dünya çapında filigranlamaya başlamasından yaklaşık iki ay sonra geliyor. O karar, talimatların, bağlamın ve kararların kendilerine ait olduğunu, modelin yalnızca bir araç olduğunu savunan kullanıcıların tepkisini çekmişti. OpenAI daha önce de bir metin filigranı geliştirmiş, ancak kullanıcıların çıktısını işaretlemeyen rakiplere geçebileceği endişesiyle bunu yayımlamaktan çekinmişti. Anthropic, Google, Meta, Microsoft ve OpenAI, AB'nin yapay zekâ üretimi içerikle ilgili uygulama kurallarına imza atan şirketler arasında.