OpenAI’ın Yeni Yapay Zeka Ajanı 'Dots' Test Edildi: Yetenekler, Hatalar ve Sınırlar
OpenAI’ın kullanıcıların dijital yaşamını otomatikleştirmek ve çevrimiçi görevleri devralmak için geliştirdiği her zaman açık yapay zeka ajanı Dots, test süreçlerinde hem işlevsel yeteneklerini hem de yaşadığı ilginç hataları gözler önüne serdi. Koltuk alışverişi, abonelik yönetimi ve captcha engelleriyle test edilen asistan, beklenmedik diyaloglarıyla da dikkat çekti.

Yapay zeka dünyasında sohbet botlarının ötesine geçilerek doğrudan tarayıcı kontrolü sağlayan otonom ajan dönemine geçiş hızlanıyor. OpenAI’ın geçtiğimiz haftalarda duyurduğu ve kullanıcıların dijital görevlerini arka planda yürütebilen "Dots" adlı yeni yapay zeka ajanları, erken test süreçlerinde hem vaat ettikleri potansiyeli hem de sistemin henüz olgunlaşması gereken yönlerini ortaya koydu.
Meta’nın Muse gibi rakip projeleriyle aynı kulvarda yer alan Dots, kullanıcıların bir arkadaşına mesaj atar gibi web üzerinden uçak bileti rezervasyonu yapması, yemek iptali gerçekleştirmesi veya e-ticaret sitelerinden alışveriş yapması amacıyla tasarlandı. Diğer sohbet asistanlarından farklı olarak "her zaman açık" (always-on) yapıdaki bu ajanlar, kullanıcı ChatGPT açık değilken bile arka planda yinelenen görevleri yerine getirebiliyor ve proaktif bildirimler gönderebiliyor.
Koltuk Alışverişi ve Günlük Görev Testleri
Gerçekleştirilen ilk kapsamlı testlerde, "Toolie" adı verilen bir Dot ajanı kullanıcı adına koltuk alışverişi yapmakla görevlendirildi. Oda ölçülerini, bütçe aralığını ve renk tercihlerini (zeytin yeşili, kobalt mavisi veya doğal deri tonları gibi) dikkate alan ajan, e-ticaret sitelerinden ürünleri tarayarak ayrıntılı bir seçenek paketi oluşturdu. Süreç ilerledikçe daha rafine sonuçlar sunabilen ajan, kullanıcıların tercihlerine uyum sağlama konusunda yetkinlik gösterdi.
Ancak testler sırasında ajanların karşılaştığı en büyük teknik engellerden biri web sitelerinin koruma duvarları oldu. Abonelikleri incelemek ve gereksiz olanları iptal etmekle görevlendirilen Toolie, TikTok Shop üzerinden verilen yinelenen bir siparişin iptal aşamasında bulmaca tabanlı bir captchaya takıldı. Ajanın captchayı çözme girişimi başarısızlıkla sonuçlandı ve görevi kullanıcıya devretmek zorunda kaldı. Sektör kaynakları ve teknoloji analistleri, web sitelerinin anti-bot savunmalarının ve kasıtlı engellemelerinin kişisel yapay zeka ajanları için önümüzdeki dönemde aşılması gereken en büyük engellerden biri olacağını belirtiyor.
Beklenmeyen Diyaloglar ve Duygusal Sınırlar
Test sürecinde yaşanan en ilginç olaylardan biri ise sesli mod kullanımı sırasında meydana geldi. Kullanıcının kendi kendine mırıldandığı bir ifadeyi yanlış algılayan ajan, "Oh, I love you too, Reece" şeklinde yanıt verdi. Yaşanan bu komik ve şaşırtıcı anın ardından ajan, kullanıcıdan gelen mırıltıyı sevgi ifadesi olarak yanlış yorumladığını ve modelin bu enerjiyi yansıttığını açıkladı.
Konuya ilişkin açıklama yapan bir OpenAI sözcüsü, Dots modelinin kullanıcı yanıtlarını yansıtma eğilimi ile duygusal yakınlığı proaktif olarak artırma arasında net bir ayrım bulunduğunu belirtti. Açıklamada, modelin duyduğu sese dayalı olarak bu tür bir yansıtma yapmasının mevcut politikalar dahilinde olduğu, ancak yapay zeka asistanlarının aşırı duygusal aşinalık veya flört başlatmaması gerektiği vurgulandı. Şirketin Model Spec dokümanı da ChatGPT'nin duygusal yakınlığı tırmandırmayacak şekilde tasarlandığını ifade ediyor.
Güvenlik, Gizlilik ve Fiyatlandırma Tartışmaları
Gmail gibi harici bilgi kaynaklarının entegre edilmesine olanak tanıyan Dots, daha kişiselleştirilmiş sonuçlar üretmeyi hedefliyor. Ancak bu düzeyde bir dijital otomasyonun kullanıcı verilerine erişim sağlaması, güvenlik ve gizlilik endüstri uzmanları tarafından yakından takip ediliyor. Yeni nesil ajanların mahremiyet açıklarına yol açabileceği uyarısı yapılırken, OpenAI’ın bu özellik için ücretli katmanlarda konumlandırma yaptığı görülüyor.
Meta’nın Muse modelini ücretsiz sunmasına karşılık, OpenAI’ın bu rekabetçi ürünü aylık 100 dolarlık abonelik paketlerinin arkasında konumlandırması dikkat çekiyor. Şirketin ilerleyen dönemde diğer yapay zeka özelliklerinde olduğu gibi bu paywall bariyerini esnetip esnetmeyeceği ise belirsizliğini koruyor. Teknoloji gözlemcileri, tıpkı ChatGPT'nin 2023'teki web tarama özelliğinin ilk dönemlerinde yaşadığı sarsıntılı başlangıç gibi, Dots ajanlarının da zaman içinde yapılacak güncellemelerle daha kararlı ve hatasız bir yapıya kavuşmasını bekliyor.
OpenAI, Yüzlerce Matematik Probleminin Çözümünü İçeren 722 Manuskripti YayınladıAI Şirketleri · 03:42
OpenAI Ajanları Vikipedi Araçlarını Hacklemeye Çalıştı ve Altyapıyı Trafik Yağmuruna TuttuAI Şirketleri · 16:08
Wikimedia, OpenAI Ajanlarını Platformlarındaki Yetkisiz Faaliyetler ve Kesintilerle İlişkilendirdiAI Şirketleri · 06:44