?>

Dünyanın ilk yapay zeka yazılım mühendisi başarısız oldu

Cognition AI tarafından geliştirilen ve Devin olarak adlandırılan dünyanın ilk yapay zeka yazılım mühendisi, kendisine verilen görevlerin yüzde 85’inde başarısız olarak sınıfta kaldı.

Teknoloji - 1 yıl önce

Cognition AI tarafından geliştirilen ve Devin olarak adlandırılan dünyanın ilk “yapay zeka yazılım mühendisi” görünüşe göre işini yapmakta oldukça kötü. Yapılan son değerlendirmeler, bu yeni nesil aracın vaat edilen potansiyelden çok uzak olduğunu ortaya koyuyor. Testlerde Devin’in, kendisine verilen görevlerin yalnızca yüzde 15’ini başarıyla tamamladığı görüldü.

BEKLENTİLER BÜYÜKTÜ

Donanımhaber'de yer alan ayrıntılarda aktardığına göre 2024 yılının başlarında Cognition AI tarafından tanıtılan Devin, yazılım mühendislerine yardımcı olmayı amaçlayan bir otomasyon aracı olarak geliştirildi. Aralık 2024'te aylık 500 dolarlık abonelik ücretiyle genel kullanıma sunulan Devin'in, uygulama geliştirme ve hata giderme gibi görevleri baştan sona otonom bir şekilde gerçekleştirebildiği iddia edildi. Araç, Slack üzerinden komut alıyor ve Docker tabanlı bir çalışma ortamında terminal, tarayıcı, kod düzenleyici ve planlayıcı gibi araçlarla çalışıyor.

Cognition AI'nin açıklamasına göre Devin; API entegrasyonu, kod incelemeleri, altyapı yönetimi gibi görevleri yerine getirebiliyor. Hatta DoorDash üzerinden yemek siparişi verebilecek kadar "kişisel asistan" işlevi gördüğü de belirtiliyor. Bunlar, başlı başına çok büyük bir olay ve iddia.

Bu arada Devin, bir “bileşik yapay zeka sistemi”, yani OpenAI'nı GPT-4o'sunu içeren ve zaman içinde gelişmesi beklenebilecek bir dizi temel yapay zeka modeline dayanıyor. Teorik olarak onların yapabildikleri her şeyi yapması bekleniyor.

SONUÇLAR HAYAL KIRIKLIĞI OLDU

Saygın bir AI araştırma ve geliştirme laboratuvarı olan Answer.AI'dan üç veri bilimcisi Hamel Husain, Isaac Flath ve Johno Whitaker, bu iddiaları test etmek için bir dizi denemeler gerçekleştirdi. Devin ile test edilen 20 görevden sadece üçü başarıyla tamamlanabildi. Devin’in tamamladığı görevler arasında Notion veritabanından Google Sheets’e veri aktarma ve gezegen hareketlerini takip edebilen bir uygulama geliştirme bulunuyor. Ancak daha karmaşık görevlerde Devin, teknik çıkmazlara saplandı veya hatalı çözümler üretti.

Araştırmacılar, Devin'in temel engelleri fark edemediğini ve uygulanabilir olmayan çözümleri zorlamaya devam ettiğini belirtti. Örneğin, Devin’den birden fazla uygulamayı Railway platformuna dağıtması istendiğinde, bu platformun böyle bir özelliği desteklemediğini anlamadı. Günlerce çözüm arayarak zaman kaybetti ve hayali özellikler "uydurdu." Araştırmacılar, Devin’in arayüzünün kullanıcı dostu olduğunu ve bazı görevlerde umut verici sonuçlar verdiğini kabul etseler de, aracın güvenilir olmaktan uzak olduğunu vurguladı: “Daha da endişe verici olan, hangi görevlerin başarılı olacağını tahmin edemememizdi. İlk başarılarımıza benzer görevler bile karmaşık, zaman alıcı yollarla başarısız oluyordu.”

Haftanın Öne Çıkanları

Kartalkaya Kayak Merkezindeki otel sahibi kim? Mazhar Murtezaoğlu kimdir?

2025-01-21 15:09 - Gündem

AKP’li Şamil Tayyar’dan ‘denetim’ çıkışı: ‘Turizm belgeli işletmelerin denetimi bakanlığa aittir’

2025-01-23 01:39 - Siyaset

Hacı Sabancı kimdir, kaç yaşında? Hacı Sabancı babalık davası sonucu ne oldu?

2025-01-19 00:39 - Biyoğrafi

Tanju Özcan 'kirli bilgiler geliyor' dedi: Savcı ve bilirkişilere 'baskı' iddiası

2025-01-24 00:08 - Siyaset

Mardin'de silahlı kavga: 17 yaşındaki genç hayatını kaybetti

2025-01-17 01:39 - Asayiş

Zafer Partisi lideri Ümit Özdağ'a destek için 'Vatan Emniyet' önünde toplanıldı

2025-01-21 00:38 - Siyaset

Bolu'da kayak merkezinde korkunç yangın... Ölü ve yaralılar var!

2025-01-21 07:38 - Asayiş

Fenerbahçe'den Zalgiris karşısında muhteşem geri dönüş!

2025-01-18 00:00 - Spor

Orhan Gencebay'ın Bolu’daki yangın faciası ile ilgili açıklaması tepki çekti!

2025-01-23 16:38 - Magazin

Dünyaca ünlü kripto borsası Coinbase Türkiye'de faaliyet hazırlığında!

2025-01-21 00:00 - Ekonomi

İlgili Haberler

“Yapay Zekâ Yönetmenini Arıyor: Kısa Film Hackathonu” başlıyor...

00:00 - Teknoloji

Teknoloji tutkunları DevFest Gaziantep'te buluştu

00:00 - Teknoloji

Yapay zeka ile yaklaşık 20 meslek tehlike altında

00:02 - Teknoloji

Görüntülü sohbetlerde arkadaşlık bir rutin haline gelebilir mi?

11:11 - Teknoloji

SANKO Holding, TEKNOFEST 2025’te de yarışmanın yürütücülüğünü üstleniyor

00:39 - Teknoloji

Günün Manşetleri

Hasan Can Kaya ve Reynmen gözaltına alındı!

08:15 - Asayiş

Son Dakika: Fatih Ürek hayatını kaybetti...

21:28 - Gündem

Ünlülere yönelik uyuşturucu operasyonunda Mika Raun gözaltına alındı

21:26 - Asayiş

Aziz İhsan Aktaş davasında dördüncü gün sona erdi!

11:11 - Gündem

Gaziantep'te feci kaza: 2 ölü, 11 yaralı var!

11:02 - Asayiş