?>

Dünyanın ilk yapay zeka yazılım mühendisi başarısız oldu

Cognition AI tarafından geliştirilen ve Devin olarak adlandırılan dünyanın ilk yapay zeka yazılım mühendisi, kendisine verilen görevlerin yüzde 85’inde başarısız olarak sınıfta kaldı.

Teknoloji - 1 yıl önce

Cognition AI tarafından geliştirilen ve Devin olarak adlandırılan dünyanın ilk “yapay zeka yazılım mühendisi” görünüşe göre işini yapmakta oldukça kötü. Yapılan son değerlendirmeler, bu yeni nesil aracın vaat edilen potansiyelden çok uzak olduğunu ortaya koyuyor. Testlerde Devin’in, kendisine verilen görevlerin yalnızca yüzde 15’ini başarıyla tamamladığı görüldü.

BEKLENTİLER BÜYÜKTÜ

Donanımhaber'de yer alan ayrıntılarda aktardığına göre 2024 yılının başlarında Cognition AI tarafından tanıtılan Devin, yazılım mühendislerine yardımcı olmayı amaçlayan bir otomasyon aracı olarak geliştirildi. Aralık 2024'te aylık 500 dolarlık abonelik ücretiyle genel kullanıma sunulan Devin'in, uygulama geliştirme ve hata giderme gibi görevleri baştan sona otonom bir şekilde gerçekleştirebildiği iddia edildi. Araç, Slack üzerinden komut alıyor ve Docker tabanlı bir çalışma ortamında terminal, tarayıcı, kod düzenleyici ve planlayıcı gibi araçlarla çalışıyor.

Cognition AI'nin açıklamasına göre Devin; API entegrasyonu, kod incelemeleri, altyapı yönetimi gibi görevleri yerine getirebiliyor. Hatta DoorDash üzerinden yemek siparişi verebilecek kadar "kişisel asistan" işlevi gördüğü de belirtiliyor. Bunlar, başlı başına çok büyük bir olay ve iddia.

Bu arada Devin, bir “bileşik yapay zeka sistemi”, yani OpenAI'nı GPT-4o'sunu içeren ve zaman içinde gelişmesi beklenebilecek bir dizi temel yapay zeka modeline dayanıyor. Teorik olarak onların yapabildikleri her şeyi yapması bekleniyor.

SONUÇLAR HAYAL KIRIKLIĞI OLDU

Saygın bir AI araştırma ve geliştirme laboratuvarı olan Answer.AI'dan üç veri bilimcisi Hamel Husain, Isaac Flath ve Johno Whitaker, bu iddiaları test etmek için bir dizi denemeler gerçekleştirdi. Devin ile test edilen 20 görevden sadece üçü başarıyla tamamlanabildi. Devin’in tamamladığı görevler arasında Notion veritabanından Google Sheets’e veri aktarma ve gezegen hareketlerini takip edebilen bir uygulama geliştirme bulunuyor. Ancak daha karmaşık görevlerde Devin, teknik çıkmazlara saplandı veya hatalı çözümler üretti.

Araştırmacılar, Devin'in temel engelleri fark edemediğini ve uygulanabilir olmayan çözümleri zorlamaya devam ettiğini belirtti. Örneğin, Devin’den birden fazla uygulamayı Railway platformuna dağıtması istendiğinde, bu platformun böyle bir özelliği desteklemediğini anlamadı. Günlerce çözüm arayarak zaman kaybetti ve hayali özellikler "uydurdu." Araştırmacılar, Devin’in arayüzünün kullanıcı dostu olduğunu ve bazı görevlerde umut verici sonuçlar verdiğini kabul etseler de, aracın güvenilir olmaktan uzak olduğunu vurguladı: “Daha da endişe verici olan, hangi görevlerin başarılı olacağını tahmin edemememizdi. İlk başarılarımıza benzer görevler bile karmaşık, zaman alıcı yollarla başarısız oluyordu.”

Haftanın Öne Çıkanları

Kartalkaya Kayak Merkezindeki otel sahibi kim? Mazhar Murtezaoğlu kimdir?

2025-01-21 15:09 - Gündem

AKP’li Şamil Tayyar’dan ‘denetim’ çıkışı: ‘Turizm belgeli işletmelerin denetimi bakanlığa aittir’

2025-01-23 01:39 - Siyaset

Dünyaca ünlü kripto borsası Coinbase Türkiye'de faaliyet hazırlığında!

2025-01-21 00:00 - Ekonomi

Hacı Sabancı kimdir, kaç yaşında? Hacı Sabancı babalık davası sonucu ne oldu?

2025-01-19 00:39 - Biyoğrafi

Tanju Özcan 'kirli bilgiler geliyor' dedi: Savcı ve bilirkişilere 'baskı' iddiası

2025-01-24 00:08 - Siyaset

Mardin'de silahlı kavga: 17 yaşındaki genç hayatını kaybetti

2025-01-17 01:39 - Asayiş

Bolu'da kayak merkezinde korkunç yangın... Ölü ve yaralılar var!

2025-01-21 07:38 - Asayiş

Zafer Partisi lideri Ümit Özdağ'a destek için 'Vatan Emniyet' önünde toplanıldı

2025-01-21 00:38 - Siyaset

Trabzonspor, Danilo Sikan'ı resmen açıkladı!

2025-01-22 00:38 - Spor

Fenerbahçe'den Zalgiris karşısında muhteşem geri dönüş!

2025-01-18 00:00 - Spor

İlgili Haberler

“Yapay Zekâ Yönetmenini Arıyor: Kısa Film Hackathonu” başlıyor...

00:00 - Teknoloji

Teknoloji tutkunları DevFest Gaziantep'te buluştu

00:00 - Teknoloji

Yapay zeka ile yaklaşık 20 meslek tehlike altında

00:02 - Teknoloji

Görüntülü sohbetlerde arkadaşlık bir rutin haline gelebilir mi?

11:11 - Teknoloji

SANKO Holding, TEKNOFEST 2025’te de yarışmanın yürütücülüğünü üstleniyor

00:39 - Teknoloji

Günün Manşetleri

Akın Gürlek'ten Özgür Özel'in malvarlığı iddialarına yanıt

16:17 - Gündem

CHP Gaziantep'ten iş bırakan işçilere destek ziyareti

00:15 - Yerel

Kuşadası Belediye Başkanı Ömer Günel tutuklandı!

22:17 - Gündem

Ümit Özdağ: PKK terörü Güney Azerbaycan'a yayılmadan müdahale edilmesi gerekiyor

18:27 - Siyaset

Hüseyin Baş: AKP seçimi kaybedeceği için bunları yaşıyoruz

18:24 - Siyaset