DeepSeek’ten yapay zeka yarışını kızıştıracak yeni model

Çinli DeepSeek, metin yeteneklerini korurken görselleri de yorumlayabilen DeepSeek-V4-Flash-Vision-Exp modelini API erişimine açtı.

12punto

Çin merkezli yapay zeka şirketi DeepSeek, görsel girdileri anlayabilen yeni deneysel modelini tanıttı. Hangzhou merkezli şirketin duyurduğu DeepSeek-V4-Flash-Vision-Exp, yalnızca metin işleyen DeepSeek-V4-Flash modelinin çok modlu yetenekler eklenmiş sürümü olarak konumlandırılıyor.

Yeni model, metin komutlarının yanı sıra görüntü ve ekran görüntüsü gibi görsel girdileri analiz edebiliyor. Şirketin açıklamasına göre model, bu görsellerden elde ettiği bilgilerle belirli görevleri yerine getirebiliyor.

DeepSeek, X üzerinden yaptığı paylaşımda deneysel modelin metin yetenekleri açısından DeepSeek-V4-Flash ile aynı seviyeyi koruduğunu belirtti. Şirket, modelin ajan özellikleri, akıl yürütme ve dünya bilgisi gibi alanlarda mevcut amiral gemisi modelle eşleştiğini bildirdi.

Şirketin iddiasına göre DeepSeek-V4-Flash-Vision-Exp, çok modlu ajan yeteneklerini ölçen testlerde Anthropic’in gelişmiş Opus 4.8 modeline “yakın” performans gösterdi. Ajan yetenekleri, yapay zeka modelinin sürekli insan yönlendirmesi olmadan verilen görevleri takip edip sonuçlandırabilmesini ifade ediyor.

DeepSeek daha önce DeepSeek-VL ailesi gibi görsel ve çok modlu modeller üzerinde çalışmıştı. Yeni duyurulan model ise şirketin en gelişmiş model serisine görselleri yorumlama ve bu girdiler üzerinden görev yürütme kapasitesi eklemesi bakımından öne çıkıyor.

DeepSeek-V4-Flash-Vision-Exp’e şirketin API hizmeti üzerinden erişilebiliyor. Duyuru, Çinli yapay zeka şirketleri ile ABD merkezli geliştiriciler arasındaki rekabetin yoğunlaştığı bir döneme denk geldi.

Çinli geliştiriciler son dönemde daha düşük maliyetle güçlü performans sunan modelleriyle dikkat çekiyor. DeepSeek’in yılın başında piyasaya sürdüğü amiral gemisi model de açık ağırlıklı ve düşük maliyetli yapay zeka sistemlerinin kapasitesine ilişkin beklentileri değiştirmişti.