bugün
- osuruktan şiirler59
- 26 ağustos 2026 olympique lyon fenerbahçe maçı4
- yılmaz güney izleyip ahmet kaya dinleyen tip14
- gazze de 186 yardım çalışanının öldürülmesi3
- enayimiknatisi ile kavga etmek21
- dincinin içinde yaşadığı hasta hayal dünyası3
- abdullah öcalan13
- yıllık izin3
- bik bik kız kaçırdı9
- bir uykusuz eleman var uyuyamıyor geceleri2
- sözlükte kavga olmayan gün3
- tarhana çorbası7
- yasakçı zihniyet15
- alparslan kuytul13
- ekşi sözlük21
- yılmaz güney filmleri6
- şarapçı koala'nın ulusalcı nefreti8
- ilk buluşmada 13 pişi yiyen kız12
- tarhana içenlerin köylü ve eğitimsiz olması10
- avanosun nevşehirde olması5
- 18 ağustos 2026 fenerbahçe lyon maçı30
- fenerbahçe biraz sert biraz katı9
- polisin verilen emrin yasaya uygunluğunu sorgusu12
- çay içen erkeklerden iğreniyorum ıyy diyen kız5
- yılmaz güney büyüklüğü4
- ismail kartal16
- migros'a sorulacak tek soru3
- her şeyi hatırlayan insan9
- kadınlardaki aşırı özgüvenin nedeni2
- sözlüğün boktanlaşması4
- reels izleme bağımlılığı6
- ulusalcı önderlerin akp'ye geçmesi10
- astral seyahate çıkış harcı4
- muslettin amca6
- sabah alarmı yapılacak şarkı4
- bugün ne yapsam9
- müsavat dervişoğlu8
- şah hatayi'nin hataylı olmaması4
- eskiden migrosun alışveriş kamyonları vardı2
- aleksey batrakov19
- felsefe9
- gammazın gammazlanması4
- farah zeynep abdullah'ın yılmaz güney tweetleri3
- babo dünyayı düzdün doymadın3
- ırkçıların geri zekalı olduğu gerçeği3
- gazisini zulüm eden savaşta asker bulamaz5
- etimek tatlısı4
- 21 yaşında erkek 31 yaşında kadın ilişkisi4
- marco asensio5
- yeni partinin ilk krizde duvara toslaması6
QWEN2.5-MAX, 20 trilyondan fazla jeton üzerinde önyargılı ve küratörlü denetimli ince ayar (SFT) ve insan geri bildiriminden (RLHF) takviye öğrenimi ile daha da rafine edilmiş büyük ölçekli bir MOE modelidir. Bugün, Qwen Dev ekibi performans sonuçlarını paylaşmak ve API'sının kullanılabilirliğini Alibaba Cloud üzerinden duyurmaktan heyecan duyuyor. Ayrıca sizi Qwen Chat'de Qwen2.5-Max'i deneyimlemeye davet ediyoruz!
Performans
Qwen2.5-Max'i toplulukla oldukça alakalı temel kriterlerde en iyi tescilli ve açık ağırlık modellerine karşı değerlendiriyoruz. Bunlar arasında üniversite düzeyinde problemler yoluyla bilgiyi değerlendirmek için MMLU-Pro, kodlama yetenekleri için LiveCodebench, genel genel performans için Livebench ve insan tercihlerine yaklaşan arena-sert bulunmaktadır. Analizimiz hem temel hem de talimat modellerini kapsar.
Sohbet ve kodlama gibi aşağı akış uygulamaları için tasarlanmış talimat modellerini doğrudan karşılaştırarak başlıyoruz. Qwen2.5-Max'ın performans sonuçları, Deepseek V3, GPT-4O ve Claude-3.5-Sonnet dahil olmak üzere önde gelen son teknoloji modellerle birlikte sunulmaktadır.
Performans
Qwen2.5-Max'i toplulukla oldukça alakalı temel kriterlerde en iyi tescilli ve açık ağırlık modellerine karşı değerlendiriyoruz. Bunlar arasında üniversite düzeyinde problemler yoluyla bilgiyi değerlendirmek için MMLU-Pro, kodlama yetenekleri için LiveCodebench, genel genel performans için Livebench ve insan tercihlerine yaklaşan arena-sert bulunmaktadır. Analizimiz hem temel hem de talimat modellerini kapsar.
Sohbet ve kodlama gibi aşağı akış uygulamaları için tasarlanmış talimat modellerini doğrudan karşılaştırarak başlıyoruz. Qwen2.5-Max'ın performans sonuçları, Deepseek V3, GPT-4O ve Claude-3.5-Sonnet dahil olmak üzere önde gelen son teknoloji modellerle birlikte sunulmaktadır.
Gündemdeki Haberler
Güncel Önemli Başlıklar