bugün

qwen2 5 max

QWEN2.5-MAX, 20 trilyondan fazla jeton üzerinde önyargılı ve küratörlü denetimli ince ayar (SFT) ve insan geri bildiriminden (RLHF) takviye öğrenimi ile daha da rafine edilmiş büyük ölçekli bir MOE modelidir. Bugün, Qwen Dev ekibi performans sonuçlarını paylaşmak ve API'sının kullanılabilirliğini Alibaba Cloud üzerinden duyurmaktan heyecan duyuyor. Ayrıca sizi Qwen Chat'de Qwen2.5-Max'i deneyimlemeye davet ediyoruz!
Performans

Qwen2.5-Max'i toplulukla oldukça alakalı temel kriterlerde en iyi tescilli ve açık ağırlık modellerine karşı değerlendiriyoruz. Bunlar arasında üniversite düzeyinde problemler yoluyla bilgiyi değerlendirmek için MMLU-Pro, kodlama yetenekleri için LiveCodebench, genel genel performans için Livebench ve insan tercihlerine yaklaşan arena-sert bulunmaktadır. Analizimiz hem temel hem de talimat modellerini kapsar.

Sohbet ve kodlama gibi aşağı akış uygulamaları için tasarlanmış talimat modellerini doğrudan karşılaştırarak başlıyoruz. Qwen2.5-Max'ın performans sonuçları, Deepseek V3, GPT-4O ve Claude-3.5-Sonnet dahil olmak üzere önde gelen son teknoloji modellerle birlikte sunulmaktadır.
© copyright 2005 - 2026