9月19日云棲大會,阿里云CTO周靖人宣布,通義旗艦模型Qwen-Max全方位升級,性能接近GPT-4o。通義官網和通義APP的后臺模型均已切換為Qwen-Max,繼續免費為所有用戶提供服務。用戶也可通過阿里云百煉平臺調用Qwen-Max的API。
相比上一代模型,Qwen-Max在訓練中使用了更多的訓練數據、更大的模型規模、更強的人類對齊,最終達到了更高的智能水平。在MMLU-Pro、MATH、GSM8K、MBPP、MultiPL-E、LiveCodeBench等十多個權威基準上,Qwen-Max表現接近GPT-4o,數學能力、代碼能力則超越了GPT-4o。數學和代碼所代表的推理能力是大模型智能水平的最重要體現。
相比2023年4月的初代通義千問大模型,Qwen-Max的理解能力提升46%、數學能力提升75%、代碼能力提升102%、幻覺抵御能力提升35%、指令遵循能力提升105%,模型與人類偏好的對齊水平更是有了質的飛躍,提升了700%以上。
申請創業報道,分享創業好點子。點擊此處,共同探討創業新機遇!