9月19日云棲大會,阿里云CTO周靖人宣布,通義旗艦模型Qwen-Max全方位升級,性能接近GPT-4o。通義官網和通義APP的后臺模型均已切換為Qwen-Max,繼續(xù)免費為所有用戶提供服務。用戶也可通過阿里云百煉平臺調用Qwen-Max的API。
相比上一代模型,Qwen-Max在訓練中使用了更多的訓練數(shù)據(jù)、更大的模型規(guī)模、更強的人類對齊,最終達到了更高的智能水平。在MMLU-Pro、MATH、GSM8K、MBPP、MultiPL-E、LiveCodeBench等十多個權威基準上,Qwen-Max表現(xiàn)接近GPT-4o,數(shù)學能力、代碼能力則超越了GPT-4o。數(shù)學和代碼所代表的推理能力是大模型智能水平的最重要體現(xiàn)。
相比2023年4月的初代通義千問大模型,Qwen-Max的理解能力提升46%、數(shù)學能力提升75%、代碼能力提升102%、幻覺抵御能力提升35%、指令遵循能力提升105%,模型與人類偏好的對齊水平更是有了質的飛躍,提升了700%以上。
申請創(chuàng)業(yè)報道,分享創(chuàng)業(yè)好點子。點擊此處,共同探討創(chuàng)業(yè)新機遇!