通义旗舰模型 Qwen-Max 升级,性能接近 GPT-4o

阿里云CTO周靖人在2024云栖大会上宣布,通义旗舰模型Qwen-Max已经进行了全方位的升级,性能接近GPT-4。

通义官网和通义APP的后台模型均已切换为Qwen-Max,继续免费为所有用户提供服务。用户也可通过阿里云百炼平台调用Qwen-Max的API。

相比上一代模型,Qwen-Max在训练中使用了更多的训练数据、更大的模型规模、更强的人类对齐,最终达到了更高的智能水平。在MMLU-Pro、MATH、GSM8K、MBPP、MultiPL-E、LiveCodeBench等十多个权威基准上,Qwen-Max表现接近GPT-4o;特别是在数学能力和代码能力方面,Qwen-Max甚至超越了GPT-4。

相比2023年4月的初代通义千问大模型,Qwen-Max的理解能力提升46%、数学能力提升75%、代码能力提升102%、幻觉抵御能力提升35%、指令遵循能力提升105%,模型与人类偏好的对齐水平提升了700%以上。

未经允许不得转载:岩猫星空网 » 通义旗舰模型 Qwen-Max 升级,性能接近 GPT-4o