前沿科技

通义千问升级旗舰模型 Qwen-Max,性能接近 GPT-4o

【黑马财经】9 月 19 日消息,在今日开幕的云栖大会上,阿里云 CTO 周靖人宣布,通义旗舰模型 Qwen-Max 全方位升级,性能接近 GPT-4o。通义官网和通义 APP 的后台模型均已切换为 Qwen-Max,继续免费为所有用户提供服务。用户也可通过阿里云百炼平台调用 Qwen-Max 的 API。

相比上一代模型,Qwen-Max 在训练中使用了更多的训练数据、更大的模型规模、更强的人类对齐,最终达到了更高的智能水平。在 MMLU-Pro、MATH、GSM8K、MBPP、MultiPL-E、LiveCodeBench 等十多个权威基准上,Qwen-Max 表现接近 GPT-4o,数学能力、代码能力则超越了 GPT-4o。数学和代码所代表的推理能力是大模型智能水平的最重要体现。

相比 2023 年 4 月的初代通义千问大模型,Qwen-Max 的理解能力提升 46%、数学能力提升 75%、代码能力提升 102%、幻觉抵御能力提升 35%、指令遵循能力提升 105%,模型与人类偏好的对齐水平更是有了质的飞跃,提升了 700% 以上。

推荐阅读

国家安全部:警惕深度伪造技术带来的安全风险

admin

阿里视频生成大模型万相 2.1 开源!效果超 Sora,消费级显卡就能跑

admin

马蜂窝大数据:「元旦一日游」 热度上涨 166%,不少人选择 「请四休九」

admin