阿里云更新Qwen3模型 涵盖文本理解、科学等多个关键领域

凤凰网科技讯 7月22日,阿里云通义千问Qwen大模型官方账号公布对旗舰版Qwen3模型进行了更新,推出Qwen3-235B-A22B-FP8非思考模式(Non-thinking)的更新版本,命名为Qwen3-235B-A22B-Instruct-2507-FP8。此次更新,涵盖指令遵循、逻辑推理、文本理解、数学、科学、编程及工具使用等多个关键领域。

资料显示,新的Qwen3模型通用能力显著提升。在GQPA(知识)、AIME25(数学)、LiveCodeBench(编程)、Arena-Hard(人类偏好对齐)、BFCL(Agent 能力)等测评里,它超越了Kimi-K2、DeepSeek-V3等开源模型,以及Claude-Opus4-Non-thinking等闭源模型。

不仅如此,新版Qwen3在关键性能方面实现了进一步增强。在多语言的长尾知识覆盖上取得重要突破,极大地丰富了知识储备;在主观及开放性任务处理中,更能精准契合用户偏好,生成的回复实用性更强,文本质量也更高;长文本处理能力提升至256K,上下文理解能力得以进一步强化,能够更好地应对复杂内容。

目前,Qwen3新模型已在魔搭社区和HuggingFace上开源更新。

文章来源于网络。发布者:火星财经,转载请注明出处:https://www.sengcheng.com/article/80649.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
火星财经的头像火星财经
宗馥莉行的基本盘,还都是父亲宗庆后布的局!全盘控制娃哈哈除了“集权”,更大可能或许是推动娃哈哈上市
上一篇 2025年7月22日 上午11:07
美国“星际之门”项目据悉陷入僵局;谷歌Gemini高级版获IMO 2025官方认证金牌 丨全球科技早参
下一篇 2025年7月22日 上午11:07

相关推荐

发表回复

登录后才能评论
关注微信