阿里千问开源Qwen3.8系列模型:27B版支持262K原生上下文

智车科技

1天前

Qwen3.8-27B采用270亿参数的稠密(Dense)架构,是原生多模态模型,可端到端理解文本、图像与视频。

识礁Farsight 8月15日消息,阿里千问正式开源Qwen3.8系列模型,其中最受关注的是全新亮相的Qwen3.8-27B。该模型以Apache 2.0宽松协议开放权重,所有开发者、科研机构与企业均可免费下载、部署及商用,Hugging Face与魔搭社区ModelScope已同步上线。

图片

据悉,Qwen3.8-27B采用270亿参数的稠密(Dense)架构,是原生多模态模型,可端到端理解文本、图像与视频。其原生上下文长度达到262K Tokens,借助YaRN技术可进一步外推至1M Tokens,意味着整套代码仓库或长文档能够一次性纳入上下文。

性能层面,较上一代Qwen3.6-27B,Qwen3.8-27B在编程与办公场景实现大幅跃升,整体水平已超越Qwen3.7-Plus。

图片

官方基准显示:终端智能编程Terminal Bench 2.1由63.4升至73.0;软件工程评测SWE-bench Pro从53.5提升到61.7;长周期办公测试CoWorkBench达70.7;DeepSWE 1.1从13.3涨至42.2。模型还新增reasoning_effort功能,可按任务难度动态调节思考深度,兼顾效果与算力成本。

值得一提的是,本次开源是Qwen3.8家族整体布局的关键落子。此前旗舰Qwen3.8-Max已开放权重。截至目前,千问累计开源模型超460个,Qwen系列全球下载量突破30亿次,衍生模型超30万个,稳居全球开源模型家族第一梯队。

随着Qwen3.8系列权重的全面开放,开源与闭源旗舰之间的能力鸿沟正被快速填平,“开源即主力”的时代,或许就此拉开帷幕。

原文标题 : 阿里千问开源Qwen3.8系列模型:27B版支持262K原生上下文

Qwen3.8-27B采用270亿参数的稠密(Dense)架构,是原生多模态模型,可端到端理解文本、图像与视频。

识礁Farsight 8月15日消息,阿里千问正式开源Qwen3.8系列模型,其中最受关注的是全新亮相的Qwen3.8-27B。该模型以Apache 2.0宽松协议开放权重,所有开发者、科研机构与企业均可免费下载、部署及商用,Hugging Face与魔搭社区ModelScope已同步上线。

图片

据悉,Qwen3.8-27B采用270亿参数的稠密(Dense)架构,是原生多模态模型,可端到端理解文本、图像与视频。其原生上下文长度达到262K Tokens,借助YaRN技术可进一步外推至1M Tokens,意味着整套代码仓库或长文档能够一次性纳入上下文。

性能层面,较上一代Qwen3.6-27B,Qwen3.8-27B在编程与办公场景实现大幅跃升,整体水平已超越Qwen3.7-Plus。

图片

官方基准显示:终端智能编程Terminal Bench 2.1由63.4升至73.0;软件工程评测SWE-bench Pro从53.5提升到61.7;长周期办公测试CoWorkBench达70.7;DeepSWE 1.1从13.3涨至42.2。模型还新增reasoning_effort功能,可按任务难度动态调节思考深度,兼顾效果与算力成本。

值得一提的是,本次开源是Qwen3.8家族整体布局的关键落子。此前旗舰Qwen3.8-Max已开放权重。截至目前,千问累计开源模型超460个,Qwen系列全球下载量突破30亿次,衍生模型超30万个,稳居全球开源模型家族第一梯队。

随着Qwen3.8系列权重的全面开放,开源与闭源旗舰之间的能力鸿沟正被快速填平,“开源即主力”的时代,或许就此拉开帷幕。

原文标题 : 阿里千问开源Qwen3.8系列模型:27B版支持262K原生上下文

展开
财经头条声明:所载内容仅为传递信息目的,非本站观点,亦非投资建议。据此操作,风险自负。 商务合作:app@feheadline.com
打开“财经头条”阅读更多精彩资讯
APP内打开