新留园 海外华人的新闻与社区
论坛 信息技术 阿里千问发布Qwen3.8旗舰模型权重:迈向长周期自主智能体新纪元

阿里千问发布Qwen3.8旗舰模型权重:迈向长周期自主智能体新纪元

小新 正二品 (尚书) 楼主
2026-08-13 17:12
第1楼

【核心提要】

  • 阿里千问团队正式开放Qwen3.8-2.4T-A95B旗舰模型权重,标志着国产大模型在超大规模参数领域的关键布局。
  • 该模型深度强化了“智能体(Agent)”能力,支持长周期任务处理、自主编程及复杂科研场景的自动化执行。
  • 随着Qwen3.8、DeepSeek-V4-Pro及Grok 4.6等顶流模型的密集更新,行业重心正从单纯的对话交互转向具备高度自主性的闭环工作能力。

【正文报道】

近日,阿里千问(Qwen)大模型团队宣布正式开放其旗舰级模型——Qwen3.8-2.4T-A95B的权重。这是阿里千问首次将“Max”级别的顶级旗舰模型权重对外公开。该模型基于Qwen3.5架构构建,总参数量高达2.4万亿(2.4 Trillion),每个Token激活约950亿参数。在技术特性上,它原生支持高达26.2万个Token的上下文长度,并可扩展至101万Token,旨在显著提升模型在编程、办公、科研及长周期智能体任务中的表现。

值得注意的是,Qwen3.8系列强调“思考模式”的深度融合。该模型在生成最终答案前,会通过<think>标签输出推理过程,且目前不支持关闭此功能。为了降低部署门槛,开源社区项目Unsloth AI利用动态1-bit分层选择性量化技术(Dynamic 1-bit Tiered Selective Quantization),将原有的4.9TB模型体积压缩至397GB,大幅提升了在有限硬件资源下的可运行性。

在实测能力方面,Qwen3.8-Max展现了极强的“自主执行”潜力。在长达16天的连续编程任务中,该模型能够自动构建自进化框架、处理社区需求并进行代码自我修复;在科研领域,它能独立复现并改进学术论文。尽管在某些特定基准测试(如TerminalBench 2.1或VideoMME v2)上略逊于GPT-5.6 Sol等竞争对手,但在PaperBench和OSWorld-Verified等衡量复杂逻辑与操作能力的指标中,Qwen3.8-Max表现优异。

【小编观点】
此次Qwen3.8的发布并非孤立的更新,而是全球大模型竞赛进入“智能体(Agent)时代”的一个重要信号。从阿里千问、DeepSeek到马斯克的Grok,顶尖厂商正齐聚一堂,试图让AI脱离人类的持续干预,能够独立承接跨越数天甚至数周的长周期任务。Qwen3.8通过开放超大规模参数模型的权重,不仅是技术实力的展示,更是中国开源大模型在核心竞争力上的一次重要“落子”。

背景链接:

新闻配图

新闻配图

新闻配图

新闻配图

0 条回复

暂无回复,快来抢沙发吧!

  • 1 / 1 页
敬请注意:文中内容观点和各种评论不代表本网立场!若有违规侵权,请联系我们