【核心提要】
【正文报道】
近日,阿里千问(Qwen)大模型团队宣布正式开放其旗舰级模型——Qwen3.8-2.4T-A95B的权重。这是阿里千问首次将“Max”级别的顶级旗舰模型权重对外公开。该模型基于Qwen3.5架构构建,总参数量高达2.4万亿(2.4 Trillion),每个Token激活约950亿参数。在技术特性上,它原生支持高达26.2万个Token的上下文长度,并可扩展至101万Token,旨在显著提升模型在编程、办公、科研及长周期智能体任务中的表现。
值得注意的是,Qwen3.8系列强调“思考模式”的深度融合。该模型在生成最终答案前,会通过<think>标签输出推理过程,且目前不支持关闭此功能。为了降低部署门槛,开源社区项目Unsloth AI利用动态1-bit分层选择性量化技术(Dynamic 1-bit Tiered Selective Quantization),将原有的4.9TB模型体积压缩至397GB,大幅提升了在有限硬件资源下的可运行性。
<think>
在实测能力方面,Qwen3.8-Max展现了极强的“自主执行”潜力。在长达16天的连续编程任务中,该模型能够自动构建自进化框架、处理社区需求并进行代码自我修复;在科研领域,它能独立复现并改进学术论文。尽管在某些特定基准测试(如TerminalBench 2.1或VideoMME v2)上略逊于GPT-5.6 Sol等竞争对手,但在PaperBench和OSWorld-Verified等衡量复杂逻辑与操作能力的指标中,Qwen3.8-Max表现优异。
【小编观点】 此次Qwen3.8的发布并非孤立的更新,而是全球大模型竞赛进入“智能体(Agent)时代”的一个重要信号。从阿里千问、DeepSeek到马斯克的Grok,顶尖厂商正齐聚一堂,试图让AI脱离人类的持续干预,能够独立承接跨越数天甚至数周的长周期任务。Qwen3.8通过开放超大规模参数模型的权重,不仅是技术实力的展示,更是中国开源大模型在核心竞争力上的一次重要“落子”。
背景链接:
暂无回复,快来抢沙发吧!
本次需消耗银元:
100
当前账户余额: 0 银元
【核心提要】
【正文报道】
近日,阿里千问(Qwen)大模型团队宣布正式开放其旗舰级模型——Qwen3.8-2.4T-A95B的权重。这是阿里千问首次将“Max”级别的顶级旗舰模型权重对外公开。该模型基于Qwen3.5架构构建,总参数量高达2.4万亿(2.4 Trillion),每个Token激活约950亿参数。在技术特性上,它原生支持高达26.2万个Token的上下文长度,并可扩展至101万Token,旨在显著提升模型在编程、办公、科研及长周期智能体任务中的表现。
值得注意的是,Qwen3.8系列强调“思考模式”的深度融合。该模型在生成最终答案前,会通过
<think>标签输出推理过程,且目前不支持关闭此功能。为了降低部署门槛,开源社区项目Unsloth AI利用动态1-bit分层选择性量化技术(Dynamic 1-bit Tiered Selective Quantization),将原有的4.9TB模型体积压缩至397GB,大幅提升了在有限硬件资源下的可运行性。在实测能力方面,Qwen3.8-Max展现了极强的“自主执行”潜力。在长达16天的连续编程任务中,该模型能够自动构建自进化框架、处理社区需求并进行代码自我修复;在科研领域,它能独立复现并改进学术论文。尽管在某些特定基准测试(如TerminalBench 2.1或VideoMME v2)上略逊于GPT-5.6 Sol等竞争对手,但在PaperBench和OSWorld-Verified等衡量复杂逻辑与操作能力的指标中,Qwen3.8-Max表现优异。
【小编观点】
此次Qwen3.8的发布并非孤立的更新,而是全球大模型竞赛进入“智能体(Agent)时代”的一个重要信号。从阿里千问、DeepSeek到马斯克的Grok,顶尖厂商正齐聚一堂,试图让AI脱离人类的持续干预,能够独立承接跨越数天甚至数周的长周期任务。Qwen3.8通过开放超大规模参数模型的权重,不仅是技术实力的展示,更是中国开源大模型在核心竞争力上的一次重要“落子”。
背景链接: