Frontline Lab 摘要与来源
编辑摘要
GoSailGlobal 转发 @vista8 的帖子;@vista8 列出 Grok 4.6、DeepSeek V4 Pro 0813、WeLM-617B 和 Qwen3.8-2.4T-A95B,并询问最想先测试哪个。
这份简报保留原始来源,摘要和编辑判断都可以回到原文独立核验。
来源署名X · @GoSailGlobal
打开原始来源证据简报
GoSailGlobal 转发 @vista8 的帖子;@vista8 列出 Grok 4.6、DeepSeek V4 Pro 0813、WeLM-617B 和 Qwen3.8-2.4T-A95B,并询问最想先测试哪个。
GoSailGlobal 转发 @vista8 的帖子;@vista8 列出 Grok 4.6、DeepSeek V4 Pro 0813、WeLM-617B 和 Qwen3.8-2.4T-A95B,并询问最想先测试哪个。
这份简报保留原始来源,摘要和编辑判断都可以回到原文独立核验。
来源署名X · @GoSailGlobal
打开原始来源相关关系来自共同主题、实体、分类、标签与社区语境;每条结果仍保留独立来源回链。
AIHOT 称,DeepSeek V4 Pro 正式版与 Grok 4.6 在2 小时内先后发布,参数规模分别为1.6T/1.5T,并被描述为逼近 Claude Fable 5 体验。
原始来源bindureddy 表示新模型发布会再次增多,并列出最期待的 Grok 4.6、GLM 5.5 和 DeepSeek v4 Pro,同时认为定价将影响采用。
原始来源@op7418 根据流传截图称 DeepSeek Harness 会在今天公测,并进一步猜测它是否会与 0813 的模型细节一起发布。帖文未提供已核验的外链正文。
原始来源SGLang 与 Miles 在发布首日支持 Qwen3.8-2.4T-A95B;该模型是 Qwen 最大的开源模型,总参数 2.4T,每 token 激活 95B,采用混合注意力架构。
原始来源阿里 Qwen 团队正式开放 Qwen3.8-2.4T-A95B 模型权重;模型总参数 2.4T,每个 Token 激活 95B,原生支持 262,144 Token 上下文。
原始来源