Frontline Lab 摘要与来源
帖子称 NVIDIA researchers 构建了 SparDA,在 Q、K、V 之外加入 Forecast 投影,用上一层预测下一层所需 KV 块;该变体使解码快1.7x、长推理准确率提高6.5 points。
这份简报保留原始来源,摘要和编辑判断都可以回到原文独立核验。
来源署名X · @akshay_pachaar
打开原始来源证据简报
帖子称 NVIDIA researchers 构建了 SparDA,在 Q、K、V 之外加入 Forecast 投影,用上一层预测下一层所需 KV 块;该变体使解码快1.7x、长推理准确率提高6.5 points。
帖子称 NVIDIA researchers 构建了 SparDA,在 Q、K、V 之外加入 Forecast 投影,用上一层预测下一层所需 KV 块;该变体使解码快1.7x、长推理准确率提高6.5 points。
这份简报保留原始来源,摘要和编辑判断都可以回到原文独立核验。
来源署名X · @akshay_pachaar
打开原始来源相关关系来自共同主题、实体、分类、标签与社区语境;每条结果仍保留独立来源回链。
UnslothAI 称 2-bit NVIDIA Nemotron 3.5 Lightning 仅用 22GB VRAM 连续运行工具调用 10 分钟。该模型在过程中引用 80 多个网站、执行代码并搜索 10 个真实地点;可通过 Unsloth Desktop 运行和训练。
原始来源@op7418 根据流传截图称 DeepSeek Harness 会在今天公测,并进一步猜测它是否会与 0813 的模型细节一起发布。帖文未提供已核验的外链正文。
原始来源LTX 推出 LTX-2.5 模型,原生集成 ComfyUI;在 2 张英伟达 GB200 配置下生成 10 秒 720P 视频需 6.8 秒,LTX-2.5 Fast 按每秒 0.09 美元计费。
原始来源AIHOT 称,DeepSeek V4 Pro 正式版与 Grok 4.6 在2 小时内先后发布,参数规模分别为1.6T/1.5T,并被描述为逼近 Claude Fable 5 体验。
原始来源GoSailGlobal 转述 Crunchbase 数据称,2026 上半年全球新增 195 家独角兽,超过 2025 全年 193 家;机器人和 AI neolab 领跑,中国新增 38 家、美国 110 家。
原始来源