Frontline Lab 摘要与来源
转帖内容显示,NVIDIAAI 介绍 NVIDIA Nemotron 3.5 Lightning,这是一款开放的30B MoE 模型,拥有3B 活跃参数,面向 always-on agents 场景。
这份简报保留原始来源,摘要和编辑判断都可以回到原文独立核验。
来源署名X · @huggingface
打开原始来源证据简报
转帖内容显示,NVIDIAAI 介绍 NVIDIA Nemotron 3.5 Lightning,这是一款开放的30B MoE 模型,拥有3B 活跃参数,面向 always-on agents 场景。
转帖内容显示,NVIDIAAI 介绍 NVIDIA Nemotron 3.5 Lightning,这是一款开放的30B MoE 模型,拥有3B 活跃参数,面向 always-on agents 场景。
这份简报保留原始来源,摘要和编辑判断都可以回到原文独立核验。
来源署名X · @huggingface
打开原始来源相关关系来自共同主题、实体、分类、标签与社区语境;每条结果仍保留独立来源回链。
LTX 推出 LTX-2.5 模型,原生集成 ComfyUI;在 2 张英伟达 GB200 配置下生成 10 秒 720P 视频需 6.8 秒,LTX-2.5 Fast 按每秒 0.09 美元计费。
原始来源@huggingface 转发 ClementDelangue 的帖文,称“Local AI is exploding”,并提到 Hugging Face 过去三年一直在构建 Transformers.js;原帖在“has now become…”处被截断,未显示完整结论。
原始来源UnslothAI 称 2-bit NVIDIA Nemotron 3.5 Lightning 仅用 22GB VRAM 连续运行工具调用 10 分钟。该模型在过程中引用 80 多个网站、执行代码并搜索 10 个真实地点;可通过 Unsloth Desktop 运行和训练。
原始来源帖子称 NVIDIA researchers 构建了 SparDA,在 Q、K、V 之外加入 Forecast 投影,用上一层预测下一层所需 KV 块;该变体使解码快1.7x、长推理准确率提高6.5 points。
原始来源SGLang 与 Miles 在发布首日支持 Qwen3.8-2.4T-A95B;该模型是 Qwen 最大的开源模型,总参数 2.4T,每 token 激活 95B,采用混合注意力架构。
原始来源