Frontline Lab 摘要与来源
UnslothAI 称 2-bit NVIDIA Nemotron 3.5 Lightning 仅用 22GB VRAM 连续运行工具调用 10 分钟。该模型在过程中引用 80 多个网站、执行代码并搜索 10 个真实地点;可通过 Unsloth Desktop 运行和训练。
这份简报保留原始来源,摘要和编辑判断都可以回到原文独立核验。
来源署名X · @UnslothAI
打开原始来源证据简报
UnslothAI 称 2-bit NVIDIA Nemotron 3.5 Lightning 仅用 22GB VRAM 连续运行工具调用 10 分钟。该模型在过程中引用 80 多个网站、执行代码并搜索 10 个真实地点;可通过 Unsloth Desktop 运行和训练。
UnslothAI 称 2-bit NVIDIA Nemotron 3.5 Lightning 仅用 22GB VRAM 连续运行工具调用 10 分钟。该模型在过程中引用 80 多个网站、执行代码并搜索 10 个真实地点;可通过 Unsloth Desktop 运行和训练。
这份简报保留原始来源,摘要和编辑判断都可以回到原文独立核验。
来源署名X · @UnslothAI
打开原始来源相关关系来自共同主题、实体、分类、标签与社区语境;每条结果仍保留独立来源回链。
帖子称 NVIDIA researchers 构建了 SparDA,在 Q、K、V 之外加入 Forecast 投影,用上一层预测下一层所需 KV 块;该变体使解码快1.7x、长推理准确率提高6.5 points。
原始来源LTX 推出 LTX-2.5 模型,原生集成 ComfyUI;在 2 张英伟达 GB200 配置下生成 10 秒 720P 视频需 6.8 秒,LTX-2.5 Fast 按每秒 0.09 美元计费。
原始来源转帖内容显示,NVIDIAAI 介绍 NVIDIA Nemotron 3.5 Lightning,这是一款开放的30B MoE 模型,拥有3B 活跃参数,面向 always-on agents 场景。
原始来源Sakana AI 团队推出 Sakana Chat 大更新,服务无需登录且免费使用,由 Fugu 和更新后的 Namazu Japanese LLM 驱动,并支持完整代码执行。
原始来源OpenRouter 发布工具调用指南,说明如何用同一套代码在 Claude、GPT 和开源权重模型间切换,并覆盖定义工具、请求和返回结果循环。
原始来源