NVIDIA 展示在 Jetson AGX Thor 上本地运行 125B 多模态 MoE 模型 Qwen3.8 Flash Next
原标题:Run Qwen3.8 Flash Next, a 125B multimodal MoE model, locally on NVIDIA Jetson AGX Thor. ⚡ Built for reasoning, coding, and tool use, its 262K context window can handle large codebases and long convers
推荐理由
在机器人计算平台 Jetson AGX Thor 上以约每秒30 tokens 本地跑通125B多模态MoE,为具身端侧大模型推理提供可参考的量化与算力方案。
ROBOAIRADAR BRIEF
结构化情报
01
发生了什么
英伟达机器人账号演示在 NVIDIA Jetson AGX Thor 上本地运行 Qwen3.8 Flash Next--一款 125B 参数的多模态 MoE 模型。该模型面向推理、编程与工具调用,262K 上下文可处理大型代码库与长对话;借助 NVFP4 与 MTP,端侧推理速度约达每秒 30 tokens,相关代码已开放获取。
02
为什么重要
在机器人计算平台 Jetson AGX Thor 上以约每秒30 tokens 本地跑通125B多模态MoE,为具身端侧大模型推理提供可参考的量化与算力方案。
信息说明
RoboAIRadar 对公开信源进行聚合、中文整理和价值判断,不替代原始报道。 涉及产品参数、交易金额或公司声明时,请以原文为准。
查看原始报道