
开源生态系统正帮助 AI 发烧友和开发者更轻松地在本地构建、定制和拥有强大运行能力的智能体。NVIDIA 汇总了近期推动本地 AI 发展的合作伙伴与开源社区进展,以及整个生态中不断涌现的模型、应用和工具。
在智能体应用方面,Perplexity 推出全新的本地智能体应用 Portable Computer,让用户在 NVIDIA DGX Spark 上运行个人 AI 智能体,实现本地、私密的工作流。该应用可连接多款主流应用,用户能够在本地模型和云端模型之间灵活切换:处理复杂工作时使用云端模型,完成日常任务时则使用本地模型。在本地运行时,Perplexity 提供一键式本地推理设置,并搭载经过专门后训练的 Qwen 3.8 27B 模型。
在本地编程智能体方面,NVIDIA RTX GPU 为开发者提供在本地运行前沿水准编程智能体的解决方案。作为 Qwen3.8-Max 的本地搭档,270 亿参数的开放模型 Qwen3.8-27B 可在单个 GPU 上运行,专为需要调用本地文件、工具和项目上下文信息的快速响应式编程工作流打造。开发者可将敏感代码、专有数据和项目上下文信息保留在自己的系统中,并可在 llama.cpp、Ollama、Unsloth 和 LM Studio Bionic 等工具上部署该模型。
在模型层面,NVIDIA 此前推出了 Nemotron 3.5 Lightning,这是一款面向始终在线智能体、可定制的开放式 300 亿参数混合专家模型,采用开放权重,AI 发烧友和开发者可使用自己的示例对其进行微调,使其更好地匹配特定任务、兴趣和工作流。
在系统能力方面,NVIDIA Sync 应用更新让多台 DGX Spark 组建为集群,提供运行更大模型所需的内存容量、推理性能和训练吞吐量。NVIDIA Sync 支持 Windows 和 macOS,可自动检测已连接的系统,并通过 Tailscale 提供私密且安全的远程访问;其中的 Cluster Assistant 可自动将两台或更多台 DGX Spark 配置为高速集群,开发者通过 NVIDIA ConnectX-7 端口连接这些系统后,NVIDIA Sync 便会完成网络配置、在各节点间调度工作负载,并监控系统运行状况。此外,NVIDIA Sync 资源监视器提供单台 DGX Spark 或整个集群中 CPU 和 GPU 使用情况的实时与历史视图。
在内容生成方面,LTX 推出最新的开放世界视频生成模型 LTX-2.5,可生成更高质量的视频并更准确地遵循提示词,在多次生成中保持角色、场景和声音的一致性。全新多镜头支持让创作者可生成跨越多个剪辑镜头的连续片段,升级后的扩散视频解码器可提升画质保真度并减少伪影。LTX-2.5 针对 NVIDIA RTX GPU 和 DGX Spark 进行了优化,性能提升 2 倍,内存占用降低 40%,创作者可通过开箱即用的 ComfyUI 工作流在本地进行文生视频、图生视频和视频到视频生成。
WeChat
Profile