跳到正文
今天10月8日周四1 条
10月7日周三
  1. NVIDIA 开发者博客47

    NVIDIA AICR v1.0:开放、稳定、可验证的 GPU 集群配置

    NVIDIA 发布 AICR v1.0,为 GPU 加速 Kubernetes 集群提供开放、稳定、可验证的配置方案。该方案针对主机内核、GPU 驱动、容器运行时、网络、存储、operator 与工作负载框架等数十个各自独立发版的组件,解决版本兼容性问题。同一配置在不同服务、GPU 代际和 Kubernetes 版本下可能静默失效,AICR 旨在让部署前后的版本冲突可追溯、可验证。

10月2日周五
  1. NVIDIA 开发者博客52

    NVIDIA 发布 Do Inference Now Deploy 开源 C++ 样例集,用 TensorRT RTX 加速本地 AI 推理

    NVIDIA 推出开源 C++ 样例集 Do Inference Now (DIN) Deploy,将 ONNX Runtime 与 NVIDIA TensorRT RTX 执行提供程序结合,帮助开发者从模型 checkpoint 走到本地原生应用。该样例集面向本地应用集成 AI 模型,提供可移植模型格式、可靠运行时与跨目标系统的加速支持。

10月1日周四
  1. NVIDIA 开发者博客40

    NVIDIA cuObject 与 NVIDIA SCADA Server SDK 扩展 AI 存储访问

    NVIDIA 发布 cuObject 与 NVIDIA SCADA Server SDK,为 AI 基础设施工程师、存储开发者和云服务商提供对大容量文件与对象存储的快速、安全访问。该方案面向训练、微调、推理上下文、工具调用、搜索和数据库查询等 AI 工作负载的高速数据访问需求,覆盖本地与云端存储的数据。

  2. NVIDIA 开发者博客38

    用 NVIDIA NeMo Relay 追踪 Agent Harness 行为

    NVIDIA NeMo Relay 可追踪 Agent Harness 的执行路径,暴露任务完成背后的低效行为。失败搜索触发重复搜索、截断的文件读取导致命令重复抓取同一内容等冗余步骤会增加时延并消耗 token,即使最终答案正确也会被掩盖。这些低效还带来更多失败机会,追踪能力为改进 Agent 行为提供依据。