跳到正文

#部署/工程

今日 2 条
今天9月29日周二
  1. TechCrunch · AI31

    Modulate 融资 2500 万美元,用小型模型阵列做语音分析与深伪检测

    波士顿语音智能初创公司 Modulate 完成 2500 万美元新融资,由 Future Ventures 领投,Hyperplane 和 Lakestar 参投。其平台运行超过 100 个模型,分为信号提取与分析检测两类,为企业提供转录、情绪分析、深伪与 AI 音乐检测,以及受监管行业语音智能体的合规执行。公司现有 40-45 名员工,计划再招 10 人加强模型建设,并正提升本地与端侧部署能力。

9月28日周一
  1. The Verge · AI71

    英伟达发布 Open Agent Safety Platform,称可在毫秒级隔离越界智能体

    英伟达推出 Open Agent Safety Platform,用于隔离和监控 AI 智能体,称可在毫秒级内隔离试图越界的智能体。该平台基于开源软件 OpenShell,运行在英伟达 Vera AI CPU 上,用户可设定智能体可访问的信息,OpenShell 会在任务执行前和执行中检查这些限制,另有独立芯片上的 Sentry 技术持续监控智能体。

9月25日周五
9月24日周四
9月22日周二
  1. NVIDIA Blog22

    NVIDIA 埃及 AI 生态进入规模化生产阶段

    NVIDIA 在开罗大埃及博物馆举办活动,展示埃及 AI 生态从能力建设走向规模化落地,其 Deep Learning Institute 埃及学员规模一年增长超十倍。埃及已批准 Hassan Allam 建设运营数据中心,相关投资约 4 亿美元;Cassava 与 Vodafone Egypt 也宣布共建 AI factory,以 GPU-as-a-service 提供本地托管 AI 基础设施。

9月21日周一
9月16日周三
  1. NVIDIA Blog62

    NVIDIA Vera Rubin NVL72 首次亮相 MLPerf Inference v6.1,吞吐最高达 GB300 NVL72 的 3.7 倍

    NVIDIA 在 MLPerf Inference v6.1 首次提交 Vera Rubin NVL72 预览成绩,在 Qwen3-VL 上吞吐最高达 GB300 NVL72 的 3.7 倍,在 DeepSeek-R1 上最高达 2.5 倍。

    推荐理由:MLPerf v6.1 首次提交给出 Vera Rubin NVL72 相对 GB300 的吞吐与扩展效率数据,可据此判断下一代推理平台的性价比走向。

  2. NVIDIA Blog71

    NVIDIA 在 AI Infra Summit 发布 Vera Rubin 与 DSX 平台进展,主打每瓦 token 能效

    NVIDIA 在 AI Infra Summit 上公布 Vera Rubin 系统、DSX 平台与 NVLink 6 的多项进展,核心指标从峰值性能转向每兆瓦可验证的智能体 token 数。

    推荐理由:NVIDIA 在 AI Infra Summit 集中给出 Vera Rubin、DSX 与 NVLink 6 的能效与吞吐数据,可据此判断 AI 工厂的供电与推理经济性走向。

9月11日周五