跳到正文

全部动态

今日 61 条
9月26日周六
  1. AWS Machine Learning Blog34

    NarrateAI:在 Amazon Bedrock 上实现生产级 LLM 质量保障

    NarrateAI 在 Amazon Bedrock 上通过五项技术实现约 99% 的数值准确率并实时流式返回结果,服务超过 4000 名 AWS 高管。这五项技术分别是自适应流水线编排、跨账户多模型故障转移、实时流式评估、复合评估框架和数据准确性验证,其中约 90% 的查询走单次快速路径,仅约 10% 走并行批处理路径。

  2. AWS Machine Learning Blog34

    在 Amazon SageMaker AI 上部署 Qwen3-TTS 实时个性化语音

    阿里云 Qwen 团队开源的 Qwen3-TTS-12Hz-1.7B-Base 已上线 Amazon SageMaker JumpStart,可部署到全托管实时推理端点,仅凭几秒参考音频和对应文本即可克隆音色,无需重新训练。该模型覆盖中文、英文、日文等 10 种语言,支持跨语言克隆与流式生成,输出 24 kHz 音频,同系列还有 CustomVoice 和 Qwen3-ASR-1.7B 可选。

9月25日周五
  1. Ars Technica · AI71

    特朗普政府用 AI 审批 Medicare 老年患者医疗,引发争议

    特朗普政府今年 1 月推出试点项目 WISeR,用 AI 决定 Medicare 老年患者部分医疗服务的授权或拒绝,此前该项目并不要求医生预先审批。随后媒体报道出现技术故障、审批延迟、令人困惑的拒批和患者痛苦等待等问题;电子前沿基金会本月公布的联邦文件证实了这些反馈,有医疗提供者称该项目是耻辱。

  2. Google DeepMind67

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 的原生实时对话模型上加入近实时视频生成,实现带唇形同步、自然表情和流畅轮次的视觉化对话,已在 Gemini Enterprise 上线。

    推荐理由:官方给出 Live Avatar 的实时视频对话能力、97 种语言同步与异步工具调用细节,可据此判断企业级多模态交互的落地形态。

9月24日周四
  1. NVIDIA Blog62

    NVIDIA 联合 Google DeepMind 等开放 2800 多种病毒的蛋白复合物预测结构

    NVIDIA 加入由 Google DeepMind、EMBL-EBI 等组成的全球研究联盟,通过 AlphaFold Database 开放 2800 多种病毒的蛋白复合物预测 3D 结构,供任何科学家免费使用。

    推荐理由:NVIDIA 联合 Google DeepMind 等机构开放 2800 多种病毒的蛋白复合物预测结构,读者可了解开放科学在疫情准备中的具体做法。

  2. Ars Technica · AI42

    YouTube 今年晚些时候将推出自定义信息流和更多 AI 功能

    YouTube 在年度 Made on YouTube 活动上宣布,将推出 Custom Feeds 功能,用户输入描述即可生成自定义内容标签页,并可保存多个信息流,该功能将很快在美国的网页、移动端和电视端上线。平台还将在今年晚些时候支持评论中发布 GIF,并为私信功能加入群聊,初期仅限美国、英国、新加坡、巴西和部分欧洲国家。