Marissa Mayer 推出照片驱动 AI 助手 Dazzle,从相机胶卷读懂你
前 Yahoo CEO Marissa Mayer 发布个人 AI 助手 Dazzle,它不读取邮件和日历,只通过分析手机相册来理解用户的爱好、饮食与风格偏好。Dazzle 去年 12 月完成 800 万美元种子轮融资,可通过 App 或短信交互,功能分为扫描近期照片完成即时任务,以及挖掘相册历史生成个性化度假和礼物建议。Mayer 称 Dazzle 会丢弃 AI 标记为敏感的个人信息。
前 Yahoo CEO Marissa Mayer 发布个人 AI 助手 Dazzle,它不读取邮件和日历,只通过分析手机相册来理解用户的爱好、饮食与风格偏好。Dazzle 去年 12 月完成 800 万美元种子轮融资,可通过 App 或短信交互,功能分为扫描近期照片完成即时任务,以及挖掘相册历史生成个性化度假和礼物建议。Mayer 称 Dazzle 会丢弃 AI 标记为敏感的个人信息。
AMD 以 82 亿美元收购 World Labs。World Labs 创始人李飞飞在回顾文章中称,公司自 2024 年成立以来构建了图像、视频与空间重建的模型训练团队,并通过收购 SceniX 推进机器人仿真能力。
推荐理由:AMD 以 82 亿美元收购 World Labs,文中同时给出 Atlas 在稀疏重建上的能力定位与机器人仿真方向。
AINews 汇总 9/24-9/25 动态,指出 Opus 5.5 本周发布后社区反馈积极,尤其在用代码生成讲解视频上表现突出。
AMD 宣布以约 82 亿美元全股票交易收购 AI 研究实验室 World Labs,交易预计年底前完成。World Labs 由知名研究者李飞飞联合创立,2024 年成立后数月内估值达 10 亿美元,2025 年推出首个商业产品——可从提示词生成交互式 3D 世界的世界生成模型 Marble。
微软亚洲研究院新加坡(MSRA – Singapore)作为微软在东南亚的首个研究实验室,成立一年来围绕下一代 AI 模型与智能体系统、领域专用 AI、AI 原生研究实践、生态与人才培养四大方向推进工作。
AWS 发布教程,演示在 SageMaker AI 上从同一个 vLLM-Omni DLC 部署两个端点:实时端点运行 FLUX.2-klein-4B 生成图像,异步端点运行 Wan2.1-VACE-1.3B 做图像条件视频生成。文本提示词先生成 PNG,再连同运动提示词经 Amazon S3 传给视频端点,最终取回 MP4,并提供命令行与 Streamlit 界面。
在 Amazon SageMaker HyperPod 上,用开源 RL 框架 SkyRL 对 Qwen3-VL-8B 视觉语言模型做 GRPO 后训练,在固定 64 个迷宫评测集上把解迷宫成功率从 43.75% 提升到 95% 以上。
Runway 推出 GWM Worlds 2 研究预览,把高保真视频与音频生成变成实时交互式模拟,并引入 WorldPrompt 这一输入格式,可固定环境部分要素(包括首帧)并生成带时间戳的事件序列。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,在 Gemini 3.8 Live 的原生实时对话模型上加入近实时视频生成,实现带唇形同步、自然表情和流畅轮次的视觉化对话,已在 Gemini Enterprise 上线。
推荐理由:官方给出 Live Avatar 的实时视频对话能力、97 种语言同步与异步工具调用细节,可据此判断企业级多模态交互的落地形态。
Meta 在 Connect 2026 上把 Muse 个人智能体作为硬件加智能体战略的核心,为其加入语音与实时视频能力,并发布 Ray-Ban Meta Gen 3、售价 1299 美元的 Meta VR Glasses 以及 12 月发货的钥匙扣设备 Muse Charm。
AWS 发布基于 Strands Agents SDK 的智能体架构视频智能方案,由 Amazon Bedrock 驱动,按用户提问在运行时调度 Amazon Rekognition、Amazon Transcribe 和 Amazon Bedrock Data Automation。
Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款语音生成模型,前者面向角色设计与逐行表演指导,后者面向高并发配音与语音智能体。
推荐理由:官方给出两款 TTS 的定位差异、可用入口与基准排名,便于判断语音生成在配音和播客场景的落地方式。
NVIDIA 于 9 月 22-23 日在新加坡举办 AI Day,联合合作伙伴展示东南亚区域的 AI 落地进展。新加坡 HTX 正基于 Nemotron 3 Super 与 Nemotron 3 Nano Omni 研究公共安全 AI,越南 Viettel AI 微调 Nemotron 3 Super 后在 VMLU 基准与内部产品评测中均排名第一。
Google DeepMind 与 Google Research 发布 WeatherNext 3,称其为目前最先进、最准确的全球天气模型,按 Brightband 的独立实时评测。
推荐理由:官方给出分辨率、更新频率与降水精度提升的具体数字,可据此判断 AI 天气预报在 Google 产品中的落地程度。
微软研究院发布 MindTopo 基准,用于评估多模态大语言模型在连通性、封闭性、顺序、分离和绳结五类拓扑关系上的推理与规划能力。测试显示,当前专有与开源模型在静态识别上明显强于交互式规划,且均远低于人类水平,失败多出现在规划阶段而非感知阶段。图像与视频生成仅在单帧内保留拓扑关系时有用,跨序列仍不可靠。
Microsoft Research 发布研究模型 CARE-X,一个统一胸部 X 光视觉语言模型,同时支持报告生成与结构化预测,并用强化学习 DAPO 在多任务设定下奖励临床正确性。