蚂蚁集团宣布将旗下 AI 健康应用 AQ 升级为 “蚂蚁阿福”,并推出新版本,新增健康陪伴、健康问答和健康服务三大功能。新版 “阿福” 定位为 AI 健康朋友,支持用户记录健康数据、设定健康目标,并提供个性化健康建议。目前,该 App 月活用户超 1500 万,每天处理 500 多万个健康提问,55% 用户来自三线及以下城市,普惠性显著。此外,“阿福” 还链接了全国 30 万真人医生,提供在线问诊服务,并获多位国家院士支持。

AIWW评析

蚂蚁集团的 “阿福” App 升级,标志着 AI 从工具向 “朋友” 角色的转变,不仅提升了健康管理的便捷性,更体现了技术的人性化。其普惠性设计尤其值得称赞,覆盖三线及以下城市用户,填补了基层健康服务的空白。然而,AI 健康问答虽专业,但终究无法替代真人医生,如何在 “陪伴” 与 “医疗” 之间划清界限,避免用户过度依赖,是未来需关注的重点。此外,隐私保护问题也不容忽视,尤其是健康数据的敏感性和安全性。总体来看,“阿福” 是 “健康中国” 战略的一次创新实践,但需在技术与伦理之间找到平衡。

OpenAI 推出新一代旗舰模型 GPT-5.2,首次将专业性作为核心能力,提供 Instant、Thinking、Pro 三个版本,分别针对快速响应、复杂推理和全流程任务执行。在 GDPval 基准测试中,Thinking 模式在 44 个职业任务中 70.9% 的表现击败或持平人类专家,速度快 11 倍且成本低 99%。此外,GPT-5.2 在工具调用测试中准确率达 98.7%,支持 256k 长上下文,成为企业级生产可用的稳定工具,标志着 AI 从回答问题到协作执行完整任务的重大转变。

AIWW评析

GPT-5.2 的发布不仅是技术上的迭代,更是 AI 从 “助手” 向 “同事” 角色的跨越。其 70.9% 的职业任务表现超越人类专家,速度快 11 倍且成本低 99%,意味着 AI 将深度重塑专业工作场景。然而,这也引发了对人类职业替代的隐忧 ——AI 是否会成为 “完美打工人”?未来,人类或许需要重新定义自身价值,聚焦于创造力、情感和决策等 AI 难以替代的领域。这场技术革命,既是效率的狂欢,也是职业生态的重新洗牌。

DeepSeek发布V3.2系列开源模型,性能对标Gemini-3.0-Pro。DeepSeek-V3.2平衡实用,推理达GPT-5水平,适用于日常问答等;DeepSeek-V3.2-Speciale极致推理,获多项竞赛金牌,但仅限研究使用。V3.2引入DSA机制,降低计算复杂度,强化学习训练量大,Agent任务能力突出,但仍有局限性,未来会改进。

Google 正式发布新一代人工智能模型 Gemini 3,该模型在多模态理解、编程能力、推理测试等多个领域表现卓越,登顶 LMArena 排行榜。Gemini 3 在多项基准测试中刷新纪录,如 “人类最后的考试” 中达到 37.5% 准确率,GPQA Diamond 测试中得分 91.9%。此外,Google 还推出增强推理模式 Gemini 3 Deep Think 和全新开发平台 Antigravity,进一步扩展其生态优势。

蚂蚁集团正式发布全模态通用 AI 助手 “灵光”,具备 “灵光对话”、“灵光闪应用”、“灵光开眼” 三大核心功能,支持语音、3D 模型、图表、地图等多模态信息输出,并能实现文生图、文生视频等创作玩法,覆盖 AI 搜索、翻译、办公等多样化需求,已登陆安卓与苹果应用商店。

百度正式推出文心大模型 5.0,采用原生全模态统一建模技术,支持文本、图像、音频、视频等多种信息的输入与输出。该模型在多模态理解、指令遵循、创意写作等方面表现突出,具备强大的理解、逻辑和说服力。用户可通过文心 App 体验预览版,开发者和企业用户则可通过百度千帆大模型平台调用 API 服务。此前,其预览版 ERNIE-5.0-Preview-1022 已在 LMArena 大模型竞技场中位列全球第二、中国第一。

OpenAI 发布了 GPT-5.1,旨在让 ChatGPT 更智能、对话更愉快且易于定制。新模型分为 GPT-5.1 Instant 和 GPT-5.1 Thinking,前者具备自适应推理能力,后者能根据问题复杂度调整思考时间。此外,ChatGPT 新增 8 种聊天风格和个性化控制选项,并优化了心理健康评估功能,以应对用户情感依赖问题。GPT-5.1 将逐步向付费和免费用户推送,同时保留旧版模型供用户过渡。

Cursor 2.0 发布了自研编码模型 Composer 和新的多智能体界面。此前 Cursor 依赖第三方模型,此次更新标志着其从“AI 外壳”向“AI 原生平台”转变。Composer 是一款速度领先的前沿模型,生成速度是同类前沿系统的四倍,专为低延迟智能体式编码设计,通过强化学习优化,支持长上下文生成与理解,还被 Cursor 工程团队日常使用。Cursor 2.0 界面以智能体为中心,可并行运行多个智能体,还解决了代码评审与变更测试问题,基础设施上也进行了大量投入。

OpenAI 正式推出新一代视频生成模型 Sora 2,首次以独立 iOS 应用形式发布,支持 10 秒视频生成、个性化推荐流及互动功能。Sora 2 不仅实现视频与音频同步生成,还新增 “Cameo” 功能,允许用户创建虚拟分身参与视频创作。OpenAI 将其定位为 “超写实动作与声音” 的创作工具,同时强调版权合规与内容安全。此次转型标志着 AI 视频从技术炫技迈向日常内容生态。

通义千问在 AIME'25 和 HMMT 数学评测中首次以满分成绩亮相,推出 Qwen3-Max 旗舰模型,分为指令版和思考版,性能显著提升。同时开源视觉理解模型 Qwen3-VL 和全模态模型 Qwen3-Omni,覆盖文本、图像、音频和视频任务。此外,编程模型 Qwen3-Coder 升级,支持多模态输入,展现了强大的技术实力和开源速度。 

前往“AIWW”小程序,更好用