327483907 -6.97% 查看总趋势
一人手搓年度AI爆款 Moltbot!背后是复出的亿万富翁

AI 界开年最大黑马 Moltbot 横空出世,它并非来自硅谷巨头或初创公司,而是一位已实现财富自由的软件公司创始人 Peter Steinberger 独自在家开发的成果。这位身家过亿的开发者卖掉公司后躺平三年,去年复出专注 AI 研究,仅凭个人兴趣开发出这款能通过 WhatsApp 与电脑智能体交互的工具。项目爆火后 Discord 服务器被挤爆,还经历了改名风波,但 Peter 坚持开源精神,甚至考虑成立基金会而非公司来维护这个引发行业关注的创新产品。

生数科技推出Vidu主体社区,视频创作不再需要专业知识

生数科技近日推出 Vidu 主体社区,将复杂的视听语言 "打包" 成可一键调用的资产。用户只需敲一个 @符号,就能从运镜、构图、叙事、风格等八大类 200 多个预设主体中选择想要的效果,让 AI 自动完成专业视频创作。这一功能旨在解决普通用户创作 AI 视频的门槛问题,让不懂镜头语言的人也能轻松制作出具有电影感的短片。

民政部推动AI机器人进入养老照护领域

民政部最新指导意见明确将人形机器人、人工智能等前沿技术应用于养老服务。文件要求研发针对失能失智预防、生活照料、康复护理等关键技术装备,推动助餐助行、康复训练、情感陪伴等产品规模化应用。目标是通过技术装备与居家、社区、机构场景深度融合,形成全方位照护解决方案,并建立完整的养老服务技术标准体系。

MiniMax发布格莱美级AI音乐模型,消除中文洋味儿

MiniMax Music 2.5 发布,凭借格莱美级音质和极致拟真人声,开创 AI 音乐新标准。该模型不仅彻底消除中文演唱的洋味儿感,还支持 14 种以上结构标签精准控制,从大众到小众风格全覆盖。它让专业级叙事配乐触手可及,为影视、游戏和自媒体行业提供无版权风险的音乐创作工具,标志着 AI 音乐从娱乐玩具转向生产力工具。

阿里AI芯片真武上线,性能比肩英伟达H20

阿里巴巴平头哥正式推出高端 AI 芯片真武 810E,这款芯片采用 96GB HBM2e 内存和自研片间互联技术,互联带宽高达 700GB/s。该芯片已在阿里云实现多个万卡集群部署,服务国家电网、中科院等 400 多家客户。性能方面,真武 PPU 整体表现超过英伟达 A800 和主流国产 GPU,与英伟达 H20 相当,外媒报道称升级版性能甚至强于英伟达 A100。

Meta豪赌1690亿美元,AI竞赛进入万亿资本时代

Meta 宣布 2026 年将投入高达 1690 亿美元运营费用,其中资本支出达 1150-1350 亿美元,几乎是 2025 年的两倍。这意味着公司几乎将所有自由现金流投入 AI 基础设施,股价应声飙升 9%。这一举动标志着 AI 竞赛从技术比拼升级为资本耐力战,Meta 将元宇宙资源全面转向 AI,因为 AI 已直接推动其广告业务增长,形成了投入 - 增长 - 再投入的良性循环。

蚂蚁开源媲美谷歌的世界模型,具身智能未来可期

蚂蚁集团旗下的灵波科技深夜开源了名为 LingBot-World 的世界模型,其质量可对标谷歌 Genie 3。该模型最大特点是能实时生成交互式世界场景,用户通过方向键控制就能一边探索一边生成视频世界,具备稳定的长时记忆能力,无论怎么移动场景都不会 "崩坏"。这种可实时演算的世界模型不同于传统视频生成,更像是游戏模拟器,为具身智能的发展提供了关键基础设施。

豆包手机卷土重来,从被围剿到反围剿

字节跳动的豆包手机在经历首代产品被美团、微信、阿里等互联网巨头联合封锁后,正积极谋划卷土重来。第二代豆包手机预计 2026 年 Q2 发布,同时字节采取 “两条腿走路” 策略:一方面继续与中兴合作做硬件打样,另一方面以软件形式接入传音、魅族等 “others” 手机厂商,形成硬件联盟。字节的真正野心不是造手机,而是让豆包 AI 成为所有硬件的入口和标准配置。

AI音乐奇点已至,Mureka V8创作出难辨真伪的女团神曲

昆仑天工发布的 Mureka V8 AI 音乐系统实现了技术突破,其生成的流行音乐作品已能完美模仿顶级女团单曲的质感,让资深制作人也难以分辨。该系统通过创新的 MusiCoT 技术让 AI 像人类制作人一样思考音乐结构、和声逻辑和情绪铺陈,实现了从 “像音乐” 到 “是音乐” 的质变。Mureka V8 不仅在人声质感、旋律动听度和结构严谨性上达到专业水准,更开启了 “Vibe Music” 时代,让音乐创作门槛大幅降低,普通人也能通过 AI 表达情感。

腾讯开源AI图片编辑神器,一句话P图惊艳网友

腾讯混元图像 3.0 图生图版本正式开源,在全球图片编辑榜单中位列第七且是前七名中唯一的开源模型。这款 AI 工具支持增删改、风格变换、老照片修复等全面编辑功能,还能将多张照片元素合成新图。用户只需用一句话描述需求,就能快速生成电商海报、更换人物造型,甚至实现虚拟合拍,被网友称为 "终极 P 图神器",已在腾讯元宝平台上线供大家体验。

Gemini 3 Flash获得智能体视觉能力,用代码主动分析图像

谷歌为 Gemini 3 Flash 模型推出 Agentic Vision 能力,让 AI 能够通过编写和执行 Python 代码来主动操控图像。这个 “思考 - 行动 - 观察” 的闭环系统使模型不再被动接收像素,而是能根据需求裁剪、旋转、标注图像,甚至执行视觉数学计算。该技术将视觉理解从 “猜测” 变为 “深度调查”,在各类视觉基准测试中实现了 5% 到 10% 的性能提升,已通过 Google AI Studio 和 Vertex AI 的 Gemini API 向开发者开放。

AI投资新格局,北京稳居龙头,长三角群雄并起

2025 年中国 AI 投资市场呈现结构性变化,全年投资事件激增 75% 达 1579 起,创近五年新高。早期投资爆发式增长 90%,显示资本通过 "广撒网" 布局前沿赛道。北京以 405 起融资遥遥领先,深圳和上海紧随其后,长三角城市群协同效应凸显,苏州融资笔数同比大增 133%,形成 "研发 - 生产 - 应用" 的区域产业闭环。

前往“AIWW”小程序,更好用