AI行业指数
AI行业简讯
阿里云宣布6月30日升级Qwen-Plus和Qwen-Turbo至Qwen3系列,支持思考/非思考模式切换。Plus版推理能力超越QwQ,Turbo版以更小参数比肩QwQ-32B。用户可提前体验新版模型(如qwen-plus-2025-04-28),旧版快照模型(如qwen-Plus-2025-01-25)将在6月30日后停用。
阿里开源Qwen3系列,包含8款模型(如MoE架构的Qwen3-235B-A22B和Dense架构的Qwen3-32B),预训练数据达36万亿tokens,支持119种语言。首次引入“思考模式”(分步推理)和“非思考模式”(快速响应),在数学、代码等任务中媲美DeepSeek-R1、Gemini-2.5-Pro等顶尖模型。通义App及网页版同步升级,优化交互体验。
阿里推出首款“达芬奇”级视觉推理模型QVQ-Max,实现从“感知”到“认知”的跨越。该模型具备纳米级细节识别(如0.1mm肿瘤病灶检测)、多模态深度推理(如事故现场还原)及跨领域创意生成(如草图转3D设计)。在金融风控、医疗筛查等场景落地,视频理解速度比国际竞品快30%,并已集成至淘宝商品审核系统,日处理百万级图片。
阿里云在农历新年大年初一正式发布Qwen2.5-Max,采用超大规模MoE(混合专家)架构,预训练数据超过20万亿tokens,支持29种语言及多模态交互(如图像解析、视频理解)。该模型在Arena-Hard、LiveBench等11项基准测试中超越DeepSeek V3、Llama-3.1-405B等开源模型,部分指标接近GPT-4o和Claude-3.5-Sonnet。适用于教育、医疗、金融等多个行业,并开放免费体验及商业化API调用。
Manus结束邀请制,向所有用户开放注册,每日免费提供300积分(1次任务),新用户获1000积分奖励。同时推出三档订阅服务(19/39/199美元/月),提供更高权限与优先支持,加速商业化进程。
Manus母公司Butterfly Effect完成由Benchmark领投的融资,估值较前一轮增长5倍。资金将用于全球化扩张(如日本、中东市场)及算力优化,以应对服务器负载过高的问题。
为降低对海外模型(如Claude)的依赖,Manus宣布与阿里云合作,基于国产开源模型优化算力支持。此前两周,仅Claude模型调用成本已超100万美元,此举显著降低运营成本并提升本地化能力。
Manus作为全球首款通用AI Agent正式发布,具备自主执行复杂任务的能力,如市场调研、旅行规划、数据分析等。其核心突破在于“思考-规划-执行”闭环系统,支持跨平台工具调用(如代码执行、文件处理)。在GAIA基准测试中,Manus性能超越OpenAI同类产品,引发科技圈广泛关注。初期采用邀请制,邀请码一度被炒至高价。
推出智能体开发平台,集成插件系统、知识库和数据库记忆功能。支持零代码构建对话式AI应用,典型场景包括智能客服、虚拟伴侣等,首周创建量达50万+
升级视频生成能力,支持通过工作流批量产出历史故事视频。用户输入关键词如"草船借箭"即可自动生成脚本、分镜及成品视频,日均生成量突破10万条。
扣子平台对计费体系进行全新升级,取消按次收取的智能体调用费,已注册的基础版和专业版用户不受影响。此次升级旨在提升产品体验,满足不同用户的多样化需求,为商业化进程奠定基础。
扣子平台进行全面UI升级,首页布局清爽化,新增模板功能,提供营销创作、信息处理等六大类共30个模板资源,支持一键复制与编辑。同时整合个人空间与团队空间为工作空间,新增资源库页面整合插件、工作流等组件,并推出全局小助手。
发布Canva Studio实时协作平台,支持50人协同编辑视频/3D项目。革命性加入语音控制系统,用户可用自然语言指令完成复杂操作(如"把LOGO放大并移到右下角"),响应延迟低于0.3秒。
扣子(Coze)是由字节跳动推出的新一代AI应用开发平台,该平台旨在让非开发者也能快速创建、调试和优化聊天机器人,支持零代码或低代码方式快速搭建基于大模型的各类AI应用,并将这些应用发布到社交平台、通讯软件,或通过API和SDK集成到业务系统中。
发布Visual Worksuite企业套件,新增3D设计工具和AR实时预览功能。重点解决产品包装/空间设计需求,支持将平面设计一键转换为三维模型,并可通过手机扫描查看虚拟实物效果,被2000+零售品牌采用。
上线AI设计系统Magic Design,集成GPT-3文案生成和Stable Diffusion图片生成能力。用户输入文字描述可自动生成完整设计方案(含排版/配色/配图),首批开放社交媒体海报等8个场景,首周生成量突破500万份。
发布视频编辑器功能,整合5000+视频模板与200万+版权素材库,支持1080P导出和自动字幕生成。创新性地引入"拖拽时间轴"交互设计,用户可通过简单拖放完成剪辑/转场/配乐,视频制作效率提升300%。
Canva可画在洛杉矶发布视觉套件2.0,这是其史上规模最大的产品更新。新增全能画布功能,支持在同一界面创建文档、演示文稿乃至网站;推出Canva可画工作表,重新定义电子表格,实现数据可视化与智能化;AI图表功能可一键将复杂数据转化为动态视觉内容;AI批量生成支持大规模个性化内容创作。
一对夫妇因男方无精症 18 年未能怀孕,最终通过哥伦比亚大学生育中心的 STAR AI 系统成功受孕。该系统仅用一小时分析 800 万张图像,找到 3 条隐藏精子,并通过体外受精实现怀孕。相比传统手术或激素治疗,STAR 更高效、舒适且成本低(约 3000 美元)。同时,研究显示微塑料污染普遍存在于人类精液和卵泡液中,可能影响生育健康,而 STAR 技术有望缓解环境因素导致的生育难题。
即梦AI 1.4.1版本更新,接入DeepSeek R1满血版技术,优化灵感词汇生成并强化动态视频创作能力。此次升级通过技术融合进一步提升了视频生成的流畅性与创意自由度。
即梦AI全新图片模型2.1正式上线,同时推出动态海报功能,支持静态海报一键转换动态效果。此次升级显著提升了图片生成质量,并拓展了海报设计的创意表现形式。
剪映Dreamina正式更名为中文“即梦”,AI作图和视频生成功能全量上线,标志着即梦AI作为独立品牌正式进入市场,为用户提供AI图片与视频创作服务。
推出正版集成平台,新增智能画布功能(局部重绘/扩图/抠图)、视频生成能力和故事创作模式,支持从文字描述到可视化内容的一站式转化,构建包含图片/视频/社区交互的完整创作生态。
即梦3.0全量上线,核心突破包括支持2K分辨率影视级画质、中文小字稳定性优化及艺术字体生成,新增动态特效控制和消除笔工具,在电商广告、影视概念设计等领域确立差异化优势。
即梦2.1版本上线,首次实现AI绘画直出中文字功能,支持通过简单指令指定字号、字体、颜色和位置生成含中文文本的图像,解决了AI生成中文图像的行业难题,大幅提升海报设计效率和应用场景适应性
Meta 从苹果挖走负责基础模型团队的华人高管庞若鸣(Ruoming Pang),其薪酬包价值数千万美元。庞若鸣是上海交大校友,曾领导苹果自研 AI 模型团队。Meta 近期还从 OpenAI、Anthropic 等公司挖走多名顶尖 AI 人才,包括 7 位华人工程师,组建 “超级智能实验室”。苹果因内部战略调整和外部挖角,AI 团队士气低迷,面临人才流失危机。扎克伯格亲自参与招聘,Meta 计划投入数百亿美元推动 AI 研发。
一键调用代码模版组件,覆盖实用工具、排版设计和互动娱乐场景,轻松实现多种创意玩法。实时预览让你的想法「所见即所得」,边改边看高效直观又灵活,支持导出HTML文件或生成链接直接分享。
百度在 Create2025 大会上推出文心大模型 4.5 Turbo 和 X1 Turbo,性能更强、成本更低,其中 4.5 Turbo 价格下降 80%,X1 Turbo 价格降 50%。同时发布高说服力数字人、多智能体协作 APP “心响” 及内容操作系统 “沧舟 OS” 等 AI 应用,覆盖电商、法律咨询等场景。
语音转文字,让重点信息一目了然。支持mp3/wav/m4a等音频格式,还能智能划重点,一键总结结构化摘要。告别繁琐手动整理,提升工作学习效率。
百度在 WAVE SUMMIT 2024 大会上正式推出文心大模型 4.0 Turbo,显著提升响应速度与生成效果。实测显示,其生成千字长文仅需 20 秒,在时事新闻、专业知识问答、多文档处理及代码开发等场景表现优异。
文心一言App升级为"文小言",新增富媒体搜索、多模态输入、文本与图片创作、高拟真数字人等AI能力,重新定义新搜索体验。9月内开放文心4.0大模型免费使用,提供问问题、陪聊天、写文章等五大核心场景能力。
文心一言宣布全面免费开放,所有用户可体验文心系列最新模型,包括超长文档处理、专业检索增强、高级AI绘画等功能。同时上线深度搜索功能,具备专家级内容回复和多场景任务处理能力,支持多模态输入输出。
文心一言网页端产品发布。
ChatGPT整合DALL·E 3,支持文本生成图像,用户可通过对话直接生成精确图像,Plus及企业用户优先使用,增强多模态交互体验。
OpenAI 推出 GPT-4.1 系列,包括 GPT-4.1、GPT-4.1 mini 和 GPT-4.1 nano 三款模型,支持长达 100 万 Token 的上下文窗口,在编程、指令遵循和多轮对话中表现优异。其中 GPT-4.1 nano 以 “最快、最便宜” 为亮点,适合低延迟需求。该系列已开放 API,价格亲民,并在多项基准测试中超越前代,为开发者提供更强大的 AI 工具。
ChatGPT 引入插件功能,允许接入第三方服务,实现实时信息查询、代码执行等扩展,提升实用性和灵活性。
微软在 Azure AI Foundry 中上线 Deep Research 公开预览版,该智能体基于 OpenAI 的 o3 模型,结合必应搜索能力,可自动化完成复杂研究任务。它能拆解问题、抓取权威信息、生成结构化报告,并记录推理路径,适用于学术、金融、医疗等领域。微软还开放了 API,支持开发者将其集成到应用中,提升多智能体协作效率。
推出GPT-4o(Omni)模型,支持文本、语音、图像多模态交互,响应速度提升2倍,在编程、写作等任务中全面超越GPT-4,成为新一代旗舰模型。
推出GPT-4多模态模型,支持图像输入和文本输出,在学术基准测试中全面超越GPT-3.5,并面向Plus用户开放,实现了更复杂的推理和创作能力。
ChatGPT正式发布,基于GPT-3.5模型,支持对话式交互,可完成文本生成、代码编写等任务,成为全球最快达到1亿用户的产品之一。
Kimi发布Kimi-Dev-72B编程大模型,仅72B参数就在SWE-bench测试中以42.3%得分超越671B参数的竞品,成为全球开源模型第一。
Kimi推出K1.5推理模型,支持图像和文本的多模态综合推理,数学问题准确率提升40%,编程任务完成率达89.3%,图像分析准确率超92%。
Kimi智能助手正式发布,成为全球首个支持20万汉字无损上下文输入的智能助手产品,主要应用于学术论文翻译、法律问题分析等专业场景,引发了"Kimi概念股"的市场热潮。
Kimi推出v7.5.6.701版本,新增拍照搜题、文档翻译等学习工具,强化了AI学习辅助功能。
Kimi发布moonshot-v1-20240416版本,显著提升联网模式下的首字返回速度,增强了逻辑推理和编程能力。同时新增语音输入/播报功能,网页版支持添加常用语提示词。
Kimi支持200万字超长无损上下文输入,相比最初版本提升了10倍。这一升级使Kimi能够处理更复杂的任务,如学习整部《甄嬛传》剧本后讨论剧情,或阅读《中医内科学》后提供诊疗建议。
夸克网盘v7.13.6.861发布,支持与极空间NAS联动,实现网盘备份及Docker远程访问,强化存储生态整合能力。
夸克上线“高考志愿咨询”功能,基于AI分析考生成绩和兴趣,生成个性化志愿方案,累计为考生提供超1000万份专业报告。
夸克新增“拍照问夸克”功能,支持上传图片识别物体、表格、文物等,并关联相关问题(如淘宝同款链接、历史背景),可一次性上传10张图片进行深度推理。
夸克上线“深度思考”功能,基于阿里通义大模型,突破传统关键词搜索限制,通过“问题解析-信息精读-知识融合”三步模式,为用户提供结构化解决方案,覆盖学习、医疗、旅游等多领域需求。
夸克推出“AI超级框”功能,从传统搜索引擎向全能型AI助手转型。升级后的夸克整合了AI对话、深度思考、深度搜索、深度研究、深度执行五大能力,涵盖AI写作、AI生图、AI PPT生成、学术研究、健康问答等场景。
腾讯元宝“高考志愿咨询”能力正式上线。用户在元宝手机端、电脑版、网页版升级到最新版本,选择任意模型,开启深度思考,提问志愿填报相关问题,元宝会自动触发深度搜索,提交专属深度建议。
腾讯 AI 助手 “腾讯元宝” 迎来更新,整合混元和 DeepSeek-R1 671B 满血版两大模型,用户可免费使用 DeepSeek 的联网搜索功能,覆盖微信公众号等腾讯生态内容及权威信源。
基于混元大模型1.5版本,正式推出面向用户的应用端“腾讯元宝”(原名“混元助手”),提供AI对话、文本生成、知识问答等核心功能。
腾讯首次公布自研通用大模型“混元”,参数规模达千亿级,覆盖文本生成、逻辑推理、多轮对话等核心能力,支持中文及多语言处理,为后续应用(包括腾讯元宝)提供底层技术支撑。
2025 年上半年,美国 AI 初创公司融资势头强劲,多家企业完成超 1 亿美元融资。其中,OpenAI 以 400 亿美元融资创纪录,估值达 3000 亿美元;Anthropic 完成 35 亿美元 E 轮融资,估值 615 亿美元。其他亮点包括企业搜索公司 Glean(1.5 亿美元)、AI 编程工具 Cursor(9 亿美元)及视频生成平台 Runway(3.08 亿美元)。AI 赛道持续受资本青睐,覆盖基础设施、医疗、法律等多个领域。
只需你给出一个主题、一种风格和情绪,豆包就能像一位才华横溢的音乐家,为你创作出一首完整的、独具匠心的音乐作品。
现在可以在电脑上通过「语音通话」功能与豆包语音对话了!点击首页输入框右侧入口即可开启。通话过程中,豆包还能实时联网搜索最新信息,确保提供更精准的回答。
