2026年全球AI人工智能领域最前沿新闻资讯
我们会持续整理全球主流AI工具的重要更新,重点关注ChatGPT、Claude、Gemini、Grok、SuperGrok和Poe等产品的新模型、新功能、套餐变化及开放范围。欢迎收藏本页面,及时了解这些AI工具最近发生了哪些值得关注的变化。
2026年7月24日:Anthropic发布Claude Opus 5,重点提升长时间Agent任务、代码开发、复杂分析和办公文件处理能力。该模型同步进入Claude网页端、Claude Code和API,并成为Claude Max的默认模型,Claude Pro用户也可以使用。
2026年7月24日:xAI推出Grok的Google Workspace插件,用户可以直接在Google Docs、Google Sheets和Google Slides中调用Grok。它能够分析表格、编写公式、调整文档和制作演示文稿,还可以通过连接器读取Google Drive文件与近期邮件。
2026年7月21日:Google发布Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和Gemini 3.5 Flash Cyber。三款模型分别面向复杂Agent任务、低成本高频处理和网络安全场景,其中Cyber版本初期只向可信机构限量开放。
2026年7月16日:xAI正式发布Grok 4.5,重点加强代码开发、多步骤Agent任务和专业知识处理能力。该模型成为Grok Build的默认模型,并陆续开放到grok.com、X、iOS、Android和API。
2026年7月16日:Grok上线Automations自动化任务功能,用户设置一次任务后,它就可以按天、按周或按月自动运行,也可以在收到符合条件的邮件后立即处理。定时任务向所有用户开放,邮件触发功能包含在SuperGrok会员中。
2026年7月9日:OpenAI开始推出GPT-5.6 Sol,这是面向复杂代码、研究、科学、网络安全、电脑操作和设计任务的旗舰推理模型。该模型主要向符合条件的ChatGPT付费套餐开放,Free和Go用户暂时无法使用。
2026年7月9日:OpenAI在ChatGPT中推出Work任务模式,用户可以把文件、资料和具体目标交给ChatGPT,让它在较长时间内持续处理并返回完整结果。该功能进一步强化了ChatGPT执行多步骤任务的能力。
2026年7月8日:OpenAI发布GPT-Live,并升级ChatGPT的实时语音体验。新版本更加重视自然打断、连续对话、语气理解和复杂口头指令,让语音交流更接近正常聊天。
2026年7月1日:xAI推出Voice Agent Builder测试版,用户不用写代码就能配置基于Grok Voice的语音Agent。平台整合了电话接入、知识库、工具调用、MCP、人工转接和通话记录等功能。
2026年6月30日:Anthropic发布Claude Sonnet 5,重点提升代码开发、工具调用、复杂推理和长流程任务表现。该模型面向Claude应用、Claude Code和API开放,成为Sonnet系列的新一代主力版本。
2026年6月30日:Google把Gemini Spark带到macOS,并增加Canva、Dropbox、OpenTable等连接应用。用户可以让Spark整理本地文件、调用Google Workspace资料,还能持续追踪新闻、体育、金融和其他实时变化。
2026年6月30日:Google发布Nano Banana 2 Lite,并向开发者开放Gemini Omni Flash。前者主打更快、更低成本的图片生成,后者支持根据文字、图片、音频和视频创建或连续修改视频。
2026年6月16日:xAI推出Grok Imagine Video 1.5,进一步提升视频画质、动作连贯性和生成速度。Fast模式可以更快生成720p短视频,适合需要反复尝试和快速修改的创作场景。
2026年6月9日:Anthropic发布Claude Fable 5和Claude Mythos 5。Fable 5面向普通用户和开发者开放,重点处理复杂代码、研究和长时间Agent任务;Mythos 5则面向经过审核的网络安全使用场景。
2026年5月28日:Anthropic发布Claude Opus 4.8,继续加强复杂代码、科学研究、专业分析和长时间任务能力。该模型进入Claude应用、Claude Code和API,为高难度任务提供了新的Opus选择。
2026年5月19日:Google在I/O大会上发布Gemini Omni和Gemini 3.5 Flash,并让Gemini应用加入Gemini Spark、Daily Brief等主动执行功能。Gemini开始从回答问题进一步转向持续处理任务、生成多媒体内容和调用外部服务。
2026年5月6日:xAI为Grok推出连接器功能,可以读取Google Drive、OneDrive、Dropbox、Notion、Slack等服务中的资料。用户不需要反复上传文件,就能让Grok结合自己的工作内容回答问题和完成任务。
2026年4月23日:OpenAI发布GPT-5.5,并同步推出GPT-5.5 Thinking和GPT-5.5 Pro。新模型重点提升代码、电脑操作、在线研究、数据分析和办公文件制作能力,面向ChatGPT、Codex和API逐步开放。
2026年4月16日:Anthropic发布Claude Opus 4.7,重点改进长时间代码任务、工具使用、电脑操作和复杂研究能力。该模型同步进入Claude应用、Claude Code和API。
2026年3月5日:OpenAI发布GPT-5.4和GPT-5.4 Pro,并在ChatGPT、Codex和API中开放。GPT-5.4加强了代码、电脑操作、深度搜索和办公文件处理,同时支持最高100万Token上下文。
2026年2月17日:Anthropic发布Claude Sonnet 4.6,继续提升代码开发、工具调用、电脑操作和指令理解能力。该模型面向Claude应用、Claude Code和API开放,适合日常高频任务。
2026年2月5日:Anthropic发布Claude Opus 4.6,重点加强复杂代码、长时间Agent任务、研究分析和专业内容处理。用户可以在Claude网页端、Claude Code和API中使用。
2026年2月5日:OpenAI推出GPT-5.3-Codex,把代码生成、推理和通用任务能力整合到同一款Codex模型中。它可以持续处理大型代码库、运行工具并完成时间更长的软件开发任务。
2026年1月28日:xAI开放Grok Imagine API,开发者可以调用Grok完成带声音的视频生成、视频编辑和图片创作。该服务把Grok的多媒体生成能力从应用端扩展到了第三方程序。
2025年12月11日:OpenAI发布GPT-5.2系列,并向ChatGPT和API用户逐步开放Instant、Thinking和Pro版本。新模型重点改进长上下文理解、工具调用、代码开发、视觉分析和复杂专业任务。
2025年12月4日:Google在Gemini应用中正式开放Gemini 3 Deep Think,面向Google AI Ultra用户提供。这个模式会同时探索多种推理路径,更适合处理数学、科学和逻辑类难题。
2025年11月24日:Anthropic发布Claude Opus 4.5,并把API价格调整为每百万输入Token 5美元、输出Token 25美元。新版本重点加强代码、Agent、电脑操作、深度研究以及表格和演示文稿处理。
2025年11月18日:Google正式发布Gemini 3,并先推出Gemini 3 Pro预览版。该模型进入Gemini应用、Google搜索、AI Studio、Vertex AI和Google Antigravity,重点提升推理、多模态理解、代码开发和任务执行。
2025年11月17日:xAI发布Grok 4.1,并向grok.com、X、iOS和Android用户开放。新版本加强了对话自然度、情绪理解、内容创作和指令执行,并可以在模型选择器中直接使用。
2025年11月17日:Poe向所有用户推出群聊功能,最多可以让200名参与者和多个AI模型进入同一个对话。群聊会共享上下文,适合一起规划、讨论、创作或调用不同模型处理同一项任务。
2025年11月12日:OpenAI发布GPT-5.1 Instant和GPT-5.1 Thinking。Instant版本更重视自然交流和指令理解,Thinking版本会根据问题难度调整推理时间,两者都开始进入ChatGPT。
2025年10月15日:Anthropic发布Claude Haiku 4.5,主打更快响应、更低成本和较强的代码能力。该模型面向Claude应用和API开放,适合需要大量、快速处理请求的场景。
2025年10月10日:Poe改用更加透明的美元定价,并为API加入工具调用能力。订阅用户在积分不足时可以单独购买额外积分,开发者也能通过一个API接入Poe中的多种模型。
2025年9月30日:OpenAI发布Sora 2,并推出新的Sora应用。Sora 2加强了物理规律、动作连续性、画面控制和同步音频生成,用户还可以通过Cameos功能把授权人物形象加入视频。
2025年9月29日:Anthropic发布Claude Sonnet 4.5,重点提升代码、电脑操作、工具调用和长时间Agent任务。该版本进入Claude应用、Claude Code和API,并带来更完整的代码执行和文件处理能力。
2025年8月7日:OpenAI发布GPT-5,并把它设为ChatGPT的新一代默认模型系统。免费用户可以使用基础额度,Plus用户获得更高限额,Pro用户还可以使用面向高难度任务的GPT-5 Pro。
2025年8月5日:Anthropic发布Claude Opus 4.1,主要改进代码开发、复杂推理、研究分析和长时间任务表现。该模型同步进入Claude应用、Claude Code和API。
2025年8月1日:Google向Google AI Ultra用户开放Gemini 2.5 Deep Think。这个模式会并行考虑多种解题方向,再整合出最终答案,重点面向数学、代码和复杂推理任务。
2025年7月31日:Poe正式推出统一API,开发者可以通过兼容OpenAI的接口调用Poe中的文字、图片、视频和音频模型。现有Poe订阅积分也可以直接用于Cursor、Cline等外部工具。
2025年7月17日:OpenAI推出ChatGPT agent,把Deep Research和Operator的能力整合进ChatGPT。用户可以让它浏览网页、运行代码、使用终端和调用外部工具,连续完成研究、整理和操作类任务。
2025年7月9日:xAI发布Grok 4,并同步推出推理能力更高的Grok 4 Heavy。模型首先向SuperGrok和X Premium+用户开放,重点提升复杂推理、代码、数学和实时搜索能力。
2025年6月17日:Google推出Gemini 2.5 Pro和Gemini 2.5 Flash稳定版,同时发布Gemini 2.5 Flash-Lite预览版。三款模型分别覆盖高能力、速度与成本平衡以及大规模低成本处理场景。
2025年5月22日:Anthropic发布Claude Opus 4和Claude Sonnet 4,并同步升级Claude Code。两款模型强化了代码、工具调用、长时间任务和复杂推理,还支持在思考过程中调用外部工具。
2025年5月20日:Google在Gemini应用中加入Veo 3视频生成、Gemini Live摄像头和屏幕共享、Deep Research升级以及Gemini in Chrome。Google同时推出Google AI Pro和Google AI Ultra两档订阅。
2025年5月16日:OpenAI推出Codex云端代码Agent,用户可以让它在隔离环境中读取代码、运行测试、修复问题和提交修改。Codex先向Pro、Business和Enterprise用户开放,之后扩展到Plus用户。
2025年4月16日:OpenAI正式发布o3和o4-mini,并将两款推理模型加入ChatGPT和API。它们可以在推理过程中调用网页搜索、Python、文件分析和图片理解等工具,更适合复杂的多步骤问题。
2025年4月15日:Anthropic为Claude推出Research功能和Google Workspace连接。Claude可以搜索网络,并结合Gmail、Google Calendar和Google Drive中的资料生成带引用的研究结果。
2025年3月25日:OpenAI把原生图片生成能力整合进GPT-4o,并面向Free、Plus、Pro和Team用户逐步开放。用户可以直接在聊天中生成、修改图片,并通过连续对话调整文字、人物和画面细节。
2025年3月25日:Google发布Gemini 2.5 Pro实验版,并在Gemini应用和Google AI Studio中开放。该模型把推理过程作为默认能力,重点提升数学、代码、多模态理解和长上下文任务。
2025年3月18日:Google为Gemini推出Canvas和Audio Overview。Canvas可以在独立区域中修改文档与代码,Audio Overview则能把上传的资料整理成双人播客式音频。
2025年2月27日:OpenAI发布GPT-4.5研究预览版,并先向ChatGPT Pro用户开放。新模型更加重视自然交流、知识覆盖、写作质量和对用户意图的理解,之后扩展到更多付费套餐和API。
2025年2月25日:Poe推出Poe Apps,用户可以通过提示词和AI模型快速制作带界面的互动应用。创建完成后可以直接分享给其他用户使用,并能够组合Poe平台中的不同模型和机器人。
2025年2月24日:Anthropic发布Claude 3.7 Sonnet,并同步推出Claude Code测试版。Claude 3.7 Sonnet可以在快速回答和扩展思考之间切换,Claude Code则能在终端中读取项目、修改代码和运行命令。
2025年2月2日:OpenAI推出ChatGPT Deep Research,用户提交任务后,它可以自主搜索、阅读和整合大量网络资料,再生成带来源的完整报告。该功能先向Pro用户开放,之后逐步覆盖其他套餐。
2025年1月23日:OpenAI发布Operator研究预览版,让AI可以像用户一样在浏览器中点击、输入和滚动页面。它能够处理订餐、填写表格和在线购买等任务,最初面向美国ChatGPT Pro用户开放。
2024年12月12日:xAI开始向所有X用户免费开放Grok,并同步升级Grok-2、网页搜索、引用和多语言能力。付费用户拥有更高使用限额,同时Grok也加入了Aurora图片生成和帖子分析功能。
2024年12月11日:Google发布Gemini 2.0 Flash实验版,并在Gemini Advanced中推出Deep Research。新模型加强实时多模态交互和工具调用,Deep Research则可以自动规划搜索并整理网络资料。
2024年12月9日:OpenAI正式开放Sora Turbo,并通过Sora.com向ChatGPT Plus和Pro用户提供。用户可以根据文字或图片生成视频,Pro套餐拥有更高分辨率、更多并发任务和无水印下载额度。
2024年12月5日:OpenAI发布完整版o1,并推出每月200美元的ChatGPT Pro套餐。Pro用户可以使用o1 pro mode、GPT-4o、Advanced Voice等高额度能力,适合需要高频处理复杂问题的用户。
2024年10月31日:OpenAI正式推出ChatGPT Search,ChatGPT可以搜索最新网页并在回答中展示来源。该功能先向Plus和Team用户开放,之后逐步扩展到免费用户和未登录用户。
2024年10月22日:Anthropic升级Claude 3.5 Sonnet,并推出Claude 3.5 Haiku和Computer Use测试功能。开发者可以让Claude查看电脑画面、移动鼠标、点击按钮和输入文字,开始处理图形界面中的任务。
2024年10月3日:OpenAI推出ChatGPT Canvas测试版,为写作和代码项目增加独立编辑区域。用户可以选中局部内容让ChatGPT修改,也可以直接在同一界面中继续编辑和调整。
2024年9月12日:OpenAI发布o1-preview和o1-mini,这是专门加强复杂推理的新模型系列。两款模型先向ChatGPT Plus和Team用户开放,在数学、科学和代码问题上会花更多时间分析后再回答。
2024年8月13日:xAI发布Grok-2和Grok-2 mini测试版,并向X Premium和Premium+用户开放。新模型提升了聊天、代码、推理和视觉理解,同时首次在Grok中加入图片生成功能。
2024年8月13日:Google正式推出Gemini Live,并先向Android端Gemini Advanced用户开放。用户可以用自然语音持续对话、随时打断回答,还能在多个声音之间选择。
2024年7月18日:OpenAI发布GPT-4o mini,主打更低成本和更快响应,并在ChatGPT中替代GPT-3.5成为免费用户的轻量模型。它支持文字和视觉输入,也通过API向开发者开放。
2024年6月21日:Anthropic发布Claude 3.5 Sonnet,并同步推出Artifacts。用户生成代码、文档或网页时,可以在聊天旁边的独立窗口中预览、修改和继续完善内容。
2024年5月14日:Google把Gemini 1.5 Pro加入Gemini Advanced,并提供最高100万Token上下文。用户可以上传长文档、代码库、视频和Google Drive文件,让Gemini在大量内容中查找和整理信息。
2024年5月13日:OpenAI发布GPT-4o,把文字、图片和语音能力整合进同一款模型。GPT-4o开始向免费用户开放,Plus用户获得更高限额,实时语音和视觉能力随后分阶段上线。
2024年3月4日:Anthropic发布Claude 3模型家族,包括Opus、Sonnet和Haiku。三款模型支持图片理解、最高200K上下文和更强的工具使用能力,分别覆盖高能力、平衡和快速低成本场景。
2024年2月15日:Google发布Gemini 1.5 Pro,并展示最高100万Token的长上下文能力。该模型可以一次处理长文档、大型代码库、长视频和大量音频,最初向开发者及企业用户限量开放。
2024年2月8日:Google把Bard正式更名为Gemini,并推出使用Ultra 1.0的Gemini Advanced。Android端同时上线独立应用,iOS用户可以通过Google应用调用Gemini,Google One AI Premium套餐定价为每月19.99美元。
2024年1月10日:OpenAI正式开放GPT Store,并同步推出ChatGPT Team套餐。Plus、Team和Enterprise用户可以查找社区创建的GPT,团队用户则获得独立工作区、更高使用额度和管理功能。
2023年12月6日:Google正式发布Gemini 1.0模型家族,包括Ultra、Pro和Nano。Gemini Pro开始进入Bard,Gemini Nano用于部分手机端功能,Gemini Ultra则为后续Gemini Advanced做准备。
2023年11月21日:Anthropic发布Claude 2.1,将上下文窗口提升到200K,并降低模型在长文档中生成错误信息的概率。新版本还加入系统提示词和工具调用测试功能,进入Claude网页端和API。
2023年11月6日:OpenAI在首届开发者大会上发布GPT-4 Turbo、Assistants API和可自定义的GPTs。用户不需要写代码就能为特定用途创建ChatGPT版本,开发者则可以使用更长上下文和新的工具接口。
2023年11月3日:xAI首次公布Grok,并向部分X Premium+用户开放早期测试。Grok可以结合X平台的实时内容回答问题,这也成为xAI正式进入通用AI助手市场的起点。
2023年10月28日:Poe推出创作者变现计划,机器人作者可以根据用户订阅和使用情况获得收入。这个变化让Poe从单纯的模型聚合平台进一步加入自定义机器人创作和商业化能力。
2023年9月25日:OpenAI为ChatGPT加入语音对话和图片理解能力。用户可以直接说话与ChatGPT交流,也可以上传照片、文档或界面图片,让它识别内容并继续讨论。
2023年9月19日:Google推出Bard Extensions,让Bard可以调用Gmail、Google Docs、Google Drive、Google Maps、YouTube以及航班和酒店信息。用户可以在一次对话中整合多个Google服务中的内容。
2023年9月7日:Anthropic正式推出Claude Pro订阅,价格为每月20美元。付费用户获得更高使用额度、高峰期优先访问和新功能优先体验资格。
2023年7月11日:Anthropic发布Claude 2,并通过claude.ai向美国和英国用户开放公开测试。Claude 2提升了代码、推理和长文档处理能力,并支持最高100K上下文。
2023年3月23日:OpenAI开始测试ChatGPT插件,允许ChatGPT连接第三方服务、搜索网页、运行代码和调用外部数据。插件让ChatGPT首次能够突破纯聊天界面,执行更多实时任务。
2023年3月21日:Google面向美国和英国用户开放Bard早期测试。Bard可以回答问题、解释概念和协助写作,Google随后逐步增加语言、地区和更多产品能力。
2023年3月14日:OpenAI正式发布GPT-4,并向ChatGPT Plus用户和API开发者开放。GPT-4在复杂推理、指令理解和图片输入方面明显升级,也成为ChatGPT后续多项高级功能的基础。
2023年3月14日:Anthropic正式推出Claude和Claude Instant。Claude强调长文本理解、写作、总结和对话能力,Claude Instant则主打更快响应和更低使用成本。
2023年2月1日:OpenAI推出ChatGPT Plus订阅,价格为每月20美元。付费用户可以在高峰期优先使用ChatGPT,并获得更快响应和新功能优先体验资格。
2022年11月30日:OpenAI正式推出ChatGPT研究预览版,并免费向公众开放。它采用对话形式理解连续问题、修改答案和承认部分错误,随后迅速成为普通用户接触生成式AI的重要入口。
