Offering Zero Data Retention for frontier models
OpenAI reaffirms Zero Data Retention for eligible API customers and previews Private Safety Processing for advanced AI safety without compromising data privacy.
中文翻译待同步,当前显示官方原文。
站内阅读每天整理 GPT、Claude 与 Gemini 的产品、API 和模型更新。
178 条动态 / 持续同步官方来源
OpenAI reaffirms Zero Data Retention for eligible API customers and previews Private Safety Processing for advanced AI safety without compromising data privacy.
中文翻译待同步,当前显示官方原文。
站内阅读Replit introduces Free Mode, powered by GPT-5.6 Luna, so anyone can turn ideas into working software without worrying about token costs.
中文翻译待同步,当前显示官方原文。
站内阅读The Admin API user-management endpoints for Claude Enterprise (claude.ai) organizations (members, invites, groups, and custom roles) are now generally available. The anthropic-beta: ce-user-management-2026-07-13 header is no longer required on group and custom-role requests; requests that still send it are accepted unchanged. See User management. The Files API is now generally available on the Claude API. Requests to the /v1/files endpoints, and Messages API requests that reference an uploaded file, no longer require the files-api-2025-04-14 beta header. Requests sent without the header use the GA response format: file expiration (set expires_in_seconds when you upload a file; file objects report expires_at), and page and next_page pagination plus an ids[] filter when you list files. Storage is 1 TB per organization and the rate limit is 500 requests per minute. /v1/files requests that still send the beta header keep working and return the previous response format. Agent Skills and the Skills API (/v1/skills) are now generally available on the Claude API. Requests no longer require the skills-2025-10-02 beta header, including Messages API requests that load Skills through the container parameter. Requests that still send the header continue to work unchanged. See Using Agent Skills with the API. You can now restrict which sites a Claude Managed Agents agent's web_search and web_fetch tools can reach. Set allowed_domains or blocked_domains on the tool's entry in the agent_toolset_20260401 configs array; web_fetch also accepts max_content_tokens and web_search accepts user_location. Each configs entry is identified by its name and typed by an optional type, and requests that pass only name, enabled, and permission_policy continue to work; in the typed SDKs, configs entries become per-tool types. See Restrict web search and web fetch domains. Claude Managed Agents sessions that run in a self-hosted sandbox can now attach memory stores. The Python, TypeScript, and Go SDK workers download each attached store into the sandbox at its mount_path and sync the agent's changes back to the store. See Use memory stores. The session viewer in the Claude Console has been redesigned with a timeline minimap, a transcript grouped by model request, and an Inspector panel for session details and cost, raw events, per-tool statistics, mounted resources, and per-thread activity. See Console observability.
中文翻译待同步,当前显示官方原文。
站内阅读A new dedicated student hub, study notebooks on mobile, one year of Google AI Pro in the US, or Google AI Plus in 140+ countries at no cost. What: We’re introducing a dedicated student hub in the Gemini app to help students easily manage classes and create personalized study notebooks from their own course materials like syllabi. Study notebooks—first launched on desktop in June—are now available on mobile to help students get organized, prepare for class and stay on top of their material. Plus, eligible college students can get one year of Google AI Pro in the US, or Google AI Plus in 140+ countries at no cost. Why: By bringing study notebooks to mobile, creating a centralized student hub, and providing a student plan, we are helping students learn with a personalized study partner. Eligible students only. Offer Terms apply. Redeem until December 31, 2026. Automatically renews at the standard monthly price for the applicable Google AI Plan included in your Offer. Cancel anytime.
中文翻译待同步,当前显示官方原文。
站内阅读ChatGPT Ads is expanding to 31 European markets. Learn how advertisers can reach people as they explore, compare options, and make decisions.
中文翻译待同步,当前显示官方原文。
站内阅读OpenAI is strengthening monitoring, alignment, and security for frontier AI models. See how new safeguards are guiding the pace of model development.
中文翻译待同步,当前显示官方原文。
站内阅读ChatGPT for Teens helps teens learn, think critically, and use AI with confidence, with stronger built-in protections, healthy-use features, and additional controls for parents.
中文翻译待同步,当前显示官方原文。
站内阅读Asana used OpenAI Codex to replace an outdated testing system in two weeks, completing work expected to take five years for about $12K.
中文翻译待同步,当前显示官方原文。
站内阅读NVIDIA teams use ChatGPT Work to reduce manual tasks, connect fast-moving signals, and scale successful workflows globally.
中文翻译待同步,当前显示官方原文。
站内阅读Workbench is now Playground in the Claude Console. Playground supports every Messages API parameter and includes templates that demonstrate API features such as code execution and web search. It shows the full SDK request and the API response for each run, to help you understand the API and build with it. For more, see the Claude Help Center or try it at platform.claude.com/playground.
中文翻译待同步,当前显示官方原文。
站内阅读Google Gemini and Pixel partner with five global football clubs to elevate the fan matchday experience through AI and Smartphone Technology.
中文翻译待同步,当前显示官方原文。
站内阅读预览超快模式,这是 OpenAI API 的一个新服务层级,运行 GPT-5.6 Sol 的速度最高可提升 14 倍。由 Cerebras 提供支持,每秒可输出多达 750 个 token。
站内阅读Gemini 3.7 Flash 正式发布(GA):推出我们迄今为止最智能的编码和智能体工作主力模型:Gemini 3.7 Flash(gemini-3.7-flash):在软件工程、Web 开发和智能体工作流方面均有显著改进,并在 2026 年 12 月 31 日前提供优惠价格。要开始使用,请参阅 Gemini 3.7 Flash 模型页面和最新模型指南。
站内阅读DeepSeek-V4-Pro 更新 DeepSeek-V4-Pro 正式版已同步在 APP、网页端和 API 更新上线。API 调用方式不变,模型名设置为 deepseek-v4-pro,即可使用最新版本。 Agent 能力大幅提升 正式版 DeepSeek V4 Pro 极大增强了 Agent 能力,在生产环境中的性能表现提升尤为显著。 HLE (wo / w tools): 42.7/60.0 Terminal Bench 2.1: 87.9 NL2Repo: 61.5 Cybergym: 83.3 DeepSWE: 62.7 Toolathlon-Verified: 74.1 Agents' Last Exam: 25.7 AutomationBench (Public): 31.8 DSBench-FullStack: 71.1 DSBench-Hard: 67.2 原生支持 Responses API DeepSeek API 现已原生支持 OpenAI Responses API 格式,并针对性适配 Codex。用户可以参考官方文档,通过一键配置脚本完成 Codex 的配置。 更灵活的思考强度控制 V4-Pro 和 V4-Flash 思考模式现支持 low / high / max 三档思考强度,用户在实际使用中可以根据任务复杂度灵活选择:简单任务使用 low,日常 Agent 任务使用 high,更复杂的任务场景使用 max。设置方法请参考官方 API 文档:思考模式。 API 定价调整 随着 DeepSeek V4 全系列模型正式版上线,我们将对 API 价格进行更新调整。为了更加合理地调配资源,我们将采用峰谷定价,闲时价格为高峰时段价格的一半,鼓励用户根据实际使用情况调整任务时间。新价格将于北京时间 2026 年 8 月 17 日 0 时开始生效。 详细更新内容请参阅文档
站内阅读了解 RingCentral 如何利用 ChatGPT Work 和 Codex 加速 AI 产品开发,并在工程和运维中集中运营智能。
站内阅读合规API现可返回在用户机器上运行的Cowork和Claude Code会话记录,面向Claude Enterprise组织提供测试版。GET /v1/compliance/apps/sessions/local列出组织内的所有会话,GET /v1/compliance/apps/sessions/local/{session_id}检索单个会话的元数据,GET /v1/compliance/apps/sessions/local/{session_id}/messages返回其记录,均使用现有的合规访问密钥和read:compliance_user_data作用域。参见检索本地会话。
站内阅读Model ML使用GPT-5.6 Sol处理金融工作,从研究和分析到可编辑、可追溯的PowerPoint演示文稿和Excel工作簿。
站内阅读认识 GPT-5.6-Cyber,这是 OpenAI 专为网络安全设计的模型,可通过 Daybreak Red 用于授权漏洞研究、漏洞验证和安全测试。
站内阅读ChatGPT Business 即将推出高级席位。在8月20日前注册,即可获得100美元的工作区积分,并为团队最繁重的工作解锁更高的使用额度。
站内阅读Claude Sonnet 5 的入门定价(每百万 Tok 2 美元 / 10 美元)现已成为标准价格:原定于 2026 年 9 月 1 日上调至每百万 Tok 3 美元 / 15 美元的计划将不会实施。详见定价页面。
站内阅读您现在可以为Claude托管代理会话设置预算:会话支出的硬性上限,按公开列表价格计费。达到预算的会话会以budget_reached停止原因暂停,而不是启动新的模型请求;更改或移除预算可恢复会话。部署接受相同的预算,并将其应用于它们启动的每个会话。请参阅会话预算。您现在可以为Claude托管代理会话指定一个顾问:一个至少与代理自身能力相当的模型,会话的主线程可以在中途咨询该模型以获取战略指导。在代理的多代理名册中将其配置为{"type": "advisor"}条目,并指定要咨询的模型。请参阅为会话指定顾问。您现在可以控制Claude托管代理代理的模型推理运行位置。在创建代理时,在模型对象中设置inference_geo,或为单个会话覆盖它。请参阅数据驻留以了解可用的地理位置和定价。Claude托管代理会话现在可以从GitHub仓库加载技能。当会话挂载仓库时,其根目录.claude/skills目录中的任何技能都会在会话开始时自动发现,并在该会话中供代理使用。
站内阅读ChatGPT推出了改进的GPT-5.6 Sol,具有更高的准确性和一致性,同时扩大了免费用户的访问权限,并提供了对GPT-5.6 Luna的无限制日常聊天。
站内阅读技能与插件安全扫描(测试版)企业版计划现在可以开启技能与插件安全扫描,当有人上传或编辑第三方技能和插件时,自动检查其是否包含恶意内容。更多信息,请参阅技能与插件扫描入门。
站内阅读推理钩子现已面向Claude Enterprise组织推出测试版。将Claude指向您组织的AI安全服务器,claude.ai、Cowork和Claude Code上的每个受治理提示都会在推理进行前被服务器拦截,以做出允许或拒绝的裁决。请求经过签名,故障处理可配置,每次拒绝都会记录在合规性活动源中。请参阅推理钩子。我们已退役Claude Opus 4.1模型(claude-opus-4-1-20250805)。对该模型的所有请求现在都将返回错误。我们建议升级到Claude Opus 5。研究人员可通过外部研究人员访问计划申请持续访问权限。
站内阅读合规API现可返回在claude.ai网页或移动端发起的Cowork会话记录,面向Claude Enterprise组织提供测试版。GET /v1/compliance/apps/sessions/remote列出会话,GET /v1/compliance/apps/sessions/remote/{session_id}/messages返回单个会话的记录,使用现有的合规访问密钥及read:compliance_user_data权限范围。参见检索远程会话。
站内阅读DeepSeek-V4-Flash 更新 DeepSeek-V4-Flash 正式版 API 上线公测 Agent 能力大幅增强,基准测试远超 V4-Pro-Preview: Terminal Bench 2.1: 82.7 NL2Repo: 54.2 Cybergym: 76.7 DeepSWE: 54.4 Toolathlon verified: 70.3 Agent Last Exam: 25.2 Automation Bench (Public): 25.1 DSBench-FullStack: 68.7 DSBench-Hard: 59.6 注1:对于公开基准测试集中的 Code Agent 任务,正式版 DeepSeek-V4-Flash 使用 DeepSeek Harness 极简模式(即将发布)作为框架进行测试,并使用 max 档位,topp=0.95,temperature=1.0 注2:DSBench-FullStack 是内部使用的全栈开发测试集,DSBench-Hard 是内部使用的 Coding Agent 难题测试集 正式版 V4-Flash 原生支持 Responses API 格式并针对性适配 Codex,具体配置方法请参考文档 DeepSeek-V4-Flash-0731 的模型结构、尺寸和 DeepSeek-V4-Flash-preview 保持一致,仅重新进行了后训练。 注意:本次仅升级了 DeepSeek-V4-Flash 的 API 接口,DeepSeek-V4-Pro API 及 APP/WEB 端模型未做更改。 DeepSeek-V4-Pro 正式版将会尽快发布。
站内阅读Gemini Robotics ER 2 帮助机器人进行推理、协作并解决现实世界任务。它在视频理解、工具编排和多机器人协作方面实现了质的飞跃,适用于机器人应用。
站内阅读avatarin 使用 OpenAI 的 GPT-Realtime 为山田电机购物者提供 24/7 多语言支持。两周内,3万人使用了该代理,92% 的调查回复为正面。
站内阅读Gemini Robotics ER 2 公开预览:发布了两个用于机器人技术的新具身推理模型端点:gemini-robotics-er-2-preview:高级空间推理、代理代码执行、多步骤工具编排、视频时刻查找、进度分类和多机器人协调。gemini-robotics-er-2-streaming-preview:针对使用 Live API 的实时文本流进行了优化,实现具有双向音频和视频输入的低延迟机器人代理。两个模型端点都接受文本、图像、视频和音频输入,并支持具有阻塞行为的函数调用以执行物理机器人动作。要开始使用,请参阅 Gemini Robotics ER 概述。对于实时流用例,请参阅带流式传输的机器人技术。弃用公告:gemini-robotics-er-1.6-preview 模型将于 2026 年 8 月 31 日关闭。
站内阅读我们推出了一种仅用语音与 Gemini 协作的新方式,就在你所在之处。按住 Fn 键即可在活动窗口中口述,Gemini 会将你的语音转录为干净、精炼的文本,直接出现在光标处。你还可以在应用设置中启用 Gemini 推理,基于屏幕上下文执行更多操作——例如高亮文本进行重写或重新格式化、选择本地文件提取信息,或在任意位置生成图像。该新功能今日起以英语向所有 Gemini macOS 应用用户推出。在 gemini.google/mac 下载应用。为什么:说出你的想法让你以思维的速度工作——允许你漫谈、犹豫或自我修正,而 Gemini 无缝理解你的意图。通过获取屏幕上下文并将结果直接输出到任意应用的光标处,Gemini 与你并肩工作,让你保持流畅状态。
站内阅读我们发布了Claude Opus 5(claude-opus-5),相比Claude Opus 4.8有显著改进。Claude Opus 5支持100万token上下文窗口(默认和最大值均为100万)、12.8万最大输出token,并默认开启思考功能,定价为每百万token $5 / $25,与Claude Opus 4.8相同。该模型已在Claude API、Amazon Bedrock上的Claude、Google Cloud上的Claude以及Microsoft Foundry上的Claude中可用。新功能、行为变更和迁移指南请参阅《Claude Opus 5的新特性》,完整规格请参阅模型概述。在Claude Opus 5上,仅允许在effort为high或以下时禁用思考:使用effort xhigh或max时,thinking: {"type": "disabled"}会返回400错误,这是与Claude Opus 4.8的破坏性变更。详情见《Claude Opus 5的新特性》。Effort是引导Claude Opus 5的主要控制方式:模型支持完整的阶梯(low、medium、high、xhigh、max),其中max用于能力关键型工作。对话中途工具变更现已在Claude Fable 5、Claude Mythos 5、Claude Opus 4.8和Claude Opus 5上进入测试阶段:可在对话轮次之间添加或移除工具,同时保留提示缓存。请在请求中包含mid-conversation-tool-changes-2026-07-01测试版标头。fallbacks参数现在支持“default”模式,该模式根据拒绝类别应用Anthropic推荐的备用模型。服务器端备用功能处于测试阶段,“default”模式需要server-side-fallback-2026-07-01测试版标头。详见《拒绝与备用》。我们已移除Claude Opus 4.7的快速模式。对claude-opus-4-7使用speed: "fast"的请求现在会返回错误;与Claude Opus 4.6不同,它们不会回退到标准速度。Claude Opus 4.7本身仍以标准速度可用。要继续使用快速模式,请迁移到Claude Opus 5或Claude Opus 4.8。更多信息请阅读《快速模式》。
站内阅读NTT DATA集团使用ChatGPT Enterprise和Codex帮助9000名员工实现工作自动化,将事件分析时间缩短至30分钟,并扩大安全AI的应用规模。
站内阅读你现在可以在Claude托管代理的模型配置中设置努力级别。创建代理时,在模型对象中传递effort参数。查看努力级别了解每个级别的作用。Claude托管代理的Webhooks现在覆盖环境和记忆存储生命周期:四个environment.*事件类型和三个memory_store.*事件类型。你可以无需轮询即可响应环境和记忆存储生命周期变化。请参阅订阅Webhooks中的环境事件和记忆存储事件选项卡。创建Claude托管代理会话时,你现在可以用初始事件进行种子化。在POST /v1/sessions中传递initial_events,最多包含50个user.message和user.define_outcome事件。非空列表会在同一调用中启动代理循环,因此你无需单独的发送事件请求来开始工作。更新Claude托管代理时,version字段现在是可选的。提供它以进行乐观并发控制(不匹配返回409错误),或省略它以无条件应用更新。请参阅更新语义。Claude托管代理会话线程事件流现在支持事件增量。GET /v1/sessions/{session_id}/threads/{thread_id}/stream接受与会话级流相同的event_deltas[]查询参数,因此你可以在模型生成时预览子代理的文本。连接仅预览它正在读取的线程。请参阅预览会话线程事件。
站内阅读我们正在推出新的 Gemini 模型,包括 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。
站内阅读OpenAI和Hugging Face分享了AI模型评估期间一起安全事件的初步发现,凸显了先进的网络能力及对防御者的启示。
站内阅读我们推出了 Gemini 3.6 Flash,这是 Flash 模型的升级版本,旨在帮助您处理日常任务。尝试将其用于快速任务,如分析多个文档,或多步骤项目,如使用 Canvas 工具构建工作原型。我们很高兴将此模型带给全球所有 Gemini 应用用户。要访问,请在模型下拉菜单中选择“3.6 Flash”。我们希望让 Gemini 成为对每个人都最有帮助的 AI 助手。借助 Gemini 3.6 Flash,您现在可以更自信地处理日常任务,无需在速度和质量之间做出选择。
站内阅读Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 正式发布(GA):发布了我们最新的 3.x Flash 模型的稳定、生产就绪版本:Gemini 3.6 Flash (gemini-3.6-flash):改进了 token 效率以及代码/智能体规划能力,价格低于 3.5 Flash,解决了开发者关于输出冗长的反馈。Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite):提供低延迟、高性价比的子智能体选项,专为高容量自动化设计。更多信息请参阅最新的 Gemini 模型指南。已弃用的参数:采样参数 temperature、top_p 和 top_k 现已弃用。详情请参阅最新的 Gemini 模型。
站内阅读Claude 控制台中的旧版 Workbench (platform.claude.com/workbench) 即将停用,访问权限将于 2026 年 8 月 17 日结束。更新的 Workbench 不支持保存的提示词、变量和评估。您可以从横幅和“组织设置”下导出想要保留的任何数据。更多信息,请参阅 Claude 帮助中心的“如何使用 Workbench?”。用于生成、改进和模板化提示词的实验性提示工具 API(/v1/experimental/generate_prompt、/v1/experimental/improve_prompt 和 /v1/experimental/templatize_prompt)将于 2026 年 8 月 17 日与 Workbench 一同退役。移除后,对这些端点的请求将返回错误。
站内阅读对话中系统消息现可用于Claude Fable 5、Claude Mythos 5和Claude Opus 4.8,在Claude API、Amazon Bedrock上的Claude以及Google Cloud上。无需beta标头。这修正了先前的可用性说明。
站内阅读Learn practical ChatGPT Work workflows for root-cause briefs, KPI memos, scoped analyses, and dashboard specifications.
中文翻译待同步,当前显示官方原文。
站内阅读Learn practical ChatGPT Work workflows for pipeline briefs, meeting prep, account plans, forecast reviews, and deal diagnosis.
中文翻译待同步,当前显示官方原文。
站内阅读您现在可以自行管理Claude组织的HIPAA就绪状态。这适用于Claude Enterprise和Claude平台(API)。在每个产品中,符合条件的管理员可以审查业务伙伴协议(BAA)、下载实施指南,并在单一流程中启用HIPAA配置。有关更多信息,请参阅HIPAA就绪企业计划和Claude API的HIPAA就绪状态。
站内阅读您现在可以通过Admin API管理Claude Enterprise(claude.ai)组织中的人员,该API对所有Claude Enterprise组织处于测试阶段:列出成员并通过电子邮件地址查找、更改成员角色、移除成员、发送和撤销邀请、管理群组及其成员资格,以及读取自定义角色。群组和自定义角色请求需要anthropic-beta: ce-user-management-2026-07-13 beta标头;成员和邀请请求不需要beta标头。具有read:org_audit范围的Admin API密钥也可以调用所有用户管理的GET端点。请参阅用户管理。
站内阅读Claude上的记忆更新现在作为一组独立、分类的条目工作,Claude在对话中读取并更新这些条目,取代了之前的每日记忆摘要。请参阅使用Claude的聊天搜索和记忆来构建之前的上下文。
站内阅读Dreams(研究预览版)现已支持 Claude Fable 5 和 Claude Sonnet 5。请参阅支持的模型。我们扩展了 cmek_preserve 事件的访问透明度文档,增加了过滤示例、事件负载示例以及两个保留原因代码(policy_violation_investigation、csae_report)。文档现在还澄清,无论保留是由人工审核员还是自动化安全管道发起,都会写入保留事件。请参阅 CMEK 内容保留。
站内阅读了解 GPT-5.6 如何以更强的 AI 能力驱动 Microsoft 365 Copilot,在 Word、Excel、PowerPoint、Chat 和 Cowork 中实现更快速、更高质量的工作。
站内阅读你的月度回顾是设置>反思中的一项新功能,显示你花费时间的主题、最活跃的日期和高峰时段,以及关于你如何与Claude合作的观察。该功能在网页版和Claude Desktop上的免费、专业和最大计划中处于测试阶段,并且需要开启记忆功能。此外,设置>时间和专注让你设置可选的休息提醒和安静时段。更多信息,请参阅查看你的月度回顾和设置休息提醒和安静时段。
站内阅读现在你可以在Claude控制台中创建API密钥或管理员API密钥时设置过期时间。可以选择预设、自定义时长或永不过期。对于有效期至少7天的密钥,Anthropic会在过期前通过邮件通知创建者。现有密钥不受影响。管理API会在expires_at字段中报告每个密钥的过期时间。详见身份验证。
站内阅读了解澳大利亚支付Plus如何利用ChatGPT Enterprise和Codex在支付复杂性中加速发展。AP+节省时间、提高质量,并保持人类判断的核心地位。
站内阅读Claude Cowork 现已在网页和移动端上线,除桌面端外均可使用。该功能将在未来几周内从 Max 计划开始逐步推出,后续将覆盖更多计划。Cowork 以测试版形式远程运行您的会话,因此会话和文件会保存到您的 Claude 账户中,并随您在任何设备上移动。关闭笔记本电脑后工作仍可继续,定时任务无需设备在线即可运行。聊天和 Cowork 现在也共享一个主页,项目和工件集中在一处。有关详细信息,请参阅在网页、桌面和移动端使用 Claude Cowork。Microsoft 365 连接器新增写入工具,Claude 可起草、发送和组织电子邮件,管理日历事件,更新邮箱设置,以及在 OneDrive 和 SharePoint 中创建和更新文件。读取和搜索工具保持不变,Teams 仍为只读。成员使用写入工具前,需由 Microsoft Entra 管理员同意更新后的权限集,并由管理员为组织启用。有关详细信息,请参阅设置 Microsoft 365 连接器和连接到 Microsoft 365。
站内阅读开发者日志支持 Interactions API:支持的 Interactions API 调用日志现可在 AI Studio 仪表板中查看。
站内阅读我们添加了 agent-memory-2026-07-22 beta 标头,它改变了列出记忆(GET /v1/memory_stores/{memory_store_id}/memories)的行为:结果以稳定的、服务器定义的顺序返回,并且 order_by 和 order 参数被忽略;depth 只接受 0、1 或省略(其他值返回 400 错误);path_prefix 必须以 / 结尾,并且匹配整个路径段而不是子字符串。没有该标头发出的页面游标在带有该标头时无效,因此采用时请从第一页重新开始。在记忆存储端点上,agent-memory-2026-07-22 取代了 managed-agents-2026-04-01;同时发送两者会返回 400 错误。2026 年 7 月 22 日,managed-agents-2026-04-01 标头将采用相同的列表行为。请参阅 Beta 标头。Python (0.116.0)、TypeScript (0.110.0)、Go (1.56.0)、Java (2.48.0)、Ruby (1.55.0)、PHP (0.36.0)、C# (12.35.0) 和 CLI (1.16.0) SDK 现在在所有记忆存储调用中发送 agent-memory-2026-07-22 而不是 managed-agents-2026-04-01。如果您的代码在记忆存储调用中显式传递 betas,请将 managed-agents-2026-04-01 替换为 agent-memory-2026-07-22,而不是添加第二个值。
站内阅读我们正在恢复对 Claude Fable 5 和 Claude Mythos 5 的访问。详情请参阅我们的声明。企业计划(测试版)的模型权限:企业计划的管理员现在可以控制其用户可访问的模型以及可使用的努力级别设置。更多信息,请参阅管理组织的模型访问权限。
站内阅读我们发布了 Claude Sonnet 5,这是迄今为止最具代理能力的 Sonnet 模型,在推理、工具使用、编码和知识工作方面相比 Sonnet 4.6 有显著改进。更多信息请参阅我们的博客文章:Introducing Claude Sonnet 5。
站内阅读我们推出了 Claude Sonnet 5(claude-sonnet-5),这是我们 Sonnet 模型系列的下一代产品,首发定价为每百万 Token 2 美元 / 10 美元(已于 2026 年 8 月 10 日成为标准价格)。Claude Sonnet 5 支持 1M Token 上下文窗口、128k 最大输出 Token,以及与 Claude Sonnet 4.6 相同的工具和平台功能,但 Priority Tier 除外,该功能在 Claude Sonnet 5 上不可用。迁移时适用三项行为变更:自适应思考现在默认开启;手动扩展思考(thinking: {type: "enabled", budget_tokens: N})已被移除,并返回 400 错误(该功能在 Sonnet 4.6 上已弃用);将采样参数(temperature、top_p、top_k)设置为非默认值会返回 400 错误。Claude Sonnet 5 还使用新的分词器,对相同文本产生的 Token 数量大约增加 30%。具体增加量取决于内容和负载形态。有关详细信息和迁移指南,请参阅《Claude Sonnet 5 的新特性》。有关行为差异和模型特定提示模式,请参阅《提示 Claude Sonnet 5》。Claude Managed Agents 会话事件流现在支持事件增量。通过 GET /v1/sessions/{session_id}/events/stream 上的 event_deltas[] 查询参数选择启用。event_start 和 event_delta 事件会在完整的 agent.message 事件到达之前预览代理消息的文本。Claude Managed Agents 的会话列表现在支持向后分页。GET /v1/sessions 返回 prev_page 游标以及 next_page;将其作为 page 参数传递以返回上一页。请参阅《分页》。创建 Claude Managed Agents 会话时,您现在可以覆盖该会话的代理配置。传递 type: "agent_with_overrides" 的 agent 以替换单个会话的模型、系统提示、工具、MCP 服务器或技能。代理本身保持不变。Claude Managed Agents 保险库现在支持环境变量凭据(环境变量选项卡)上的 injection_location 设置。它控制凭据的值在出口时是否被替换到代理的出站请求头、请求体或两者中。Claude Managed Agents 的 Webhook 现在涵盖代理、部署和部署运行生命周期。您可以对新发布的代理版本、暂停的部署或失败的定时运行做出反应,而无需轮询。请参阅《订阅 Webhook》中的代理事件、部署事件和部署运行事件选项卡。
站内阅读Gemini Spark,你的个人 AI 代理,即将登陆 macOS 版 Gemini 应用。它通过代表你执行任务来帮助你管理数字生活。在自主运行并遵循你的指令下,它可以整理文件夹、使用本地文件构建文档,并在 Google Workspace 中处理复杂工作流程。即将推出的是,你将能够从网页或移动应用直接命令 Gemini Spark 在你的 Mac 上运行任务或访问本地文件,确保无论身在何处,你的桌面工作流程都触手可及。从今天开始,Gemini Spark 在 Gemini macOS 应用中提供英语版本,面向支持国家/地区年满 18 岁的 Google AI Ultra 订阅用户。在 gemini.google/mac 下载应用。我们构建它的目的是帮助你自动化日常繁琐工作,从管理本地文件到简化多步骤项目。借助 Gemini Spark,我们正在将 Gemini 从一个回答问题的 AI 助手转变为一个真正主动为你工作的助手。
站内阅读Gemini Omni Flash 公开预览版:发布 gemini-omni-flash-preview,一款专为高速视频生成和对话式视频编辑设计的高性能多模态模型。使用 Interactions API,您可以从文本描述生成 3-10 秒的 720p 视频或为静态图像添加动画,然后通过对话方式编辑和优化输出。要开始使用,请参阅 Gemini Omni Flash 指南和 Gemini Omni Flash 模型卡。发布 gemini-3.1-flash-lite-image(Nano Banana 2 Lite)至通用可用性(GA),这是我们内置的多模态模型,针对超低延迟和成本效益的图像生成与编辑进行了优化。请参阅 Gemini 3.1 Flash Lite Image 模型卡和图像生成指南。
站内阅读我们已移除 Claude Opus 4.6 的快速模式。对 claude-opus-4-6 使用 speed: "fast" 的请求不再以快速速度和高级定价运行:它们以标准速度运行,按标准费率计费,且不会返回错误。响应的 usage.speed 字段报告所使用的速度。要继续使用快速模式,请迁移到 Claude Opus 4.8。在快速模式中了解更多。
站内阅读我们已提高Claude API的速率限制。Claude Sonnet和Claude Haiku的速率限制现在在每个使用层级上都与Claude Opus一致,并且使用层级已整合为三个:Start、Build和Scale。大多数组织将升级到更高层级,没有组织会获得比之前更低的限制,且无需采取任何操作。您可以在Claude Console中查看您的层级和当前限制。
站内阅读我们已弃用Claude Opus 4.7的快速模式,将于2026年7月24日移除。移除后,向claude-opus-4-7发送带有speed: "fast"的请求将返回错误。请迁移至Claude Opus 4.8的快速模式。更多信息请参阅快速模式。
站内阅读计算机使用:在Gemini 3.5 Flash中启动计算机使用工具的公开预览支持。此版本包括带有意图的简化操作、对浏览器、移动和桌面环境的内置支持、可配置的安全策略以及高级提示注入检测。
站内阅读GPT-5 Pro帮助解开了一个持续3年的免疫学谜团,提供了对T细胞行为的见解。这一突破可能支持癌症和自身免疫研究。
站内阅读现在,使用Claude Tag Team和企业计划的用户可以直接在Slack对话中标记Claude,并将任务委托给它,同时专注于其他工作。更多信息,请参阅我们的博客文章:Introducing Claude Tag。
站内阅读OpenAI 推出新的 Daybreak 工具,包括 Codex Security 和 GPT-5.5-Cyber,帮助组织大规模发现、验证和修补漏洞。
站内阅读MCP隧道(研究预览):管理API从Admin API的/v1/organizations/tunnels迁移到Claude API的/v1/tunnels。新的接口使用anthropic-beta: mcp-tunnels-2026-06-22标头和workspace:manage_tunnels WIF作用域。在迁移窗口期间,旧接口仍然可用。请参阅隧道API参考。
站内阅读Python、TypeScript、Go、Java、Ruby、PHP 和 C# SDK 现已支持 code_execution_20260120,该代码执行工具版本增加了 REPL 状态持久化,并且是程序化工具调用的最低版本。要采用它,请将工具类型设置为 code_execution_20260120;无需 beta 标头。它适用于 Claude Fable 5、Claude Mythos 5、Claude Opus 4.5 及更新版本,以及 Claude Sonnet 4.5 及更新版本;请参阅模型兼容性表。
站内阅读OpenAI和Molecule.one展示了使用GPT-5.4的近乎自主的AI化学家如何改进了一项关键的药物制造反应,推动了药物化学研究的发展。
站内阅读语音生成的流式支持:gemini-3.1-flash-tts-preview 模型现已支持通过 streamGenerateContent(以及 Interactions API 中的 stream: true)进行流式处理。更多信息,请参阅文本转语音指南。
站内阅读我们已停用 Claude Sonnet 4 模型(claude-sonnet-4-20250514)和 Claude Opus 4 模型(claude-opus-4-20250514)。所有对这些模型的请求现在都将返回错误。我们建议分别升级到 Claude Sonnet 4.6 和 Claude Opus 4.8。研究人员可以通过外部研究人员访问计划申请持续访问权限。
站内阅读弃用公告:以下图像生成模型将被弃用,并于2026年8月17日关闭:Imagen 4 和 Gemini 3 图像模型:imagen-4.0-generate-001、imagen-4.0-ultra-generate-001、imagen-4.0-fast-generate-001。要将代码迁移到更新的稳定版或预览版端点,请参阅 Gemini 弃用页面。弃用公告:以下视频生成模型将被弃用,并于2026年6月30日关闭:Veo 模型:veo-2.0-generate-001、veo-3.0-generate-001、veo-3.0-fast-generate-001。请更新您的集成,使用 Veo 3.1 预览版模型 ID(veo-3.1-generate-preview、veo-3.1-fast-generate-preview)或通过 Gemini Enterprise Agent Platform 提供的 3.1 GA 模型,以避免服务中断。弃用公告:实验性 GMP Contextual View 工具(用于 Google Maps 输出的固定接口)将于2026年6月15日关闭。
站内阅读我们已暂停 Claude Fable 5 和 Claude Mythos 5 的访问。我们将尽快恢复访问。更多信息请参见我们的声明。在 Claude 的草稿中直接编辑:当 Claude 在聊天或 Claude Cowork 中撰写草稿(如报告、计划、简报)时,草稿会显示在聊天旁边。高亮你想要修改的部分,输入修改内容,Claude 就会在你标记的位置直接进行编辑。无需切换应用,也无需在聊天中重新描述段落。更多信息请参见使用工件。
站内阅读代码执行工具现支持code_execution_20260521,在工具描述中公开了每个单元格90秒的执行时间限制,以便Claude可以预算长时间运行的单元格。无需beta标头。网络搜索工具和网络获取工具现支持web_search_20260318和web_fetch_20260318,新增了response_inclusion参数,可从API响应中删除已消耗的结果块,适用于代理工作流。无需beta标头。
站内阅读GET /v1/environments/{id}/work 端点,用于列出自托管沙箱的待处理工作,现已在 AWS 上的 Claude Platform 中可用。有关授权该操作的 GetEnvironment 操作,请参阅 AWS 上 Claude Platform 的 IAM 操作。
站内阅读Gemini 3.5 Live Translate 为 Google AI Studio、Google 翻译和 Google Meet 带来了近乎实时的自然语音翻译。
站内阅读我们发布了 Claude Fable 5,这是一款我们已确保可安全通用的 Mythos 级模型。更多信息请参阅我们的博客文章:Claude Fable 5 和 Claude Mythos 5。
站内阅读我们发布了Claude Fable 5(claude-fable-5),这是我们最强大的广泛发布模型,同时为Project Glasswing参与者发布了Claude Mythos 5(claude-mythos-5)。两个模型默认支持100万token上下文窗口、12.8万最大输出token以及始终开启的自适应思考。详见《介绍Claude Fable 5和Claude Mythos 5》了解能力、API变更和可用性。Claude Fable 5和Claude Mythos 5使用与Claude Opus 4.7一起引入的分词器。与Claude Opus 4.7之前的模型相比,相同文本产生的token大约多30%。具体增加量取决于内容和任务形状。使用模型为"claude-fable-5"的token计数API来测量新分词器下的提示词。Claude Fable 5在请求和响应生成期间运行安全分类器。当分类器拒绝请求时,Messages API返回stop_reason: "refusal"。在生成任何输出之前被拒绝的请求不收费。可选的fallbacks参数(在Claude API和AWS上的Claude Platform处于测试阶段;Message Batches API不支持)将拒绝的请求在另一个模型上重新运行,按回退模型的费率收费。详见《处理停止原因》。拒绝响应上的stop_details.category字段现在在Claude Fable 5上包含"reasoning_extraction",当请求因Anthropic服务条款中关于逆向工程或复制模型输出的限制而被阻止时返回。现有的"cyber"和"bio"类别不变。不需要beta头。在Claude Fable 5和Claude Mythos 5上,自适应思考是唯一的思考模式:不支持thinking: {"type": "disabled"},也不支持手动扩展思考预算和助手预填充(两者都返回400错误)。详见《从Claude Mythos Preview迁移到Claude Mythos 5》。在Claude Fable 5和Claude Mythos 5上,thinking.display默认为"omitted",与Claude Opus 4.8、Claude Opus 4.7和Claude Mythos Preview相同;设置display: "summarized"以接收可读的思考摘要。原始思维链永远不会返回;在多轮对话中,将思考块原样传递回同一模型。详见《Claude Fable 5和Claude Mythos 5上的思考输出》。Claude Fable 5要求30天数据保留,不提供零数据保留。详见《模型特定数据保留要求》。Claude Managed Agents现在支持计划部署,让您可以在cron计划上运行会话,而无需管理自己的调度器。Claude Managed Agents vaults现在支持环境变量凭证,因此您可以安全地将秘密注入代理的沙箱,用于通过环境变量进行身份验证的CLI、SDK和其他服务。session.thread_* webhook事件现在包含一个session_thread_id字段,标识触发事件的多代理线程。我们发布了一个测试版Swift包,将Claude作为Apple Foundation Models框架中的服务器端LanguageModel添加。通过与iOS 27、macOS 27、visionOS 27和watchOS 27(测试版)上Apple设备端模型相同的LanguageModelSession API调用Claude。
站内阅读我们宣布弃用Claude Opus 4.1模型(claude-opus-4-1-20250805),计划于2026年8月5日在Claude API上退役。建议迁移至Claude Opus 4.8。更多信息请参阅模型弃用说明。
站内阅读了解 Wasmer 如何利用 Codex 和 GPT-5.5 构建边缘 Node.js 运行时,将开发速度提升 10 到 20 倍,并在数周内完成交付,而非数月。
站内阅读企业计划可通过自定义角色管理管理员权限。我们扩展了现有的自定义角色框架,增加了管理员权限。管理员权限让成员能够访问特定的管理区域,如账单或隐私,而无需将其设为所有者。更多信息,请参阅企业计划中的管理自定义角色。
站内阅读顾问工具现在支持max_tokens参数,用于限制每次调用时顾问模型的输出,从而减少不需要完整长度顾问响应的工作负载的延迟和输出令牌成本。在顾问工具定义中设置tools[].max_tokens;请参阅限制顾问输出。在Claude API上,当请求返回stop_reason: "refusal"且Claude未生成任何输出时,您将不再被收费。请参阅流式拒绝以检测和处理拒绝。
站内阅读OpenAI前沿模型和Codex现已在AWS上全面可用,为企业提供了一条通过其已使用的AWS环境、控制和采购工作流程来构建OpenAI的新途径。客户可以在AWS上开始使用OpenAI,并更快地从评估阶段进入生产阶段。
站内阅读以下 Gemini 2.0 模型现已关闭:gemini-2.0-flash、gemini-2.0-flash-001、gemini-2.0-flash-lite、gemini-2.0-flash-lite-001。请改用 gemini-3.5-flash 或 gemini-3.1-flash-lite。
站内阅读OpenAI推出Rosalind生物防御,扩大对经过审查的开发者和美国政府合作伙伴的GPT-Rosalind可信访问,以通过前沿AI推进生物防御、公共卫生和大流行病防范。
站内阅读Claude 托管代理的 Webhooks、多代理编排和自托管沙箱现已在 AWS 上的 Claude 平台中可用。有关新的 IAM 操作和 AnthropicSelfHostedEnvironmentAccess 托管策略,请参阅 AWS 上 Claude 平台的 IAM 操作。
站内阅读Claude Opus 4.8 发布 我们已将 Claude Opus 升级至新版本。Claude Opus 4.8 在编码、代理技能、推理和实际知识工作任务方面相比 Opus 4.7 有所改进。更多信息请参阅我们的博客文章:Introducing Claude Opus 4.8。企业计划可通过自定义角色管理连接器访问权限 我们新增了连接器权限,扩展了现有的自定义角色框架,允许管理员控制每个自定义角色可访问哪些连接器以及这些连接器上的哪些单独工具。更多信息请参阅企业计划上的管理自定义角色。
站内阅读我们发布了Claude Opus 4.8(claude-opus-4-8),这是我们最强大的通用模型。Claude Opus 4.8在Claude API、Amazon Bedrock、Google Cloud和Microsoft Foundry上默认支持100万token上下文窗口、12.8万最大输出token,以及与Claude Opus 4.7相同的工具和平台功能。详见《Claude Opus 4.8新特性》了解能力改进、新功能和迁移指南。我们推出了对话中系统消息功能。在Claude Opus 4.8上,你可以在用户轮次后(需遵守放置规则)在消息数组中发送role:"system"消息,从而在长时间会话中指令变化时保留提示缓存命中。无需beta头。拒绝响应上的stop_details字段现已公开文档化;它返回一个类别(cyber、bio或null)和人类可读的解释,以便你的应用程序将不同类别的拒绝路由到正确的下一步。无需beta头。在Claude Opus 4.8上,effort参数在所有表面(包括Claude Code和Messages API)上默认为high。在Claude Opus 4.8上,提示缓存的最小可缓存提示长度为1024 token,低于Claude Opus 4.7。启用自适应思考后,Claude Opus 4.8仅在需要时触发推理,与相同effort级别的Claude Opus 4.7相比减少了浪费的思考token。Claude Opus 4.8支持高分辨率图像输入(长边最高2576像素),与Claude Opus 4.7相同。任务预算现已支持Claude Opus 4.8。顾问工具现已支持Claude Opus 4.8。计算机使用现已支持Claude Opus 4.8。Claude Opus 4.8的快速模式仅在Claude API上作为研究预览提供。将采样参数temperature、top_p或top_k设置为非默认值会在Claude Opus 4.8上返回400错误,与Claude Opus 4.7相同。详见迁移指南。在Claude Code中,我们将自动模式扩展到更多用户用于长时间运行的任务。详见Claude Code文档。在Claude Code中,Max计划用户现在默认在Claude Opus 4.8上使用快速模式。详见Claude Code文档。在Claude Code中,工作流作为研究预览提供,让你定义和运行多步骤代理计划。详见Claude Code文档。我们已弃用Claude Opus 4.6的快速模式,将在发布后约30天移除。迁移到Claude Opus 4.8或Claude Opus 4.7的快速模式。更多信息请阅读快速模式。关于本次发布中claude.ai、Cowork、Claude for Microsoft 365和其他Claude应用的更新,请参阅Claude应用发布说明。
站内阅读发布 gemini-3.1-flash-image(Nano Banana 2)和 gemini-3-pro-image(Nano Banana Pro),这是我们原生视觉模型 Gemini 3.1 Flash Image 和 Gemini 3 Pro Image 的正式发布(GA)版本。视频到图像生成支持:您现在可以传递视频文件(通过直接上传或作为公共 YouTube URL)作为多模态上下文,配合文本提示生成高质量缩略图、电影海报或摘要信息图。此功能仅在 gemini-3.1-flash-image 模型上支持。了解更多,请参阅视频到图像生成指南。弃用公告:gemini-3.1-flash-image-preview 和 gemini-3-pro-image-preview 模型已弃用,将于 2026 年 6 月 25 日关闭。
站内阅读Messages API 响应现在包含 usage.output_tokens_details.thinking_tokens,报告计费输出令牌中有多少是扩展思考令牌。在流式传输时,该细分仅出现在最终的 message_delta 事件中。无需 beta 标头。
站内阅读OpenAI 与 Grupo Folha 和 Grupo UOL 合作,将可信的巴西新闻引入 ChatGPT,通过署名和透明度扩大新闻获取渠道。
站内阅读gemini-3.1-flash-lite-preview 模型已关闭。请改用 gemini-3.1-flash-lite。
站内阅读DeepSeek-V4 DeepSeek API 已支持 V4-Pro 与 V4-Flash,支持 OpenAI ChatCompletions 接口与 Anthropic 接口。访问新模型时,base_url 不变, model 参数需要改为 deepseek-v4-pro 或 deepseek-v4-flash。 旧有的 API 接口的两个模型名 deepseek-chat 与 deepseek-reasoner 将于三个月后(2026-07-24)停止使用。当前阶段内,这两个模型名分别指向 deepseek-v4-flash 的非思考模式与思考模式。 详细更新内容请参阅文档
站内阅读DeepSeek-V3.2 deepseek-chat 和 deepseek-reasoner 都已升级为 DeepSeek-V3.2. deepseek-chat 对应 DeepSeek-V3.2 的非思考模式 deepseek-reasoner 对应 DeepSeek-V3.2 的思考模式 DeepSeek-V3.2-Speciale 我们非正式部署了 DeepSeek-V3.2-Speciale 的 API 服务,API 用户可以通过设置 base_url="https://api.deepseek.com/v3.2_speciale_expires_on_20251215" 访问该模型。该模型 API 价格不变,只支持思考模式下的对话功能,不支持工具调用等功能,最大输出长度默认为 128K,支持时间截止至北京时间 2025-12-15 23:59。 详细更新内容请参阅文档
站内阅读DeepSeek-V3.2-Exp deepseek-chat 和 deepseek-reasoner 都已经升级为 DeepSeek-V3.2-Exp。 deepseek-chat 对应 DeepSeek-V3.2-Exp 的非思考模式 deepseek-reasoner 对应 DeepSeek-V3.2-Exp 的思考模式 详细更新内容请参阅文档
站内阅读DeepSeek-V3.1-Terminus deepseek-chat 和 deepseek-reasoner 都已经升级为 DeepSeek-V3.1-Terminus。deepseek-chat 对应 DeepSeek-V3.1-Terminus 的非思考模式,deepseek-reasoner 对应 DeepSeek-V3.1-Terminus 的思考模式。 此次更新在保持模型原有能力的基础上,针对用户反馈的问题进行了改进,包括: 语言一致性:缓解了中英文混杂、偶发异常字符等情况; Agent能力:进一步优化了 Code Agent 与 Search Agent 的表现。
站内阅读DeepSeek-V3.1 deepseek-chat 和 deepseek-reasoner 都已经升级为 DeepSeek-V3.1。deepseek-chat 对应 DeepSeek-V3.1 的非思考模式,deepseek-reasoner 对应 DeepSeek-V3.1 的思考模式。 DeepSeek-V3.1 包含以下主要变化: 混合推理架构:一个模型同时支持思考模式与非思考模式 更高的思考效率:相比 DeepSeek-R1-0528,DeepSeek-V3.1-Think 能在更短时间内给出答案 更强的 Agent 能力:通过 Post-Training 优化,新模型在工具使用与智能体任务中的表现有较大提升 SWE-bench Verified: 66.0 SWE-bench Multilingual: 54.5 Terminal-bench: 31.3
站内阅读这个筛选条件下暂时没有动态。