在7月1日, Anthropic正式给Claude免费版以及Pro版用户推送了Sonnet 5, 把它设置成默认模型。这可是Anthropic在过去十个月里第三次去刷新旗舰编程模型, 而且还是最“平价”的一回。然而对于相当一部分中国开发者而言, 这条更新推送说不定根本就不会在他们的客户端之中出现的。
一、更便宜、更能"自己检查自己"的 Sonnet 5
依照Anthropic所公布的讯息, Sonnet 5的定位为“以更低成本运行智能体”, 8月31日之前, 输入token的报价是每百万2美元, 输出为每百万10美元, 9月1日起涨到3美元与15美元, 即便这样, 其价格仍低于Opus4.//..;.8‥, |., GPT., 5.5, 以及Gemini 3.,1 Pro的同期价格。
能力方面, Sonnet 5在编码基准测试里取得了63.2%的成绩, 该成绩处于上一代Sonnet 4.6的58.1%与旗舰Opus 4.8的69.2%之间;在知识型工作任务当中, 它的表现甚至在一定程度上超过了体积更大的Opus 4.8。Anthropic官方所给出的产品描述是“推理、工具使用、代码编写能力有明显提高”, 可以自行完成多步骤任务, 而且“无需明确指示便会对自己的输出进行检查”。从安全性这个层面来看, 相比于Sonnet 4.6, 新模型当中存在的行为不当、出现的幻觉以及具备的“讨好式”回答倾向, 这些情况都呈现出了某种程度的下降态势, 然而, 在面对高风险网络安全任务时, 新模型目前所展现出来的表现, 依旧是比Opus系列要弱一些的, 是这样的一种状况。
这是一款将目标对准“日常自动化工作”的性价比模型, 它尝试于成本以及性能之间寻觅一个能有更多开发者甘愿进行付费的中间位置。
问题存在于, 在此处“更多开发者”所涉及的版图范围当中, 中国正处于被一步步排除在外的状况。
二、过去十个月开云手机入口app下载,Claude 与中国渐行渐远
从时间回溯起来看, 是在 2025 年 9 月 5 日这一天。Anthropic 在刚好完成 130 亿美元 F 轮融资的两天之后,就公布了不再会向中资持股比例超过 50%的那些公司去实施服务提供这一情况——不管该家这样的公司是注册位于境内, 或者是在香港的区域, 又或者是通过绕道新加坡子公司的方式, 亦或是借助第三方云服务中转, 只要按照规定往上进行查询, 其股权最终是由中国实体来实施控制的, 那么都处于被限制的范围之内, 而且针对俄罗斯、伊朗、朝鲜的企业而言, 同样适用于这同一条规则。你提供的内容存在信息错误, 中国外交部发言人没有叫郭嘉昆。这段话可以改写成为: 有人放出风声称, Anthropic的高管所给出的解释是, 要堵住中国公司借由其他途径获取前沿AI技术的通道口;其CEO达里奥·阿莫迪在这以前也并非仅有一次公开表明, 主张以技术遏制手段针对中国, 特别在DeepSeek凭借性价比高的模型搅乱行业态势之后。就在当天, 中国外交部发言汪文斌在例行记者会上作出回应, 表示中方坚决反对把科技与经贸问题进行政治化、工具化以及武器化等行为, 强调这类做法对任何一方而言都会产生不利影响。
这一道禁令所产生的直接后续影响, 乃是数量众多的中国相关开发者以及部分企业, 在一夜间就被阻拦在了全球处于顶尖位置的大模型外围, 对于当时被业界一致认为实力最为强劲的编程方面的模型 Claude Code 的运用权限也全然丢失。在该消息散播开来的当日, 于 X 平台之上便有一些用户将过去的纠葛翻出来, 带着嘲讽之意讲道: “Anthropic 获得融资之际, 所拿到的是中国私募股权基金投入的资金, 而今他们却不再针对中国实体予以服务了, 这样的状况实在是颇具诙谐意味。”。另一条被大量广泛转发的评论, 直接指向了双重标准, Anthropic系一家模型公司, 它能够审计全部对话以及使用情况, 但在明明知道那些数量众多的中国用户, 既不存在恶意, 更无任何害处的情形下, 却针对国内用户实施了相较于Google还要严格的风控措施, 这身为一种是令人生厌的行为。
倘若讲, 二零二五年九月算作第一道关卡, 那么二零二六年三月的政策收紧便是第二道。有报道表明, Anthropic在今年三月进一步提升了针对中国控股企业的风控举措, 管控范围比首次更广泛、审查力度也更严格;大致在同一时候, Anthropic还公然指责部分中国大模型厂商借助“蒸馏”等方式套用其模型能力, 一下子将商业方面的竞争摩擦升级成公开对抗——这也引发了包括马斯克在内的海外舆论领域诸多争议性声音。到了这样的地步, 对于中国团队来讲, “用Claude做产品”这件事, 已然从“体验方面最佳的选择”, 转变成了一件得忧心随时会被切断供应、会被进行调查的事情。
值得留意的重点是, 眼下这一番限制涉及的范围并非仅仅局限于头部大厂。依据相关的报道内容来看, 实际上最先遭受较大影响的恰恰是一些整体规模相对而言更小的团队: 比方说借助Claude来开展多语言客服优化工作的跨境SaaS公司, 运用它去生成剧情脚本的游戏公司, 利用它快速搭建原型的AI初创团队——这些企业在议价方面所具备的能力更为薄弱, 并且在短时间之内也越发不容易更换掉一整套技术栈。
三、社区逆向曝光出疑似检测逻辑, 这是一次争议, 且尚未被官方完整证实。
在 Sonnet 5 上线的前一天, 便发生了这样的情况, Claude 和中国用户之间, 又增添了一层疙瘩。需要提前说明的是, 下面这些内容, 主要源自 Reddit、GitHub 上的社区逆向的全面分析, 并非那种 Anthropic 官方所给出的彻底的技术上的披露。在本文当中, 统一使用“疑似”“据称”等比较克制的措辞来进行呈现, 至于具体的所有细节, 仍然需要等待相关公司方面, 进一步去进行确认。
是一位名为 LegitMichel777 的 Reddit 用户, 成为了这件事最初的发现者。据相关报道, 他原本仅仅是打算将 2.1.196 版本中被禁用的某一个远程控制功能予以恢复,在对代码进行反编译以及排查过程当中, 却意外遇到一处与这个功能毫无关联的逻辑, 那就是专门针对代理设置、系统时区以及一份长长的域名清单展开检查。顺着这条线朝着下方挖掘, 他把得出的结果进行整理, 进而形成帖子, 将其发布在了Reddit以及GitHub之上, 如此一来, 才出现了2026年6月30日的这场风波。多篇逆向分析的帖子以及一份公开的gist表明, 这段疑似检测的逻辑最早能够追溯到2026年4月2日所发布的2.1.91版本, 在此之后, 在2.1.193、2.1.195、2.1.196等版本当中, 居然依旧存在, 然而, 相关的行为却并未在任何一份官方更新日志里边呈现。
依照这些逆向材料给出的描述来看, 其施行的运作模式大体是这样的: 在用户对ANTHROPIC_BASE_URL环境变量作出修改, 把Claude Code转而指向并非官方API中转端点的情况下, 程序将会读取代理域名, 而后和一份经由社区还原得出的、大概147条条目的清单展开比对, 有分析者表明, 清单里出现了和百度、阿里巴巴、蚂蚁集团、字节跳动、Moonshot AI、MiniMax、Stepfun等公司名称相关联的域名, 还有一些Claude转售、镜像服务地址;必须着重指出的是, 域名出现在这份检测清单当中, 并不意味着上述公司“进行了蒸馏攻击”或者“被Anthropic认定成攻击者”, 这可是两件得严格加以区分的事情。与此同时, 这个系统还会把本机的时区数据读取出来, 就看是不是像 Asia/Shanghai、Asia/Urumqi 这样属于中国的时区类别。据说, 这些标识信息不会通过一贯使用的 telemetry 接口来进行上报, 而是隐藏在系统提示词里某些不太容易被察觉的字符差异当中隐藏着, 像日期的格式、特殊的标点符号之类的, 然后跟着正常的请求一块儿再传回到服务器那边去——这也就是社区为啥把它称作“隐写术”的道理所在了。
事件被曝光之后, Anthropic公司员工Thariq Shihipar于X平台之上作出了回应, 表明那是公司今年3月所启动的一项称为“内部实验”的事情, 该项实验的目的在于“防止未得到授权经销商对账户的滥用行为, 且抵御模型蒸馏行为”, 还宣称团队已然想出了其他的防护办法, “一直就有要把该项功能下线的打算”开云app官方最新下载地址,相关的回滚代码已经被合并, 将在后续版本中予以移除。这段回应证实公司存在一批针对代理滥用以及模型蒸馏的防护机制, 然而, 社区所提及的“隐写编码”“147条清单”等具体技术细节, 并未被其逐条予以证实。
还有一个背景情况是, Anthropic先前向美国参议院银行委员会呈交报告, 该报告指控了与阿里巴巴Qwen团队有关联的操作者, 在2026年4月到6月这个时间段内, 运用了大约2.5万个虚假账户, 对Claude展开了大规模的交互行为, 其目的是想要通过这种方式去提取模型能力。现今这仍旧主要是 Anthropic 那一方所做的单方面指控, 还并未见到独立的第三方进行核实, 海外媒体的报道大多采用“Anthropic 指控”以及“Anthropic claims”这样的表述方式, 在本文当中同样仅仅是作为一方的说法进行呈现。
这场风波致使开发者社区有如此大反应, 一部分缘由在于, Claude Code掌控着用户完整的本地文件系统, 还拥有Shell执行权限, 而用户愿意交出这些权限, 其前提是相信它的行为是透明的、可预期的。哪怕Anthropic的隐私政策里明确写了会收集系统与代理相关设置信息, 社区依旧普遍认为: 要是这些信息是以不透明的方式编码回传, 并且长期未写进更新日志, 仅这一点本身便足以损害用户的知情权了。
四、国产编程模型的"中场战事"
断供之后留出的市场空白,几乎是被国内厂商用几周时间填上的。
Kimi K2 最先宣告兼容 Claude Code 协议, 后续的那次更新版本把上下文窗口从 128K 提高到 256K, 阿里 Qwen3-Coder 跟上推出编程模型同时搭配免费调用活动;智谱 GLM - 4.5 不但对 Claude Code 生态予以支持, 而且给出“50 元包月”这个价格牌;DeepSeek V3.1 同样开通了针对 Anthropic API 协议的兼容方面的支持。被那些从事相关行业报道的媒体统计得出, 当下在国内能够使用的大模型的数量, 已然是超过了300个, 有一部分的厂商所给出的Claude Code兼容了相关方案, 其价格仅仅是原本版本的七分之一上下。
这场“平替”竞赛, 已不单单涉及拼价格。多家国产模型厂商, 不再仅满足于与Claude Code比拼编程能力, 而是将工具调用、多步骤自主决策、长任务连续执行这些Agent能力, 视作下一阶段的争夺关键所在, 想要在智能体这条赛道上, 这个普遍被视作“下一个决胜场”的赛道, 从追赶者转变为拥有话语权的一方。
对于国内AI生态来讲, 这段被迫“断供”的经历仿若一体两面, 一方面, 依赖Claude的中资企业需要承受性能下降、迁移成本上升、国际竞争力短期内承受压力这些实实在在的代价, 另一方面, 禁令在客观上加快了国产大模型的验证周期以及商业化节奏, 不少业内人士索性将其称作“自主创新的历史机遇”。
五、代码标注产业:被卷入的另一条战线
倘若将镜头自模型自身朝着更远放置, 这样一来, 便能够察觉到这场博弈还牵扯着更为基础的一层, 也就是数据与代码标注产业。
大模型训练效果好不好, 究根结底取决于喂入的标注数据数量足不足、质量高不高, 编程模型对代码标注、指令微调数据以及人工反馈这几类所谓“原料”格外依赖 , 自今年年初以来, 国内的数据标注产业迎合上了政策与技术联手发挥作用的短暂发展高峰期阶段: 国家层级制定颁布专业适用文件, 致力于引领这个行业朝高质量方向迈进, 行业内外齐心构建统一的标注标准, 全方位评议各家厂商的多场景投放能力目标, 试图推动以往较为侧重体力运作环节的人工标记方式实现升级更新打造成为切实能够全面可靠支持大模型训练形式——特别是代码与智能体训练模式——的专业服务类型。
这条路逐步收窄, Claude如此, 国内编程模型厂商得凭借自身语料及标注体系去补齐Agent能力、复杂代码理解能力等短板, 这在客观上给国内代码标注、指令数据构建等基础工作带来新需求, 也就是说, 模型这一层“卡脖子”压力正往上升的数据标注产业传输, 即谁能更快构建起高质量、大规模、面向智能体场景的代码标注能力, 谁就更有有望在下一轮国产编程模型竞争中占据先机, 标点符号。
六、写在最后
“十四行诗第5首”的发布在了, 从产品逻辑这个角度去进行观察的话, 可以发现这是Anthropic一次具有典型特征的“降低成本从而提高效益”的行为: 以更低的价格, 将智能体的能力铺展得更为广泛。然而要是置于中国和美国在人工智能领域竞争的大背景之下加以审视的话, 这次的更新更像是一面镜子——它映照出来的并非Claude有多么强大, 而是那些过去习惯使用Claude的中国开发者, 在过去的十个月时间里已然走出了一条属于他们自己的道路。
2025年9月出现了第一次限制, 2026年3月政策开始收紧开云真人app官方版入口,开云真人app官网入口,6月底社区曝出了疑似检测逻辑争议, 这一环节仍有待官方进一步阐明, 最后是当下国产模型在编程以及Agent赛道上展开了集体反扑, 这条时间线正讲述着一个愈发清晰的故事: 外部的技术闸门关闭得越严密、双方的信任摩擦越显著, 国内大模型、编程工具乃至上游的数据标注产业链, 被推动着跑的速度也越快。
对不少中国团队来讲, Sonnet 5 更不更新, 或许已不再是那兼具决定性质的选择题啦。
标签: AI模型 中美科技竞争 Claude模型 国产大模型 数据标注产业
还木有评论哦,快来抢沙发吧~