本周回顾:中国的就业焦虑、新的前沿模型以及扎克伯格的惊人回归
周一——中国 2035 年 AI 计划在国内引发日益增长的就业焦虑
中国领导层已将人工智能的普及列为国家级任务:预计到 2035 年,AI 技术将全面融入经济与社会的各个层面。这一战略由源源不断的开源模型支撑,这些模型性能强劲,且无论是训练还是运行,成本相对低廉。与唐纳德·特朗普不同,习近平对 AI 风险表达了更深的担忧,并呼吁加强监管,以确保人工智能“始终处于人类控制之下”。然而,美国的相关辩论走向了相反方向:在行业高管呼吁放缓研发步伐之后,特朗普将这些安全担忧斥为骗局,认为这反而给了中国在科技竞赛中取得领先的优势。
民意调查显示,与美国人相比,中国人对该技术表现出更积极的态度,且普及速度更快。但在表面之下,中国也面临着全球普遍存在的同一场争论。中国各大平台上充斥着关于失业和生计担忧的帖子。例如,30 岁的演员徐鹏,去年在经历了一段失业期后,在中国东部影视制作中心横店,每月拍摄一至两部剧集。今年二月春节后,原本计划启动两部新剧,但预期的电话始终未响。经询问,制片方告知,公司取消了拍摄计划,转而使用 AI 生成视频。“昨天一切还好,今天突然就没了”,他如此描述这种变化的过程。
按这种描述,北京领导层对这场变革带来的政治与经济后果越来越担忧。在美国,这类冲突可以公开摆上台面,通过法院和立法程序来解决;而在中国,受影响的人缺乏参与决定自身处境的渠道。这让中共陷入两难:技术快速发展能增强国家的对外地位,但为了维持内部稳定,又可能不得不给技术踩刹车。
{Synthszr 观点:从外部看,中国像一个拿着统一时间表的单一行动者:2035 年、覆盖所有行业、自上而下推进。但在内部,这张时间表碎裂成无数个案,比如横店那位演员——春节过后丢了两个剧组,因为一家工作室改用了 AI 生成视频。这些裂痕从外部几乎无法衡量,因为它们发生在短视频工作室和地方劳动力市场,而不是听证会或诉状里。对北京来说,这意味着每一次加速产生的压力都无处释放,党必须自己把握分寸,既没有泄压阀,也没有预警系统。中国未来几年能走多快,取决于影视、广告等行业的就业数据,而这些数据外界几乎看不到。
Synthszr 观点:从外部看,中国通往 2035 年的路线图浑然一体,内部却碎裂成无数个案,比如横店那位演员。没有法院和立法作为泄压阀,党只能自己给压力调门,而且没有预警系统。中国的速度最终取决于就业数据,而这些数据外界几乎看不见。
周二 — Amazon 把 Meta 的灵感女神挡在门外,Shopify 坐收渔利
Shopify 计划允许 Meta 的个人 AI 助手 Muse 代表用户在其平台上的商家处完成购买。接入将通过 Shopify 的一键支付服务 Shop Pay 实现,该服务存有买家的配送和账单信息。这让 Muse 获得了一条通往西方最大商家网络之一 Agentic Checkout 的官方通道。
与此同时,Amazon 封禁了 Muse 对其在线商城的访问权限。自周日晚起,若用户试图派遣 Muse 前往该网站购物,便会看到如下提示:“未授权的 AI 代理继续访问违反了 Amazon 的服务条款,而我们的客户已同意这些条款。”据 Amazon 称,在采取此举之前,他们曾试图说服 Meta 自愿将该市场从其产品中移除。一位发言人表示,代表客户向其他企业采购的第三方应用必须透明运行,并尊重提供商关于是否参与的决策。Meta 对此暂时未作回应。
Amazon 给出了三点理由:公司并未就此次访问获得预先通知,Muse 在浏览时未识别自身为代理,且该代理似乎在抓取并存储用户的凭证。服务条款要求代理在 HTTP 请求中以文本片段形式进行身份标识。据 Amazon 描述,Muse 可根据用户指令访问账户页面和订单历史,这在该公司看来等同于一个未披露的第三方在用户账户中操作并处理交易。Meta 在启动时曾表示,Muse 无法查看密码或支付数据;共享的凭证会进入安全存储并加以利用,而代理本身不会看到它们。根据 Meta 的说法,该产品在启动时每个实例都包含一个隔离的 Secure VM,以及一个名为 Sentinel 的第二代理,该代理经过安全训练,用于审查如购物等敏感操作;此外,一种旨在连 Meta 自身也无法访问用户数据的 Confidential VM 目前正面向少量用户进行测试,并计划在今年内全面推出。
在经济层面,亚马逊的后台业务依赖页面访问量:去年广告收入超过 680 亿美元,主要由浏览产品页面和赞助广告位的用户支撑。亚马逊还辩称,AI Agent 绕过了内置的个性化功能,展示了与购买历史不符的产品;他们期待更透明的机制、为商家提供 Opt-out(退出)选项,以及双向的价值交换。其使用条款并未明确提及 AI 购物助手,但禁止“数据 挖掘、机器人或类似的数据采集与提取工具”。然而,屏蔽这些工具面临营收风险:若排除 ChatGPT 的 Bot,将切断来自每月约 10 亿 OpenAI 用户的潜在购买;而亚马逊与 OpenAI 刚刚宣布的广告合作也表明,商家与 AI Agent 在中期内必须寻求共存。此外还有责任归属问题:如果 AI Agent 下错单,亚马逊既要安抚不满的消费者,也要处理不满的商家。
Meta 则表示,Muse 既不会访问用户的密码,也不会接触其支付信息:据公司介绍,登录凭证会被安全存储,并在不可见的情况下使用,类似于浏览器里保存密码的机制。Muse 于本月才刚刚发布,设计目标是自主完成多步骤任务:填表单、发邮件、订行程、购物。这个 Agent 我们在 9 月 19 日就报道过一次,当时它正和 Amazon 起冲突。悬而未决的问题是:Agent 与第三方网站打交道时,规则究竟由谁来定。 → Wall Street Journal、Digit、GeekWire、TechCrunch、SiliconANGLE、Business Insider
Synthszr 观点:Shopify 通过接入 Shop Pay 的接口获得了一个新的销售渠道,而 Amazon 则要守住靠赞助商品位撑起来的广告业务,抵御外来 Agent。代价是:客户关系流向了 Meta。Tobi Lütke 显然是有意押注——订单量的增加眼下足以抵消这个代价。
周三 — Opus 5.5 发布:Anthropic 承诺以更低成本带来更强性能
Anthropic 周二发布了 Claude Opus 5.5,这是新 5.5 系列的首款模型,定价远低于自家的旗舰产品。通过 API,Opus 5.5 的输入 Token 价格为每百万个 4 美元,输出 Token 为每百万个 20 美元,比 Opus 5 低 20%。几周前刚发布的 Fable 5.1 和 Mythos 5.1 的价格分别为 10 美元和 50 美元,是其两倍多。上下文缓存 成本也更低:Cache-Write(写入缓存)从 6.25 美元降至 5 美元/百万 Token,Cache-Read(读取缓存)从 0.50 美元降至 0.20 美元/百万 Token。供应商表示,实际节省幅度更接近 40%,因为该模型在处理相同任务时消耗的 Token 更少,且生成速度提升超过 30%。此外,Claude Code 和 Claude 平台现在提供加速模式(Fast-Mode),速度最高提升 2.5 倍,价格分别为 8 美元和 40 美元。
Anthropic 将重点放在长时运行的 Coding Agent(编码智能体)上。在 Terminal-Bench 4.0 上,该公司的报告成绩为 66.4%,而 Fable 5.1 为 55.8%,Opus 5 为 52.3%;在 FrontierCode v1.1 上,成绩为 54.4%,高于 Fable 5.1 的 50.3%;在 CursorBench 4.0 上,成绩为 57.8%,高于 51.8%。在知识工作领域(GDPval-AA v2.1),得分从 1735 升至 1846;在多学科推理测试(Humanity’s Last Exam)中,得分从 65.6% 升至 67.7%。Anthropic 建议不要仅凭几分的 Benchmark(基准测试)差异就断定日常使用中会有显著不同,并形容 Opus 5.5 在大多数任务上的表现与 Fable 5.1 大致相当。在与竞争对手的比较中,该公司指出其 FrontierCode 成绩优于 GPT-6 Astra,而每任务成本仅约为后者的 20%,并在 CursorBench 上以约