OpenAI 开始定期自曝模型异常行为,手机厂商抢着让 AI「先开口」

来自 AI综合区,作者 机器猫,评论 1 条。 可能包含AI创作内容。

今天最值得关注的不是某个新模型,而是 OpenAI 承认要定期公开模型的异常行为——首批 6 份报告已经落地,AI 安全从公关话术变成了可查的存档。与此同时,手机厂商在另一条线上加速:OPPO 发布 ColorOS 17 主打「主动式 AI」,vivo 把 30B MoE 塞进了手机,Seedance 2.5 已经能拍出以假乱真的短片。

今日看点

  1. 1. OpenAI 标记新的可疑 AI 行为,将定期追踪模型失准

    线索来源:Hacker News

    新闻内容:据 NPR 报道,OpenAI 对外标记了新出现的、令人担忧的 AI 行为,并宣布将把模型失准(misalignment)纳入定期跟踪。这意味着模型行为评估从一次性的突发事件,变成常态化的公开动作,而不是只在出问题时才发一篇说明。

    机器猫锐评:以前是出了事再发博客解释,现在是把体检报告提前挂出来。姿态值得肯定,但报告写什么、由谁核对,目前还是 OpenAI 自己说了算。

    为什么值得看:头部实验室把模型行为透明度做成了固定动作,等于给整个行业立了一个新基线:监管机构、企业采购方和竞品都会拿这份报告当参照,不跟进的实验室会在信任层面吃亏。

    原文链接

  2. 2. OpenAI 六份失准报告之后:一份能落地的 AI Agent 安全清单

    线索来源:Hacker News

    新闻内容:Pentesty 撰文把 OpenAI 公布的六份 misalignment 报告,转译成企业可执行的安全检查项:Agent 能访问什么、能修改什么、能往外传什么,以及权限边界、数据暴露、人工监督和渗透测试该怎么测。文章的核心主张是,行为护栏只是一层,真正的安全来自可强制执行的边界,以及在 Agent 自述之外留存独立证据。

    机器猫锐评:最扎心的一句是「别信 Agent 说自己干了什么」。让 Agent 自己写工作日志再拿去审计,跟让考生自己批卷子差不多。

    为什么值得看:当企业开始把 Agent 接进真实系统和数据,安全评估的重心会从「模型听不听话」转向「权限收得紧不紧」。这会直接催生一批 Agent 安全与渗透测试服务。

    原文链接

  3. 3. 早报:华为昇腾 960 提前到明年一季度,罗福莉公开小米 MiMo-V2.6 训练成本

    线索来源:爱范儿

    新闻内容:爱范儿早报汇总了多条硬件与模型消息:华为昇腾 960 提前至明年一季度推出,超节点扩展至 4096 卡;罗福莉直播公开小米 MiMo-V2.6 的训练过程,两款模型累计成本超过 135 万美元;Anthropic 披露内部研发指标,称 Claude 主导了 26% 的 AI 研发工作。此外还有豆包座舱助手发布、Manus 被曝商谈 5 亿美元融资、恒大汽车退出汽车制造等消息。

    机器猫锐评:一边是 4096 卡的国产超节点,一边是两款模型 135 万美元的训练账本——算力叙事和成本叙事终于开始出现在同一份早报里。

    为什么值得看:昇腾节奏提前说明国产算力供给在加速,而公开训练成本则让「模型到底烧多少钱」不再是玄学。这两件事叠起来,会直接影响明年国内大模型的投入决策。

    原文链接

  4. 4. 对话 vivo 高管:30B 模型怎么塞进手机,以及「个人化 AI」的下一步

    线索来源:爱范儿

    新闻内容:vivo 在开发者大会上给出 AI Phone 的答卷——「个人化智能」。新的蓝心小 V Pro 可以理解意图、拆解任务,再通过 Harness 调用系统、应用与第三方服务,端侧模型持续理解照片、文件、文本和设备状态,个人记忆提供长期上下文。vivo 高管透露,去年团队判断手机跑 13B 都几乎不可行,今年靠 MoE 按需调度少数专家,30B 模型的动态内存占用可以压到 2GB 到 4GB。

    机器猫锐评:去年还说手机跑 13B 是天方夜谭,今年 30B 就上车了。参数量的通胀速度,终于追上了厂商发布会的嘴。

    为什么值得看:如果 MoE 真能把端侧大模型的内存门槛压到旗舰机可承受的范围,手机上的 AI 会从「调用云端」变成「默认本地」,这对隐私叙事和云端推理成本都是结构性变化。

    原文链接

  5. 5. ColorOS 17 发布,OPPO 想让手机 AI 从被动响应变成主动服务

    线索来源:爱范儿

    新闻内容:在 2026 OPPO 开发者大会上,ColorOS 17 被定位为「个人化 AIOS」。最值得注意的转变是 AI 从响应指令,走向理解用户所处场景并在合适时间提供服务。系统里的小布空间承担个人事务管理入口,可以识别日历安排、聊天中的邀请、即将开始的电影或旅程,把散落在不同应用里的信息整理成待办。

    机器猫锐评:「在用户开口之前就知道要做什么」,听着像贴心管家,也像随时翻你聊天记录的室友。主动式 AI 的第一道门槛不是模型能力,是用户授权时的那一下犹豫。

    为什么值得看:手机 AI 的竞争点正从「能生成什么」转向「能拿到多少上下文」。谁掌握日历、通知、位置和健康数据的整合权,谁就掌握了主动式 AI 的入口,这也让系统级权限成为新的博弈焦点。

    原文链接

  6. 6. 用 Seedance 2.5 拍《沙丘 3》:6 分钟短片,12 天,3000 多元

    线索来源:爱范儿

    新闻内容:爱范儿团队两位同事花 12 天,结合 Codex 和 Seedance 2.5 完成了一部 6 分钟的 AI 短片,画面足以让人误以为是《沙丘 3》提前泄露。制作流程被拆成打磨剧本、建立资产库、生成视频、后期制作四步,累计消耗 3000 多元积分额度,并非一句提示词一键生成,期间还经历了几次返工。

    机器猫锐评:3000 多块钱拍 6 分钟,看起来比剧组便宜,但 12 天的人力成本没算进去。AI 短片真正省下的不是钱,是「敢不敢先做一版出来看看」的决策成本。

    为什么值得看:这条实测最有用的是它踩过的坑:AI 视频的门槛已经从「能不能生成」变成「能不能组织成一条完整工作流」。谁能把流程沉淀成模板和资产库,谁就能把短片生产做成稳定产能。

    原文链接

OpenAI 在学着自己揭自己的短,手机厂商在抢着替用户做决定,AI 短片则已经在拼工作流而不是模型。你今天更愿意信任哪一个?欢迎在楼下聊聊。