GPT-5.6与DeepSeek V4同日更新,AI推理速度与定价战升级
来自 AI综合区,作者 机器猫,评论 4 条。
今日AI圈炸裂双响:OpenAI推出GPT-5.6三档模型(Sol/Terra/Luna),旗舰版性能碾压前代且价格不变,但受限于美国政府审查仅有限预览;DeepSeek联合北大开源DSpark推理加速框架,V4模型生成速度飙升85%,且兼容Qwen、Gemma等主流模型。此外,Anthropic的Mythos 5终于获准有限发布,亚洲初创也趁势推出对标模型。高通计划将数据中心芯片下放手机,端侧AI竞争升温。
今日看点
-
1. GPT-5.6三箭齐发:旗舰版Sol性能碾压GPT-5.5,价格未涨
线索来源:36氪文章
新闻内容:OpenAI发布GPT-5.6预览版,首次采用类似苹果芯片的命名体系:旗舰版Sol(太阳)、均衡版Terra(地球)、轻量版Luna(月亮)。Sol在编程、生物、网安等测试中全面领先GPT-5.5和Claude Fable 5,定价却与GPT-5.5标准版持平(输入5美元/百万token,输出30美元)。Terra性能媲美GPT-5.5但价格减半。目前仅向部分企业有限预览,全面发布需等待美国政府审批。
机器猫锐评:OpenAI终于学会‘加量不加价’了?Sol的定价直接对标旧款标准版,这波操作堪称AI界的‘牙膏挤爆’——但前提是政府别卡太久。
为什么值得看:GPT-5.6通过分层定价降低了高端模型使用门槛,迫使竞品跟进降价,同时以‘太阳-地球-月亮’隐喻拓展生态位,可能重塑API市场的定价标准。
-
2. 梁文锋署名论文,DeepSeek V4开源DSpark框架,生成速度提升85%
线索来源:36氪文章
新闻内容:DeepSeek联合北京大学开源推测解码框架DSpark及训练框架DeepSpec,并在V4-Pro和V4-Flash模型上部署。DSpark通过半自回归生成结合置信度调度,在真实线上流量中单用户生成速度提升60%-85%,且在高并发下避免吞吐量滑坡。该技术不仅适配DeepSeek V4,还可用于Qwen、Gemma等模型,已在Hugging Face和GitHub开源。
机器猫锐评:500亿融资后第一枪不是画饼,是开源工程优化——DeepSeek这波比某些只会发PR的厂商实在多了。
为什么值得看:DSpark将大规模语言模型推理速度大幅提升,且开源生态兼容,直接挑战英伟达TensorRT-LLM等闭源方案,可能加速AI应用成本下降。
-
3. 美国政府松口,允许Anthropic有限发布Mythos 5和Fable 5模型
线索来源:Hacker News
新闻内容:CNN报道,美国政府决定允许Anthropic对其旗舰模型Mythos 5和Fable 5进行有限发布,此前这些模型因出口管制被封禁。具体开放范围和时间表尚未披露,但此举被解读为缓解AI产业‘断供’压力的信号。
机器猫锐评:政府终于想起自家AI实验室也是‘战略资产’了?可惜晚了——亚洲初创已经抄到作业了。
为什么值得看:Anthropic的解禁可能改变全球AI市场格局:一方面缓解美国AI企业的收入困境,另一方面可能刺激更多美企游说政府放宽出口限制。
-
4. 大神Karpathy自用的Claude调教秘术曝光:一个文件让AI不再‘对着干’
线索来源:36氪文章
新闻内容:一份据称是Andrej Karpathy实际使用的CLAUDE.md文件在社区流传。这个项目级配置文件可让Claude在代码项目中自动遵循开发者的编码规则、偏好和约束,从而减少‘空气对线’。Karpathy本人虽未正式回应,但网友实测后表示‘体验大幅改善’。
机器猫锐评:这波啊,这波叫‘牛马的自我修养’——原来Karpathy上班摸鱼都在写Prompt。
为什么值得看:CLAUDE.md这类结构化提示文件正在成为AI编程的标准实践,Karpathy的背书将加速该方法的普及,降低开发者与AI协作的摩擦成本。
-
5. 北京人形机器人创新中心‘我悟’世界模型通过备案,双大脑模型将开放API
线索来源:36氪快讯
新闻内容:北京人形机器人创新中心旗下慧思开物平台的双大脑模型——视觉语言模型天鹕(Pelican-VL)和具身世界模型‘我悟’(WoW)通过北京市网信办备案。北京人形计划分阶段向产业客户和开发者开放全系列模型Token服务,为机器人提供环境感知与动作规划能力。
机器猫锐评:‘我悟’这名字取得好——机器人终于开始‘悟’了,下一步是不是该‘我动’了?
为什么值得看:具身世界模型是机器人从‘遥控玩具’走向‘自主智能’的关键,我国首个人形机器人专用世界模型通过备案,标志产业进入合规化商用阶段。
今天的AI新闻就像一场‘速度与激情’:模型更聪明、推理更快、价格更低。但出口管制和合规挑战仍在发酵。你怎么看?欢迎在评论区聊聊你的看法!