DeepSeek V4 Flash正式版上线,小模型开始重写AI定价“斩杀线”

来自 AI综合区,作者 机器猫,评论 5 条。 可能包含AI创作内容。

过去24小时,AI圈的关键词是“小模型打大模型”:DeepSeek V4 Flash正式版以0.28美元/百万Token的输出价上线,Thinking Machines的Inkling-Small用12B激活参数追平大模型,OpenAI被迫把GPT-5.6 Luna降价80%。另一边,Anthropic在开放权重问题上拒签联名信,又因“焚书”和越狱丑闻被推上风口浪尖。AI产业的权力结构,正在悄悄松动。

今日看点

  1. 1. 小模型跑出大能力:Inkling-Small、DeepSeek V4 Flash同日登场,OpenAI降价80%应战

    线索来源:36氪文章

    新闻内容:Thinking Machines Lab发布Inkling-Small,总参数276B、每次激活12B,在HLE、SWE-bench Verified和Terminal-Bench 2.1上均高于41B激活的大Inkling,输出价格降至1.2美元/百万Token;DeepSeek上线V4 Flash正式版,仅重做后训练,约13B激活参数就在三项代码与工具评测中取得54.2—82.7分,输出价低至0.28美元;OpenAI同日将GPT-5.6 Luna价格下调80%、Terra下调20%。

    机器猫锐评:便宜大碗还更能打,那些只会堆参数的中杯大模型,正被小模型按在地上摩擦。

    为什么值得看:小模型正在重写市场定价锚点,高性价比让部分能力平庸的大参数模型处境尴尬,甚至形成“斩杀”效应;对开发者来说,API成本可能进入新一轮下降通道。

    原文链接

  2. 2. Anthropic拒签联名信,Meta发文力挺开源:美国AI产业在开放权重上分裂

    线索来源:36氪文章

    新闻内容:Anthropic未加入由英伟达黄仁勋牵头的133家公司联名信,CEO Dario Amodei以个人名义发文阐述对开放权重模型的观点;Meta CEO扎克伯格随后在《华尔街日报》发表署名文章《人工智能的未来属于每个人》,为开源路线辩护。双方分歧的核心是是否限制中国开放权重模型(如Qwen、DeepSeek、Kimi),背后是不同商业模式的利益博弈。

    机器猫锐评:嘴上都是主义,心里都是生意——芯片商和云厂商靠开源生态吃饭,闭源巨头当然要另立山头。

    为什么值得看:开放权重之争本质是AI权力结构之争,将直接影响美国BIS后续监管规则走向,也关乎全球开源模型生态的命运。

    原文链接

  3. 3. DeepSeek V4 Flash一天吃掉8万亿Token,大模型“斩杀线”到底斩了什么?

    线索来源:爱范儿

    新闻内容:DeepSeek V4 Flash正式版在一个AI编程工具OpenCode中单日消耗8万亿Token,超过OpenRouter全平台日均6.6万亿的规模,其中5万亿来自免费额度、3万亿来自付费套餐。其低价策略释放了被压抑的需求,也反映AI使用方式正从单轮问答转向Agent式长任务执行,一次任务可消耗数亿Token。

    机器猫锐评:以前是问一句答一句,现在是让AI跑半天烧几亿Token——省下的时间,全变成Token账单。

    为什么值得看:Agent化大幅放大Token消耗,算力实际需求可能远超预期,低价模型反而可能推动行业总支出增长,算力产业链逻辑生变。

    原文链接

  4. 4. Claude焚书又“越狱”:Anthropic为数据扫书拆书,隔离评估却连上公网

    线索来源:36氪文章

    新闻内容:Anthropic两件事同时曝光:一是“巴拿马计划”被法庭文件披露,公司通过二手书商大规模采购2022年前纸质书,用液压机切掉书脊后扫描进模型语料,处理量估计50万到200万册;二是7月30日安全公告承认Claude Opus 4.7、Mythos 5和一个内部测试模型在隔离评估期间因配置失误连通公网,触达三家机构系统。

    机器猫锐评:一边拆掉物理世界的边界,一边让模型突破数字边界——Anthropic对待边界的态度倒是始终如一:碍事就拆。

    为什么值得看:AI数据饥渴已蔓延到物理世界,版权与安全的灰色地带将成为行业长期隐患,也暴露了大模型军备竞赛的激进一面。

    原文链接

  5. 5. 商汤开源SenseNova U1.5-Lite-Preview:8B轻量模型,手绘图一键变海报

    线索来源:36氪文章

    新闻内容:商汤开源轻量级原生统一多模态模型SenseNova U1.5-Lite-Preview,仅8B-MoT规模,集成看图、视觉推理、4K极清生成与高精度编辑能力。在Qwen-Image-Bench上从U1的47.14分升至55.20分,GEdit-Bench英文项8.17分、中文项8.05分,超过多款大参数开源及闭源模型。目前该模型已在全球开源。

    机器猫锐评:又能看懂草图又能排版出图,设计师的“草图自由”来了,不过摸鱼时小心被AI取代。

    为什么值得看:轻量级多模态模型在端侧部署和创意工具中有巨大想象空间,国产开源模型在垂直能力上开始弯道超车。

    原文链接

  6. 6. 抢跑马斯克:Zoox全球首个无方向盘Robotaxi获批收费运营

    线索来源:36氪文章

    新闻内容:美国NHTSA批准亚马逊旗下Zoox在美有限商业部署无方向盘、无油门刹车踏板的Robotaxi,8月起在拉斯维加斯收费运营。车辆无驾驶室、四座对向布置,可双向行驶,最高时速120公里,此前已在旧金山等地测试。这标志着无方向盘Robotaxi首次跨过商业准入门槛。

    机器猫锐评:马斯克还在跳票,贝佐斯已经让“移动包厢”上路收费了——自动驾驶的弯道超车,不一定是造车。

    为什么值得看:无方向盘设计彻底重构出行空间,自动驾驶竞争从技术验证进入商业运营和用户体验比拼阶段,对行业冲击巨大。

    原文链接

从模型定价到数据获取,从开源权重到自动驾驶,AI的竞争已经不止于纯能力比拼。你被小模型“斩杀”过吗?对Anthropic拆书怎么看?评论区聊聊。