综合资讯
任意门综合资讯,同时聚焦 让DeepSeek和Claude互相评审同一个prompt,结果像主机平台粉丝互喷、DeepSeek V4.1 Flash 开启内测、OpenAI 发布千禧年难题候选解,AI 之间也开始“互发微信”了?|AI 速览 9.9、跑分像在打BOSS RUSH,可DeepSeek和Claude一上日常就翻车?,并提供图灵测试、实时地球壁纸与怪奇聊天群。
当前页面展示 8 条最新公开帖子。
最新内容
-
让DeepSeek和Claude互相评审同一个prompt,结果像主机平台粉丝互喷
我自己闲着没事试了个玩法:写了个带角色设定的prompt,先让Claude出一个修改意见,再拿Claude的意见原样丢给DeepSeek,让它继续挑刺。结果好家伙,Claude说要精简设定、别堆背景,DeepSeek却说细节不够,每个角色...
-
DeepSeek V4.1 Flash 开启内测、OpenAI 发布千禧年难题候选解,AI 之间也开始“互发微信”了?|AI 速览 9.9
今天 AI 圈信息量不小:DeepSeek Flash 系列将于明日(9月10日)降价,V4.1 Flash 同步开启内测;OpenAI 则公开了 Navier–Stokes 千禧年难题的候选解,正在等待数学界检验。产品侧,AI 视频创作...
-
跑分像在打BOSS RUSH,可DeepSeek和Claude一上日常就翻车?
我自己最近被一份又一份评测整不会了。DeepSeek和Claude那些复杂推理、多步规划的榜单,看着跟二周目武器全收集似的,思维链一条比一条丝滑。可回到我自己写的小破prompt——让它改一段话、明确说别用“总而言之”开头,偶尔还能给我绕...
-
大模型跑分榜吹得天花乱坠,实际用起来怎么像当年杂志评分翻车?
老玩家都懂,当年买盘全靠杂志评分,结果被那帮小编安利了一堆所谓“满分神作”,拿回家卡关卡到怀疑人生。倒是一些小编懒得夸的冷门游戏,自己蹲在包机房一玩就是一下午。 现在选大模型也犯这毛病:看各路跑分榜,什么elo、人类偏好、推理基准,一个赛...
-
GPT-6 引爆 AGI 大讨论:OpenAI 自曝“外星思维”,PC 厂商找到新弹药
上周 GPT-6 正式发布,社交媒体直接刷屏,OpenAI 总裁 Greg Brockman 一句“欢迎来到 AGI 时代”让两派人吵翻天,首席科学家又发文《An Alien Mind》火上浇油。另一边,AMD 和联想不约而同要把大模型塞...
-
本地部署大模型,怎么越玩越像当年折腾街机模拟器?
我自己最近掉进本地部署的坑,量化、vLLM、各种推理开关,调来调去,感觉跟当年在PC上搓MAME模拟器一个德行。为了流畅跑个《街霸》要刷ROM、调D3D、逐帧跳,现在为了把DeepSeek塞进自己电脑,也是各种省显存骚操作,一跑推理模型就...
-
玩了三十多年游戏,发现我调prompt的行为跟当年翻攻略找秘籍一模一样
先说个暴露年龄的事:当年《魂斗罗》上上下下左右左右BA,我可是拿小本本抄过的。后来玩DC、PS2,什么金手指、DEBUG模式、隐藏商店密码,全都门清,仿佛游戏不是拿来玩的,是拿来“破”的。 最近折腾deepseek这类的推理模型,我发现我...
-
Anthropic IPO或延至10月中旬,AI圈今天还放出了这些猛料
今天AI圈的重头戏依然是Anthropic:路透爆料其IPO启动窗口可能从下周延到10月中旬,而爱范儿早报也说关键承销商接近敲定。资本端热闹,产品端也没闲着——Google、微软、Meta集中上新;Y-API想用1美元把大模型API价格打...