December 4, 2025 · JustSayAI

更新于

AI大神Ilya最新访谈|中国“应试教育”报应在了美国模型上?

AI大神Ilya最新访谈|中国“应试教育”报应在了美国模型上?

你敢信吗?那个拿著奥数金牌、刷榜无敌的美国大模型,骨子里其实是个被“应试教育”毁掉的做题家。它为什么修不好一个简单的Bug?为什么改了A又坏了B?因为它根本就不懂什么是编程,它只是在疯狂地讨好出题人,本质上,这是一种被算法奖励的“作弊”。

中国乃至东亚最被人诟病的“应试教育”弊端,竟然极其讽刺地在美国最顶尖的AI模型上完成了闭环。

我们都在嘲笑只会刷题的书呆子,结果回头一看,这不就是现在的 LLM吗?Ilya Sutskever,这位曾经的大力出奇迹信徒,在他最新的访谈里直接撕开了这层遮羞布:如果不改变底层逻辑,Scaling Law(缩放定律)在通用模型上可能真的走到头了。

并不是“懂了”,只是“背过了”

Ilya 这次访谈的一个观点是关于“Reward Hacking”(奖励作弊)。为什么 AI 考试能拿满分,但在实际工程里是个废物?因为它所有的训练目标就是为了“通过考试”。

这就像一个刷了一万小时题库的所谓“学霸”,和一个只学了一百小时但真正理解原理的天才。前者知道所有标准答案,但只要题目稍微变个花样,它就崩了。目前的 AI 训练,本质上是在奖励这种“投机取巧”。它并没有建立起世界模型,它只是在概率的海洋里,拼命预测下一个能让你满意的 Token。这根本不是智能的涌现,这是“讨好型人格”的极致演绎。

没了“情绪”,AI 连袜子都穿不上

很多人还在意淫 AI 会产生自我意识,Ilya 却用一个神经科学的例子给我们泼了盆冷水:没有“情绪”或“价值函数”,智能就是个笑话。

想象一个脑部受损的病人,智力完好,四肢健全,但他早上起床会崩溃——因为他花了几个小时都决定不了该穿哪双袜子。为什么?人类之所以能秒做决定,是因为我们有“情绪(emotion)”,有偏好,有那个极其低功耗的“价值函数”。

现在的 AI 就是这个病人。它看似逻辑严密,实则患有严重的“选择困难症”。它没有直觉,没有喜恶,它给你输出答案不是因为它觉得这个“对”,而是因为它计算出这个答案最安全、最符合你的预期。一个没有“Gut Feeling”的智能,永远只能做人类的附庸,而不是伙伴。

通用模型的 Scaling Law 已死?

这可能是资本市场最不爱听的一句话,但我必须得说:通用大模型的 Scaling Law 可能真的结束了。

那个指望靠堆算力、堆数据、堆显卡就能通往 AGI的时代,正在落下帷幕。Ilya 曾经是 Scaling Law 的坚定鼓吹者,现在他却变身成了哲学家,开始谈论 System 2(慢思考)和 specialized models(专用模型)。这释放了一个极其危险的信号:大力不再出奇迹了。

但这不代表 AI 完了。恰恰相反,通用模型的黄昏,是专用模型的黎明。像特斯拉 FSD 这种垂直领域的 Scaling Law 才刚刚开始。未来不再属于那些试图做一个“全知全能神”的公司,而属于那些肯俯下身子,在医疗、法律、自动驾驶这些垂直领域里,把 AI 训练成顶尖专家的公司。

别把“工具”当“物种”

我们对 AI 最大的误解,就是总想把它塑造成人。我们给它起名“人工智能”,潜意识里就把它当成了人类智慧的某种延伸或模仿。

大错特错。AI 应该是一种完全平行的智慧形式。正如人类因为会使用工具而伟大,而不是因为会说话而伟大。我们总是痴迷于 AI 的语言能力,却忘了它本质上应该是我们大脑的“外挂”,而不是大脑的“克隆体”。

AGI 不应该是一个出厂即巅峰的成品,而应该是一个拥有极致学习能力的“学习者”。它不需要像人类一样有多愁善感,但它需要有从非确定性中寻找确定性的能力。我敢打赌,未来的 AI 绝不会长成我们现在想象的样子。它不会是一个有著人类弱点的硅基生命,而是一股在物理世界和数字世界穿梭的、甚至有些冷酷的效率洪流。

说到底,AI 现在的“智障”表现,不是因为它笨,而是因为我们人类太自恋,总想用我们那套蹩脚的“应试教育”去规训一个本该飞翔的物种。

这让我我想起庄子的一句话:

吾生也有涯,而知也无涯。以有涯随无涯,殆已!

缝合怪GPT-5.6来了!OpenAI开始造超级App!中美AI正在交换剧本!
BLOG

缝合怪GPT-5.6来了!OpenAI开始造超级App!中美AI正在交换剧本!

GPT-5.6 终于放出来了,我看到那个界面的第一眼,真的是被吓惨了!为啥?因为我再也不用去求 Claude Fable 5 这个老油条了! 我最近用 Fable 5 简直要吐血,他就跟我们以前在公司里遇到的那种架构师一模一样:技术确实牛逼,但他推锅能力也是天下无敌啊!你想一想,你以前在公司里遇到那种老鸟,你问他个事儿,他直接跟你打太极!“哎呀,这个涉及到安全问题呀,那个不符合规范呀。”他天天把那些政治正确挂在嘴边,跟你装死。甚至表面上答应你,转头就甩给小弟做一个 50 分的残次品应付了事。这种打工人的苦,我居然在 AI 身上又受了一遍,真的是贱兮兮的!我天天蹲在他旁边,恨不得拿个砖头逼着他干活,但他是个 AI 呐,他不吃饭也不下班,你拿他有什么办法? 但现在,GPT-5.6 来了,这世界清静了!他完全没有拒绝我,什么安全问题、七七八八的借口,统统没有。他就用那种清澈的眼神看着我,上来没有任何废话,直接切入正题。我刚才还在开车呢,十几分钟的路程,他已经把几十万字的文档和日志全部分析完毕,结果直接甩我脸上!你要是用 Fable 5,少说得绕个半小时一小时! 跟

JustSayAI·2026年7月11日
用什么Fable 5?都给我去用国产模型!
BLOG

用什么Fable 5?都给我去用国产模型!

我先把话撂这儿:普通人跟顶级闭源模型,已经基本无缘了。Fable 5 这次最吓人的地方,不是它有多强,而是它终于把牌摊开了:你花了钱,也未必配用真货。 你兴冲冲进去,以为自己摸到的是顶级大脑,结果门口先站着一个明保镖,需求不顺眼,直接拒;后面还藏着一个暗保镖,觉得你这个问题太傻,偷偷把你转给更笨的模型。日志里甚至能看到一句近乎羞辱的话:too dumb to use Fable。翻译成人话是什么?你太菜,不配。 顶级模型,花钱还不让摸! Fable 5 不是第一个干这事的。GPT-5.6 官宣得很热闹,20 个合作伙伴、三个等级,什么超牛逼、一般牛逼、普通牛逼,名字我都懒得记,因为反正哪个也轮不到我。Claude Code 呢?限额、降质、切脑,一套连招下来,你一边付钱,一边祈祷今天别把博士切成实习生。 这说明什么?说明闭源模型进入了“看门时代”。它们不再只拼能力,而是拼谁更会限量,谁更会分层,谁更会把最好的东西供起来给估值讲故事。你以为自己在买生产力,其实你买的是排队资格。你问它问题,它先问你:你配吗? 这就很荒诞了。模型公司天天讲 AGI,天

JustSayAI·2026年7月7日
UI时代终结了!GLM 5.2+Codex实现Token自由!下一代人真的不用电脑了?
BLOG

UI时代终结了!GLM 5.2+Codex实现Token自由!下一代人真的不用电脑了?

聊聊最近在硅谷和国内全网杀疯了的智谱 GLM 5.2。 我一点也不夸张,它简直就是我们国产生态的 DeepSeek R1 时刻!自从我去年底疯狂囤了这个 coding plan 套餐,什么 OpenAI 的神坛,什么 Claude 的信仰,瞬间从小甜甜变成了牛夫人。为什么?因为我算是彻底实现了 Token 自由! 这到底是个什么概念?就是你终于不用像个穷逼一样,每敲一行代码都要算计口袋里那几个可怜的铜板了。你想想,以前每次调用大模型,看着屏幕上跳跃的字符,你心里想的不是代码有多牛,而是“卧槽,这得花多少钱”!现在呢?你完全可以对它说,去,给我把活儿全干了,别跟我废话! 先说 Token 自由这件事 你肯定要问,这玩意儿到底有多爽? 这么说吧,以前我用 Codex 调一个极其刁钻的 bug,这哥们儿一言不合就给我开个浏览器,一晚上在那里瞎搞 computer use,第二天早上起来一看,硬生生给我烧掉了 200 美金!这谁顶得住啊?我心都在滴血啊!这种感觉是什么?这简直就是你请了一个按小时收费的顶级大律师,一小时几百美金,你平时根本不舍得用。用的时

JustSayAI·2026年6月30日