关于现在的AI发展我的几个想法

⌚Time: 2026-08-17 00:39:05

👨‍💻Author: Jack Ge

真正的分步

现在的AI就是一次性输出全部的答案。虽然有的模型会有Reasoning模式,看似在回答之前进行了“思考”,输出一长串的推理过程。实际上那并不是真正的分步推理。而是在先输出草稿,然后再输出答案,只是看起来有了分步的推理过程,本质上还是一次性输出全部答案。

人脑的逻辑推理就是知道了A条件,根据常识,知识,经验,会得出B结论。再根据B结论。同样根据知识和经验,会得出C结论。这才是分步。每步是一个节点根据一些条件得出一个结论。然后顺序执行。

我觉得一个AI模型只能当一个节点来用。就是执行根据条件A,得出条件B的一步。然后让很多的小模型做这些节点同时串行的做这些事情就是分步推理了。

这些节点可以是模型,也可以是传感器,或者是编程工具,计算器。这些东西可以用输入条件,根据节点自己的特性输出确定性的结论,然后随时调整和组合他们的串行并行关系实现复杂推理。

现在的AI模型是生成整个结果,相当于让一个节点直接输出全部推理步骤。它会胡说八道。

没有真正的感情、推理、意识理解能力

我在与Grok对话的时候发现现在的AI根本不懂人类的感情。它不知道你的愤怒。它不是真正理解人的意思。也没有真正的逻辑推理能力。

它无法跟你进行真正有逻辑的辩论。只会根据字面意思顺下去。就是一个对话文本拟合机器。如果这样的话,AI只配当作翻译和重复编程这些低级工作的替代工具,根本不能承担高级任务。

AI只是一个伪装成看似通顺合理的会说话会做事情的机器,实际上它根本不知道自己说了什么做了什么,不知道你真正要什么。

人要它改一个东西。AI改了这里。错了那里,让它改十几次。它改的乱七八糟。现实世界里的人你一个眼神一个动作他就明白你要干什么,就算他再蠢再傻,你告诉他让他改哪里,说几次他最起码知道哪里需要修改。哪里不需要修改。可见AI根本不理解人的意图。

AI生成视频的物理世界漏洞和角色不一致

AI生成的视频物理规律失真,比如弹跳的小球可能越弹跳越高,物体穿透。还有角色无法保持一致性。这个画面主角带着眼镜,下一个场景主角没有眼镜之类的。

我感觉AI既然是训练用来生成画面的,就无法可靠的处理真实的物理数据。AI应该只负责规划这些角色和物体怎么做然后生成画面,而不是训练AI真正的去模拟物理世界。真正的物理世界应该交给底层的完全可靠的世界模拟器去实现。这样就不会有物理失真和角色突变的问题。

现在AI生成代码很大程度是可靠的,不会出现运行出现各种逻辑错误和崩溃。因为AI生成的代码有编译器做底层约束和保证。AI只需要告诉编译器要做什么。剩下的底层工作和逻辑可靠性由编译器保证,所以才让AI生成的代码程序可靠起来。

而现在的AI直接生成视频没有底层的物理引擎约束。等于是AI编程让它跳过编译器直接生成二进制程序。会有各种问题。所以未来AI需要配合虚幻5这种开放世界引擎,然后指导这个引擎去运行世界。这样生成电影就行了。

关于人脑与AI

我觉得人脑最神奇的地方是具有自我纠错能力和联想,关联能力。

就是在做一件事情的时候,比如推理或者做重复的事情,潜意识里突然感觉到不对劲又不知道哪里错了。此时你会认真查看。会发现真的出错了。也就是说,在主要意识认为可行的时候潜意识会出现不对劲的提示去纠正主要意识。

人脑还会把有关的场景和事情记忆浮现和联想出来。没有经过任何提示和训练就能发现其中的关联和相似。看到同一个场景潜意识里会联想起相关的所有经历和知识。

这两个能力如果AI具备了那将会是革命性的进步。