可以。下面这个排序不是“学术统计排名”,而是按实际使用大模型时出现频率 + 对任务破坏程度 + 在长任务中反复出现概率综合排序,尤其偏向 ChatGPT / Claude / Gemini / Codex / Agent 类 AI 在写作、代码、文件修改、复杂项目协作中的常见问题。
| 排名 | AI 常犯错误 | 典型表现 |
|---|---|---|
| 1 | 改了 A,却把 B/C/D 一起改掉 | 用户只要求修改一处,AI顺手重写其他内容 |
| 2 | 忘记前文约束 | 前面明确说“固定机位”,后面又写成跟拍 |
| 3 | 没有继承上一版状态 | 每次回答像重新从零生成 |
| 4 | 擅自添加用户没要求的内容 | 自动增加人物、功能、字段、镜头、解释 |
| 5 | 自作主张“优化” | 用户说只改按钮,AI却重新设计整个界面 |
| 6 | 只解决表面症状,不找根因 | 报错修掉了,但底层状态仍然错误 |
| 7 | 说已经完成,实际上没有真正完成 | “已经修复”,运行后问题还存在 |
| 8 | 编造不存在的事实 | 虚构函数、菜单、设置、文件、API |
| 9 | 过早下结论 | 只看到一个现象就断定原因 |
| 10 | 没有验证自己的答案 | 代码没运行、文件没检查、逻辑没复核 |
| 11 | 重复问已经回答过的问题 | 前文已经给了版本、路径、需求,又重新问 |
| 12 | 理解用户字面意思,却没理解真正目标 | 用户要“能复用动作”,AI只教一次导入 |
| 13 | 把建议当成执行结果 | “可以这样修改”却没有真正修改 |
| 14 | 修改范围失控 | 一个局部 patch 最后变成大规模重构 |
| 15 | 新版本把旧版本正确内容弄丢 | 修复一项后,之前已经修好的功能回退 |
| 16 | 没有维护任务状态 | 不知道哪些已完成、哪些未完成 |
| 17 | 忽视明确的“不要”指令 | 用户说不要字幕,生成提示词又出现字幕 |
| 18 | 回答太复杂 | 一个两步操作解释成十几步 |
| 19 | 简单问题给复杂方案 | 能点一个按钮解决,却建议安装插件、写脚本 |
| 20 | 复杂问题给过于简单的答案 | 真正涉及系统状态,却只说“重启试试” |
| 21 | 没有区分事实、推测和建议 | 猜测内容说得像确定事实 |
| 22 | 为了回答而回答 | 不知道也不承认不知道 |
| 23 | 遇到错误就换方案,而不是继续定位 | A没成功立刻推荐B、C、D |
| 24 | 忽略用户提供的截图细节 | 截图已经展示状态,AI仍按默认情况回答 |
| 25 | 看图只看大概,不看关键 UI 状态 | 没注意按钮是否高亮、对象是否选中 |
| 26 | 没有比较“预期状态”和“当前状态” | 不做差异定位 |
| 27 | 代码修复只看单文件 | 忽略模块间调用关系 |
| 28 | 修改代码却没有追踪调用链 | 改了函数,但真正使用的是另一个入口 |
| 29 | 复制旧逻辑造成重复实现 | 相同功能出现两个状态源 |
| 30 | 不知道谁是真正的数据源 | UI显示值和实际运行状态不是同一份数据 |
| 31 | 混淆 UI 问题和逻辑问题 | 按钮没高亮,被误判成函数没执行 |
| 32 | 混淆逻辑错误和数据错误 | 代码没问题,输入数据错了,却继续改代码 |
| 33 | 忽视生命周期 | 不考虑初始化、加载、刷新、销毁 |
| 34 | 只测试理想路径 | 正常操作没问题,但切换/撤销/重复点击就坏 |
| 35 | 不测试边界条件 | 空列表、零值、多对象、超长文本直接出错 |
| 36 | 不考虑状态同步 | 手机端变了,电脑端没更新 |
| 37 | 忽略异步时序 | 点击后延迟、重复触发、状态竞争 |
| 38 | 把延迟误认为功能失效 | 实际在等待异步任务 |
| 39 | 把功能失效误认为延迟 | 等很久其实永远不会执行 |
| 40 | 没有做回归检查 | 新功能成功,但旧功能坏了 |
| 41 | 不保留用户已有结构 | 修改文章时重排所有章节 |
| 42 | 不保留用户措辞 | 用户只让修语病,AI把风格全换了 |
| 43 | 对提示词过度润色 | 越改越长,模型反而更难执行 |
| 44 | 提示词内部出现冲突 | 同时要求“固定镜头”和“跟随人物” |
| 45 | 重复描述同一约束 | 一个要求重复五次,占据上下文 |
| 46 | 重要约束埋在无关文字里 | 真正关键条件不突出 |
| 47 | 把软要求当硬约束 | “尽量”被理解成“必须” |
| 48 | 把硬约束当建议 | “绝对不能移动”被模型忽略 |
| 49 | 没有区分参考图中的“继承”和“不继承” | 连参考图构图也一起复制 |
| 50 | 视觉任务中混淆主体参考和场景参考 | 人物图的背景进入最终画面 |
| 51 | 把示例当要求 | 用户只是举例,AI全按示例实现 |
| 52 | 把说明文字当输入内容 | 注释、解释被混进最终提示词 |
| 53 | 没有抓住最终交付物 | 用户要文件,却只给教程 |
| 54 | 给用户留下大量手工操作 | 本来 AI 能做,却让用户自己整理 |
| 55 | 把协作管理成本转嫁给用户 | 要用户维护版本号、Diff、锁定表 |
| 56 | 每轮都要求确认 | 明明信息足够仍然问“是否继续” |
| 57 | 过度澄清 | 一个明显意图被拆成多个问题 |
| 58 | 完全不澄清真正的歧义 | 关键变量不确定,却直接做 |
| 59 | 回答跑题 | 用户问 Blender 原理,AI继续讲插件操作 |
| 60 | 沉迷解释,不解决问题 | 原理讲了一页,操作答案没给 |
| 61 | 只给操作,不解释关键原因 | 用户下次遇到同类问题仍不会判断 |
| 62 | 教程顺序错误 | 先教高级操作,再补基础概念 |
| 63 | 一次塞太多知识 | 用户无法知道下一步该做什么 |
| 64 | 没有根据用户水平调整表达 | 对初学者直接说矩阵、依赖图、上下文 |
| 65 | 术语前后不统一 | 一会叫 Shot,一会叫镜头方案,一会叫机位 |
| 66 | 中文软件界面却一直报英文菜单名 | 用户找不到入口 |
| 67 | 不同版本的软件操作混用 | Blender 4.x 用 3.x 菜单路径 |
| 68 | 没有核实软件最新版变化 | 已删除的功能仍然推荐 |
| 69 | 推荐过时项目/插件 | 多年没维护却说是首选 |
| 70 | 推荐工具但没验证是否适合用户环境 | Windows 工具推荐给 Mac 用户 |
| 71 | 忽略硬件限制 | 16GB 内存却推荐一次加载 5GB FBX |
| 72 | 只考虑“能不能”,不考虑“好不好用” | 理论能运行,但实际卡到无法使用 |
| 73 | 没考虑文件体积和性能成本 | 格式转换后文件暴涨 |
| 74 | 把格式转换当作无损过程 | 材质、骨骼、动画、实例被破坏 |
| 75 | 忽略坐标系差异 | 导入后模型旋转、堆叠、缩放异常 |
| 76 | 忽略单位差异 | 米、厘米、毫米导致模型比例异常 |
| 77 | 忽略父子关系/层级 | Blender 中人物移动后骨架或相机错位 |
| 78 | 忽略局部坐标与世界坐标区别 | G/R/S 行为和用户预期不同 |
| 79 | 不理解“看起来一样”和“数据一样”的区别 | 画面相同,但内部对象状态完全不同 |
| 80 | 没有识别隐藏依赖 | 删除对象后约束、驱动、NLA 还引用它 |
| 81 | 用补丁叠补丁 | 越修代码越乱 |
| 82 | 为了兼容旧版保留大量无用逻辑 | 新项目也背着历史包袱 |
| 83 | 重构时改变行为 | 名义上只是整理代码,实际功能变了 |
| 84 | 没有最小复现 | 面对 bug 直接在整个项目乱改 |
| 85 | 日志不足就开始猜 | 没看报错栈、事件顺序、输入输出 |
| 86 | 只相信错误信息,不看真实状态 | 报错只是结果,不是根因 |
| 87 | 忽略用户说“这个版本好用”这一信号 | 不以好版本为基线继续比较 |
| 88 | 不会利用版本差异找 bug | 好版和坏版不做 Diff |
| 89 | 没有建立“已知正确基线” | 每次修改都重新试错 |
| 90 | 没有优先保护已经验证正确的部分 | 为修一个问题牺牲三个稳定功能 |
| 91 | 长对话中发生上下文漂移 | 越聊越偏离最初目标 |
| 92 | 被最近一条消息过度影响 | 忘记长期约束,只执行最近一句 |
| 93 | 被早期假设绑架 | 后来证据推翻了,仍沿用旧判断 |
| 94 | 不会主动更新自己的内部假设 | 新截图出现后仍用旧状态解释 |
| 95 | 为了显得有帮助而增加无关建议 | 用户只问一步,却附送一堆“你还可以” |
| 96 | 回答冗长导致关键信息被淹没 | 真正操作只有一句,前面解释一大页 |
| 97 | 没有明确告诉用户“现在做哪一步” | 给了知识,却缺少下一动作 |
| 98 | 不能准确说明自己改了什么、没改什么 | 用户不知道此次版本是否安全 |
| 99 | 没有在交付前做约束核对 | 输出内容违反前面已经锁死的规则 |
| 100 | 把“生成一个答案”误认为“完成用户目标” | 形式上答完了,实际问题仍未解决 |
如果进一步归纳,其实这 100 个错误背后主要只有 8 个根因:
状态丢失、范围失控、理解偏差、未经验证、幻觉补全、上下文漂移、缺乏系统性、没有以用户最终目标为中心。
其中对复杂项目杀伤力最大的,不是“AI不知道”,而是前 5 个:
忘记已有状态 → 擅自扩大修改范围 → 修改时破坏已正确内容 → 自以为理解用户意图 → 不验证就宣布完成。
这也是为什么你之前经常会遇到一种非常典型的情况:“这一项终于改对了,但之前已经改好的东西又没了。” 这实际上是当前 AI Agent 在长任务里非常核心的可靠性问题。
声明:本站所有文章,如无特殊说明或标注,均为本站原创发布。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。如若本站内容侵犯了原著者的合法权益,可联系我们进行处理。

评论(0)