麻省理工 54 人實驗:用 ChatGPT 寫完後,為什麼更難複述自己的文字?
麻省理工 54 人實驗:用 ChatGPT 寫完後,為什麼更難複述自己的文字?
這支 Shorts 引用一場關於 AI 工具的演講,以及麻省理工 54 人寫作實驗,指出問題不只是「有沒有使用工具」,而是中間的思考與判斷有沒有真正從自己腦中走過。影片說,ChatGPT 組收到的是整塊答案,連整理、拼接、判斷都可能被省掉,因此 83% 的人剛寫完就複述不出自己寫過的句子。相較之下,搜尋引擎組雖然也使用工具,但仍需判斷哪些資訊可用、把幾條資訊拼在一起,所以記憶與作品歸屬感介於純手寫組與 ChatGPT 組之間。影片進一步把這種現象比喻成肌肉荒廢:如果每天瑣碎的判斷、記憶、創造機會都被外包,等到遇到複雜事情時,能力可能已經不夠用。最後,影片主張 AI 不應只順著使用者生成答案,而應設計成會反問、挑錯、提供反面角度,讓最後的取捨仍由人自己完成。
真正的差異不是用不用工具,而是思考有沒有『過手』
00:41影片把三組寫作方式放在一起比較:ChatGPT 組、搜尋引擎組、完全不用工具組。搜尋引擎組雖然也借助工具,但仍要自己判斷哪條資訊可用,並把多條資訊拼在一起。
這個『拼』的過程,就是影片反覆強調的關鍵:資訊有沒有從自己的腦中走過。ChatGPT 組收到的是整塊答案,連拼接都可能省掉,因此剛寫完卻複述不出自己的句子。
人機協作效率提升可能同時帶來能力荒廢
01:23影片用身體訓練作比喻:以前人下地幹活,身體每天都會被使用;現在很多人不再做體力活,所以要刻意去健身房。
腦子也是一樣。如果每天那些瑣碎的判斷、記憶、創造機會都被工具接走,短期看像是省事,長期看可能讓判斷力、記憶與創造力缺少練習。
認知訓練好的 AI 不只是替你寫完,而是逼你重新判斷
02:23影片最後描述一個尚未完成的工具示範:使用者讀材料時,旁邊會出現提示,但那些提示不是替他把文章寫完,而是從反面挑毛病、換角度讓他再想一想。
影片要強調的是,工具有用不代表工具要替人做最後判斷。相反地,當使用者能對某個 AI 建議說『不』,代表這個建議反而真正促成了人的思考。
AI 產品設計差異不在你用不用工具,而在中間那一段有沒有從你腦子裡過一遍。
重點時間戳索引
- 00:00開場引用一位做 AI 工具、研究人機互動多年的研究者說法:人可能變成自己腦子的『中層幹部』,只在別人交下來的東西上簽字。
- 00:20影片提到麻省理工找 54 人寫論文,並指出 ChatGPT 組有 83% 的人剛寫完就複述不出自己的句子。
- 00:41實驗分成三組:用 ChatGPT、用搜尋引擎、完全不用工具;四個月寫四輪後,測記憶與作品歸屬感。
- 00:59搜尋引擎組的表現介於兩端之間,因為使用者仍要判斷資訊、拼接內容;這個『過手』過程讓資訊從腦中走過。
- 01:12ChatGPT 組收到的是整塊答案,省掉拼接與判斷,因此差異不在是否用工具,而在中間是否有思考過程。
- 01:23影片把動腦比喻成身體訓練:不用下地幹活後需要健身房,同樣地,腦子也需要被刻意使用。
- 01:41影片說這不是效率問題,而是能力可能被養廢;如果把動腦當成麻煩並完全交給工具,創造力、判斷與記憶會缺少日常練習。
- 01:57影片指出,個人可能覺得 AI 讓想法變多,但一群人一起看時,想法範圍反而可能更窄,像是大家都圍繞少數幾個想法打轉。
- 02:23結尾主張 AI 不應只順著使用者,而應能唱反調、挑毛病、換角度提示,讓使用者自己決定哪些建議要採納。
⚠️ 未確認 / 無法核對項目
- YouTube 無可用字幕;主文依 Whisper ASR 逐字稿整理。
- 片中提到的演講者姓名、論文題名與論文細節未在影片語音中明確說出,未另行補充外部資料。
- ASR 有少量簡中同音漂字,已在對照表標出;原始逐字稿保留在附錄供核對。
🎙️ ASR 漂字對照表
| 付出不出 / 付出不出來 | → | 複述不出 / 複述不出來 |
| 不是娘 | → | 不是你(疑似 ASR 漂字) |
| 開張 | → | 開張/開展(語境疑似『為機器人寫出的觀點做展開』,未確認) |
| 養肺 | → | 養廢 |
| 斷裂 | → | 鍛鍊(疑似 ASR 漂字) |
| 克拉拉 | → | Clara(人名,依發音推定) |
📎 原始內容(查證 / AI 追查用,非閱讀主文,點擊展開)
1 00:00:00,000 --> 00:00:01,540 朋友们,有个人在台上说 2 00:00:01,540 --> 00:00:02,620 他自己现在干的活 3 00:00:02,620 --> 00:00:04,400 就是给机器人写出来的观点开张 4 00:00:04,400 --> 00:00:05,300 而说这话的人 5 00:00:05,300 --> 00:00:06,560 自己就是造AI工具的 6 00:00:06,560 --> 00:00:08,260 他在微软研究院的剑桥实验室 7 00:00:08,260 --> 00:00:09,740 研究人怎么跟AI打交道 8 00:00:09,740 --> 00:00:10,600 研究了13年 9 00:00:10,600 --> 00:00:11,040 他说 10 00:00:11,040 --> 00:00:13,500 我们现在就像是自己脑子的中层干部 11 00:00:13,500 --> 00:00:14,300 虽然活还在干 12 00:00:14,300 --> 00:00:15,680 但真正动脑动手的内部 13 00:00:15,680 --> 00:00:16,380 已经不是娘 14 00:00:16,380 --> 00:00:18,780 你只负责在别人教下来的东西上签个字 15 00:00:18,780 --> 00:00:20,160 而这件事到底有多严重 16 00:00:20,160 --> 00:00:22,140 麻省理工还专门拿54个人测过 17 00:00:22,140 --> 00:00:22,800 他们这个实验 18 00:00:22,800 --> 00:00:23,860 我们在8月份还讲过一次 19 00:00:23,860 --> 00:00:24,680 当时讲的是 20 00:00:24,680 --> 00:00:25,640 用CHATGPT那组 21 00:00:25,640 --> 00:00:26,940 他们的大脑活动掉了多少 22 00:00:26,940 --> 00:00:27,940 但那份论文里面 23 00:00:27,940 --> 00:00:29,120 还有一个数字我们当时没讲 24 00:00:29,120 --> 00:00:30,480 就是用CHATGPT写的那组 25 00:00:30,480 --> 00:00:31,420 83%的人 26 00:00:31,420 --> 00:00:33,380 他付出不出自己刚写完的那些句子 27 00:00:33,380 --> 00:00:35,240 而且他们不是隔了几天想不起来 28 00:00:35,240 --> 00:00:35,940 是刚写完 29 00:00:35,940 --> 00:00:37,020 马上就付出不出来了 30 00:00:37,020 --> 00:00:39,200 我刚把这项演讲和那篇论文对着看了一遍 31 00:00:39,200 --> 00:00:40,540 最要命的是这三个地方 32 00:00:40,540 --> 00:00:41,360 先说第一个 33 00:00:41,360 --> 00:00:43,060 那个实验里面真正说明问题的 34 00:00:43,060 --> 00:00:44,160 其实是中间那一组 35 00:00:44,160 --> 00:00:45,860 麻省理工他找了54个人写论文 36 00:00:45,860 --> 00:00:47,580 每个人头上带着测脑电的设备 37 00:00:47,580 --> 00:00:48,240 分成了三组 38 00:00:48,240 --> 00:00:49,440 第一组用CHATGPT写 39 00:00:49,440 --> 00:00:50,920 第二组用搜索引擎查着写 40 00:00:50,920 --> 00:00:52,260 第三组什么工具都不用 41 00:00:52,260 --> 00:00:52,840 就靠自己 42 00:00:52,840 --> 00:00:54,400 他们在四个月里面写了四轮 43 00:00:54,400 --> 00:00:55,580 最后测两样东西 44 00:00:55,580 --> 00:00:57,220 一个是你还记不记得自己写了什么 45 00:00:57,220 --> 00:00:59,460 一个是这片东西你还认不认它是你写的 46 00:00:59,460 --> 00:01:00,860 结果用搜索引擎的那组 47 00:01:00,860 --> 00:01:01,900 两样都夹在中间 48 00:01:01,900 --> 00:01:03,200 比纯自己写的那组差 49 00:01:03,200 --> 00:01:04,960 但是比用CHATGPT写的那组好 50 00:01:04,960 --> 00:01:05,780 这是为什么呢 51 00:01:05,780 --> 00:01:06,720 因为用搜索的人 52 00:01:06,720 --> 00:01:08,140 还得自己判断哪条能用 53 00:01:08,140 --> 00:01:09,540 还得把几条信息拼到一块 54 00:01:09,540 --> 00:01:11,020 而这个拼的过程就是过手 55 00:01:11,020 --> 00:01:12,700 也就是从你的脑子里面过了一遍 56 00:01:12,700 --> 00:01:13,880 而用CHATGPT那组 57 00:01:13,880 --> 00:01:15,340 它的答案是整块递过来的 58 00:01:15,340 --> 00:01:16,300 你连拼都不用拼 59 00:01:16,300 --> 00:01:17,560 所以真正差在哪里 60 00:01:17,560 --> 00:01:18,580 不在意你用不用工具 61 00:01:18,580 --> 00:01:19,680 而在中间那一段 62 00:01:19,680 --> 00:01:21,480 有没有从你脑子里面过一遍 63 00:01:21,480 --> 00:01:23,080 在以前最难的是盯着一张白纸 64 00:01:23,080 --> 00:01:23,820 不知道写什么 65 00:01:23,820 --> 00:01:25,440 而现在最难的是盯着一页 66 00:01:25,440 --> 00:01:26,720 AI已经帮你填满的东西 67 00:01:26,720 --> 00:01:27,460 你要心里想 68 00:01:27,460 --> 00:01:28,320 我到底同不同意 69 00:01:28,320 --> 00:01:29,760 在播客里面他还答了个比方 70 00:01:29,760 --> 00:01:31,340 以前的人他得下地干活 71 00:01:31,340 --> 00:01:32,320 身体才天天用 72 00:01:32,320 --> 00:01:34,200 但现在很多人不用下地干活了 73 00:01:34,200 --> 00:01:35,600 所以我们才要专门去健身房 74 00:01:35,600 --> 00:01:36,780 而脑子其实也一样 75 00:01:36,780 --> 00:01:37,900 你以为自己在写 76 00:01:37,900 --> 00:01:38,920 其实那篇东西 77 00:01:38,920 --> 00:01:40,940 很多时候它只是从屏幕上过了一遍 78 00:01:40,940 --> 00:01:41,440 第二 79 00:01:41,440 --> 00:01:42,800 他说这不是效率问题 80 00:01:42,800 --> 00:01:44,060 是你的能力会被养肺 81 00:01:44,060 --> 00:01:45,520 这就好像我们发明了一种药 82 00:01:45,520 --> 00:01:46,540 专门用来替代断裂 83 00:01:46,540 --> 00:01:47,700 然后我们也在那纳闷 84 00:01:47,700 --> 00:01:49,180 为什么自己走两步就开始喘 85 00:01:49,180 --> 00:01:50,740 大家好像把动脑子这件事 86 00:01:50,740 --> 00:01:51,440 当成了一个麻烦 87 00:01:51,440 --> 00:01:52,560 得想办法解决掉 88 00:01:52,560 --> 00:01:54,260 而现在这个麻烦是被解决了 89 00:01:54,260 --> 00:01:55,020 但动脑子 90 00:01:55,020 --> 00:01:56,120 它从来就不是个麻烦 91 00:01:56,120 --> 00:01:57,720 它还补了几个特别反常识的 92 00:01:57,720 --> 00:01:58,580 你自己用AI 93 00:01:58,580 --> 00:01:59,880 会觉得自己的想法变多了 94 00:01:59,880 --> 00:02:01,340 但如果把一群人放到一起看 95 00:02:01,340 --> 00:02:02,880 用AI的那批人的想法范围 96 00:02:02,880 --> 00:02:03,640 反而更窄了 97 00:02:03,640 --> 00:02:04,660 他管这个叫风潮 98 00:02:04,660 --> 00:02:06,000 只是这个风潮特别无聊 99 00:02:06,000 --> 00:02:07,080 一群人翻来覆去 100 00:02:07,080 --> 00:02:07,900 就那五个想法 101 00:02:07,900 --> 00:02:09,300 而记性上也是一样的 102 00:02:09,300 --> 00:02:10,460 你读一份AI给你的摘要 103 00:02:10,460 --> 00:02:12,260 比你自己读原文件记得要更少 104 00:02:12,260 --> 00:02:13,840 他说这也不只是白领的事情 105 00:02:13,840 --> 00:02:14,700 你的创造力 106 00:02:14,700 --> 00:02:15,720 你会不会自己判断 107 00:02:15,720 --> 00:02:16,920 你的记性靠的就是 108 00:02:16,920 --> 00:02:18,440 每天那些琐碎的机会去练的 109 00:02:18,440 --> 00:02:19,500 而那些活你都不干了 110 00:02:19,500 --> 00:02:20,540 那肌肉就不在了 111 00:02:20,540 --> 00:02:22,000 而真等到你碰到了一件复杂的事情 112 00:02:22,000 --> 00:02:23,040 你已经没有力气了 113 00:02:23,040 --> 00:02:23,460 第三 114 00:02:23,460 --> 00:02:24,980 他说AI不应该顺着你 115 00:02:24,980 --> 00:02:26,060 应该专门给你唱反调 116 00:02:26,060 --> 00:02:27,640 他在台上还现场演示了一个 117 00:02:27,640 --> 00:02:28,480 没有做完的小工具 118 00:02:28,480 --> 00:02:29,680 里面有个叫克拉拉的人 119 00:02:29,680 --> 00:02:31,300 他在一家卖瓶装饮料的公司上班 120 00:02:31,300 --> 00:02:32,280 他们的行业里面 121 00:02:32,280 --> 00:02:33,680 出了一份关于环保包装的报告 122 00:02:33,680 --> 00:02:35,140 他的同事让他写一份提案 123 00:02:35,140 --> 00:02:36,620 说清楚公司该怎么应对 124 00:02:36,620 --> 00:02:37,780 而他把材料导进去 125 00:02:37,780 --> 00:02:39,620 这个屏幕上并没有直接给他一份总结 126 00:02:39,620 --> 00:02:40,800 他自己挑了一个角度 127 00:02:40,800 --> 00:02:41,700 一段段的往下读 128 00:02:41,700 --> 00:02:42,460 在读的时候 129 00:02:42,460 --> 00:02:43,700 旁边还会冒出一些提示 130 00:02:43,700 --> 00:02:45,720 那些提示不是帮他把这个话写完的 131 00:02:45,720 --> 00:02:46,880 而是反过来挑他的次 132 00:02:46,880 --> 00:02:48,300 换个角度让他再想一想 133 00:02:48,300 --> 00:02:49,700 其中有一条他觉得有道理 134 00:02:49,700 --> 00:02:50,400 就标记下来 135 00:02:50,400 --> 00:02:51,540 另一条他觉得没有必要 136 00:02:51,540 --> 00:02:52,240 就直接跳过 137 00:02:52,240 --> 00:02:53,780 所以这个判断是他自己做的 138 00:02:53,780 --> 00:02:54,960 不是那个工具做的 139 00:02:54,960 --> 00:02:55,200 他说 140 00:02:55,200 --> 00:02:56,840 如果你能有底气对一个建议说不 141 00:02:56,840 --> 00:02:58,300 那这个建议就算起作用了