AI书房

AI书房

用书来读懂AI

这里收录金京镇律师的AI、法律、产业、历史、政治、文化主题在线书。每本书都按目录、序言、章节、尾声整理,方便连续阅读。

AI與教室 cover

目錄

AI與教室

金京鎮

不給標準答案的人工智慧教師

本書從愛沙尼亞 AI Leap、Khanmigo、2 sigma 問題、答案外洩防線,到韓國 AI 數位教科書的分岔,追問 AI 如何保護學生思考,而不是取代學生思考。

蜘蛛網 cover

目錄

蜘蛛網

金京鎮

改變戰爭版圖的烏克蘭無人機革命

以2025年6月1日的蜘蛛網行動為軸,追蹤烏克蘭無人機如何穿透俄羅斯本土縱深,並改寫軍隊、情報與安全秩序。

中國機器人產業2026:量產與實戰的時代 封面

全25篇

中國機器人產業2026:量產與實戰的時代

金京鎮

從人形機器人量產競賽到美中霸權:2026年中國機器人產業的現狀. 目錄、序言、7部23章、結語

在深圳的一座工廠裡,數百台人形機器人重複著同一個動作。本書追蹤宇樹與優必選的量產競賽、Optimus供應鏈、實戰部署現場,以及在美中技術霸權之間韓國所處的位置。

跨越技術的青春期 封面

共 15 篇

跨越技術的青春期

金京鎮 律師

Dario Amodei 與 Anthropic,以及走向可控智能的殊死搏鬥. 目錄, 前言, 序幕, 第12章, 尾聲

一位失去父親的物理系學生,為了製造可控制的人工智能而展開的殊死搏鬥。講述 Dario Amodei 和 Anthropic 與 Pentagon 及白宮碰撞,並以擴展定律與憲法級 AI 震撼時代的故事。

Codex 37个具体使用案例 cover

书籍式阅读

Codex 37个具体使用案例

金京镇律师

从晨间简报到智能体群:37个真实工作自动化案例

这份指南汇集了37个把Codex和AI智能体接入真实工作的做法,覆盖个人事务、数据处理、营销、销售、文档、开发和浏览器控制。

分享

FacebookXLinkedInThreads
2026北京:两个巨人的危险之舞 封面

16篇公开

2026北京:两个巨人的危险之舞

金景珍律师

特朗普-习近平峰会,以及其中发生的事. 目录、序言、13章、结语

本书从霍尔木兹、稀土、台湾、波音、大豆、AI芯片这些场景,追踪特朗普的北京之行。

分享

FacebookXLinkedInThreads
把工作交给AI,然后离开座位 封面

27篇公开

把工作交给AI,然后离开座位

金京镇律师

YOLO模式完全入门. 目录和26章

一本面向初学者的在线书,讲解Claude Code和Codex中的YOLO模式。它说明如何让AI读取文件、编写代码、执行命令,并把回退、Docker沙盒和安全检查放在手边。

分享

FacebookXLinkedInThreads
《AI向人类提出的10个问题》封面

12篇文章

《AI向人类提出的10个问题》

金京镇

目录、序言、10章

《AI向人类提出的10个问题》是金京镇在AI书房公开的在线书。本书围绕AI责任、全球监视、人工智能武器、深度伪造、工作消失、能源、数据和人类身份,整理人工智能正在逼问人类的十个问题。

分享

FacebookXLinkedInThreads
《人工智能AI走上法庭》封面

26篇文章

《人工智能AI走上法庭》

金京镇律师

目录、序言、21章、3篇附录

《人工智能AI走上法庭》是金京镇律师在AI书房公开的在线书。本书从生成式AI训练数据、版权、声音克隆、深度伪造、自动驾驶、医疗和金融算法等争议出发,整理人工智能进入法院之后正在形成的法律前线。

分享

FacebookXLinkedInThreads
《人工智能与社会结构变迁》封面

16篇文章

《人工智能与社会结构变迁》

金京镇

目录、序言、13章、尾声

《人工智能与社会结构变迁》是金京镇在AI书房公开的在线书。本书从劳动、教育、不平等、城市、能源、网络安全、人际关系和民主制度出发,记录AI正在改写社会结构的过程。

分享

FacebookXLinkedInThreads
《2026年美国伊朗战争与全球能源危机》封面

39篇文章

《2026年美国伊朗战争与全球能源危机》

金京镇

目录、序章、36章、尾声

《2026年美国伊朗战争与全球能源危机》是金京镇在AI书房公开的在线书。本书从霍尔木兹海峡、海上保险、石油价格、液化天然气、粮食、美元秩序和韩国能源安全出发,追踪一场战争如何改变全球能源流动。

分享

FacebookXLinkedInThreads
《德米斯·哈萨比斯,谷歌人工智能之父》封面

34篇文章

《德米斯·哈萨比斯,谷歌人工智能之父》

金京镇

目录、序言、31章、尾声

《德米斯·哈萨比斯,谷歌人工智能之父》是金京镇在AI书房公开的在线书。本书沿着哈萨比斯从伦敦童年、国际象棋、游戏开发、脑科学、DeepMind、AlphaGo到AlphaFold的道路,记录人工智能如何进入科学发现的核心。

分享

FacebookXLinkedInThreads
Nano Banana Pro实战提示词手册 cover

24篇文章

Nano Banana Pro实战提示词手册

金京镇

6部、22章、课堂提示词附录

这本在线书围绕Nano Banana Pro的图像生成、编辑、文字渲染、角色一致性、工作场景和变现方法展开,方便课堂和实际工作直接使用。

分享

FacebookXLinkedInThreads
军事人工智能 cover

共17篇公开

军事人工智能

金京镇、金元泰

目录、序言、14章、尾声

一部系统梳理军事人工智能的长篇著作,涵盖自主武器、无人机、指挥控制、后勤、网络防御,以及美国、中国、以色列、韩国和全球国防AI企业的战略与实践。

分享

FacebookXLinkedInThreads
《读脑者:Neuralink与人类最后的革命》封面

21篇文章

《读脑者:Neuralink与人类最后的革命》

金京镇

目录、序章、18章、尾声

《读脑者:Neuralink与人类最后的革命》是金京镇在AI书房公开的在线书。本书追踪Neuralink、脑机接口、脑数据、医疗革命、神经权利和人类增强,记录人类大脑开始连接机器之后的法律与文明问题。

分享

FacebookXLinkedInThreads
《格鲁吉亚历史文化旅行》封面

24篇文章

《格鲁吉亚历史文化旅行》

金京镇

目录、序言、17章、4篇附录、尾声

《格鲁吉亚历史文化旅行》是金京镇在AI书房公开的在线书。本书从第比利斯、卡赫季、卡兹别克、高加索雪山、八千年葡萄酒、东正教、民主化、战争和旅行路线出发,记录格鲁吉亚的历史与现实。

分享

FacebookXLinkedInThreads
《一千个祈祷,一座山:读懂亚美尼亚》封面

13篇文章

《一千个祈祷,一座山:读懂亚美尼亚》

金京镇

目录、序言、10章、尾声

《一千个祈祷,一座山:读懂亚美尼亚》是金京镇在AI书房公开的在线书。本书从亚美尼亚高原、亚拉腊山、古代王国、世界第一个基督教国家、中世纪修道院、现代悲剧、离散社群和旅行指南出发,阅读亚美尼亚。

分享

FacebookXLinkedInThreads
从卖茶少年到总理 cover

共13篇公开

从卖茶少年到总理

金京镇

目录、序言、10章、尾声

一部政治传记,追踪纳伦德拉·莫迪从瓦德讷格尔卖茶少年、RSS组织者、古吉拉特邦首席部长到三任印度总理的轨迹,并由此理解现代印度、韩印关系与崛起大国的风险。

分享

FacebookXLinkedInThreads
《马来西亚:掌控马六甲海峡者掌控世界》封面

23篇文章

《马来西亚:掌控马六甲海峡者掌控世界》

金京镇

目录、序言、20章、尾声

《马来西亚:掌控马六甲海峡者掌控世界》是金京镇在AI书房公开的在线书。本书从马来半岛、马六甲王国、殖民地、联邦君主制、法律制度、城市旅行和产业结构出发,阅读马来西亚的地缘价值。

分享

FacebookXLinkedInThreads
《韩东勋留给韩国的那些痕迹》封面

13篇文章

《韩东勋留给韩国的那些痕迹》

金京镇

目录、12章

《韩东勋留给韩国的那些痕迹》是金京镇在AI书房公开的在线书。本书围绕韩东勋、韩国政治、法务部、检察改革、政治记录和受害者救济,整理他在韩国社会与国家制度中留下的公共足迹。

分享

FacebookXLinkedInThreads
《PALANTIR:战争、监视与人工智能》封面

16篇文章

《PALANTIR:战争、监视与人工智能》

金京镇律师

目录、序言、14章

《PALANTIR:战争、监视与人工智能》是金京镇律师在AI书房公开的在线书。本书从PayPal黑帮、9·11之后的情报失败、乌克兰战场、五角大楼改革和预测性治安出发,追踪数据公司如何进入国家安全与企业决策的核心。

分享

FacebookXLinkedInThreads
《韩东勋的故事》封面

39篇文章

《韩东勋的故事》

金京镇

目录、序章、36章、尾声

《韩东勋的故事》是金京镇在AI书房公开的在线书。本书从戒严之夜、检察官生涯、法务行政、政治选择、民生现场和个人面貌出发,记录韩东勋在韩国公共生活中的轨迹。

分享

FacebookXLinkedInThreads
人工智能选举 cover

14篇文章

人工智能选举

金京镇

目录、作者序、11章、结语

这本在线书写竞选信息、宣传材料、数字竞选、数据分析、团队运营、虚假信息防御、法律风险和可直接使用的提示词。

分享

FacebookXLinkedInThreads
《人工智能战斗机,人工智能空军》封面

43篇文章

《人工智能战斗机,人工智能空军》

金京镇

目录、序言、40章、尾声

《人工智能战斗机,人工智能空军》是金京镇在AI书房公开的在线书。本书围绕AI战斗机、无人作战飞机、CCA、MUM-T、第六代战斗机和未来空军,记录人工智能正在怎样改变空战、国防产业和军事伦理。

分享

FacebookXLinkedInThreads
山姆·奥特曼传:人工智能革命的开拓者 cover

22篇文章

山姆·奥特曼传:人工智能革命的开拓者

金京镇、金京兰

目录、序言、7部、20章

这本在线传记写山姆·奥特曼的成长、创业、Y Combinator、OpenAI、ChatGPT、董事会风波,以及他在人工智能时代承担的责任。

分享

FacebookXLinkedInThreads
关于北极航道的七个误解封面

10篇文章

关于北极航道的七个误解

金京镇

目录、序言、7章、尾声

金京镇AI书房在线图书,梳理关于北极航道的速度、定期航线、保险、安全规则、全年通航、碳减排和基础设施的七个常见误解。

分享

FacebookXLinkedInThreads
《世界各国在行政领域引入人工智能的案例》封面

25篇文章

《世界各国在行政领域引入人工智能的案例》

金京镇

目录、23章、尾声

金京镇AI书房在线图书,介绍公共部门AI导入、各国战略、行政服务、治理框架与未来政策课题。

分享

FacebookXLinkedInThreads
《Claude Cowork与智能体使用手册》封面

11篇文章

《Claude Cowork与智能体使用手册》

金京镇

目录、序言、8章、尾声

《Claude Cowork与智能体使用手册》是金京镇在AI书房公开的在线书。本书整理文件整理、财务数据、营销销售、研究、沟通、人事法务、软件开发和系统联动自动化场景。

分享

FacebookXLinkedInThreads
《Claude Code完全掌握》封面

41篇文章

《Claude Code完全掌握》

金京镇

目录、40章

《Claude Code完全掌握》是金京镇在AI书房公开的在线书。本书围绕Claude Code、智能体工作流、MCP、技能、部署、GitHub、自动化和商业化,整理把AI从聊天工具变成工作系统的方法。

分享

FacebookXLinkedInThreads
《黄仁勋的故事》封面

16篇文章

《黄仁勋的故事》

金京镇

目录、序言、13章、尾声

《黄仁勋的故事》是金京镇在AI书房公开的在线书。本书沿着黄仁勋的移民经历、NVIDIA创业、GPU革命、CUDA生态、AI工厂和物理AI,记录一位企业家如何站到人工智能产业的中心。

分享

FacebookXLinkedInThreads
法律实务与人工智能封面

16篇文章

法律实务与人工智能

金京镇

目录、序言、14部

金京镇AI书房在线图书,从律师实务角度整理法律检索、文书起草、证据分析、合同审查、NotebookLM以及生成式AI工作流程。

分享

FacebookXLinkedInThreads
您好,我是金京镇封面

10篇文章

您好,我是金京镇

金京镇

目录、序言、推荐语、6章、结语

金京镇AI书房在线图书。内容涵盖成长经历、科技议政活动、议员外交、立法斗争、东大门愿景以及韩国人口断崖的解决方案。

分享

FacebookXLinkedInThreads

[AI书房] 第8章 博士后与跨学科融合

德米斯·哈萨比斯,谷歌人工智能之父
Author
金京镇
Date
2026-05-06 11:11
Views
232

德米斯·哈萨比斯,谷歌人工智能之父

德米斯·哈萨比斯,谷歌人工智能之父

第8章 博士后与跨学科融合

金京镇

2009年一个傍晚,德米斯·哈萨比斯沿着美国马萨诸塞州剑桥市的查尔斯河畔散步,脑海中两个截然不同的世界正在碰撞。身后矗立着全球顶尖工科院校MIT,河对岸则是哈佛大学的红砖建筑群。这片地理景观恰如一个隐喻,精准映射出哈萨比斯当时所处的智识坐标。

他刚在伦敦大学学院(UCL)完成关于记忆与想象力的脑科学博士学位。换作一般科学家,到这里就该做选择了:成为研究大脑的生物学家,还是编写代码的计算机工程师?哈萨比斯两个都选了。

他决心在两个世界之间架起桥梁,横跨大西洋来到MIT的麦戈文脑研究所(McGovern Institute)。他找到的是托马索·波焦(Tomaso Poggio)教授的实验室。波焦教授是计算机视觉(Computer Vision)领域的宗师级人物,毕生致力于用数学模型描述人脑观看事物的方式。

哈萨比斯选择这里的原因很清楚。当时人工智能研究正经历被称为「冬天」的低迷期,但波焦教授的实验室是个例外。那里正积极尝试将生物大脑的原理转化为计算机算法。

哈萨比斯在这里找到了验证自己假说的完美环境:「理解大脑,就能创造智能。」这一时期,他获得了英国惠康信托基金会(Wellcome Trust)颁发的「亨利·惠康研究员奖」(Henry Wellcome Fellowship),这是一项相当特殊的资助。该奖学金赋予年轻科学家自由选择研究课题和研究地点的破格权限与预算。

得益于此,哈萨比斯无需依附于某位教授的项目,可以自主推进自己的宏大目标,为「通用人工智能(AGI)」进行基础设计。

他在MIT和哈佛之间自由穿行,与当代最杰出的学者们交流。他去哈佛的实验室分析最新的脑扫描数据,再回到MIT构思处理这些数据的机器学习模型。

在这个过程中,他注意到了生物大脑惊人的效率。人脑仅凭大约20瓦(W)的能耗,就能感知复杂世界、行走、对话、学习新事物。而当时的计算机消耗巨大电力,却连区分猫和狗都做不到。哈萨比斯确信,缩小这一差距的钥匙在于「计算神经科学(Computational Neuroscience)」。

这门学科将神经细胞传递信号的方式转写为数学公式。他探索了将大脑视觉皮层逐层处理信息的方式嫁接到深度学习(Deep Learning)技术上的可能性。MIT的氛围既充满激情又务实。

哈萨比斯在那里与研究员们讨论到深夜,不断打磨自己的想法。他对之前自己开发的游戏中人工智能所暴露的局限感触极深。游戏角色只在程序员预设的规则范围内显得聪明。

但哈萨比斯想要的,是即便被丢到陌生环境中也能自行领悟规则的真正智能。通过与波焦教授的合作研究,他认识到人脑处理视觉信息时呈现的「层级结构」正是答案之一。我们看东西时,大脑先识别简单的线条和颜色,再将它们组合成形状,最终形成「这是一辆汽车」这样的概念。

这种生物学上的层级秩序,日后成为DeepMind的人工智能仅凭屏幕像素(Pixel)就能征服打砖块游戏的技术基石。在美国的这段时间还给哈萨比斯留下了另一笔财富,那就是「野心的尺度」。在硅谷和波士顿的学术氛围中,他领悟到研究不能止步于写论文。

伟大的研究必须转化为改变世界的技术。他在那里毫不犹豫地对同伴们说:「我们要理解智能。」也许有人觉得他在吹牛。

但哈萨比斯的脑中,游戏开发者的经验、脑科学家的知识、机器学习这一工具,已经融合为一体。现在他带着全部素材准备返回故乡伦敦,启动人类历史上最大胆的创业。2010年,德米斯·哈萨比斯结束美国生活回到伦敦。

他的下一站是伦敦大学学院(UCL)的「盖茨比计算神经科学中心(Gatsby Computational Neuroscience Unit)」。普通大众或许对这个名字感到陌生,但对人工智能研究者而言,这里如同一座传奇圣地。该中心由后来获得诺贝尔物理学奖的杰弗里·辛顿(Geoffrey Hinton)教授主导创建,汇聚了全世界最聪明的数学头脑,共同破解人类智能的秘密。

哈萨比斯选择这里绝非偶然。他直觉感到,这是唯一能让「DeepMind」这颗种子生根发芽的土壤。他之所以能加入盖茨比中心,靠的正是前面提到的「亨利·惠康研究员奖」。

这笔资助不仅给了他财务自由,还保障了他自主决定研究方向的知识独立性。当时盖茨比中心由彼得·达扬(Peter Dayan)教授领导。达扬教授是理论神经科学大家,以数学方法阐明了大脑如何学习与处理奖赏(Reward)。

盖茨比中心是脑科学与机器学习熔于一炉的地方。那里的氛围异常紧张。研究人员不停地在生物脑实验数据与复杂概率统计之间来回穿梭。

哈萨比斯在这里遇到了老友、日后DeepMind的联合创始人谢恩·莱格(Shane Legg)。两人每到午饭时间就坐进学校附近的三明治店或酒吧(Pub),一聊就是几个小时。话题只有一个:「怎样才能造出人类水平的人工智能(AGI)?」当时在学术界,把AGI这个词挂在嘴边几乎是禁忌。

人工智能研究被困在只解决特定问题的狭义人工智能(Narrow AI)里,谈论像人一样的通用智能会被当成科幻小说。

但在盖茨比中心自由且追问根本的探索氛围里,哈萨比斯和莱格获得了打破禁忌的勇气。在盖茨比中心研究期间,哈萨比斯深入钻研了「系统神经科学(Systems Neuroscience)」。

这个领域不研究大脑的单个细胞,而是研究大脑作为一个整体系统如何整合信息、存储记忆、模拟未来。他聚焦于大脑「海马体(Hippocampus)」所扮演的角色。海马体在我们睡觉时,会像快速倒带一样重播(Replay)白天的经历,从而巩固记忆。

哈萨比斯认为这种生物学机制是大幅提升人工智能学习效率的关键。在这里的经历教会了哈萨比斯「混合(Hybrid)」的力量。在纯粹的脑科学家中间,他讲计算机算法的精确性;在机器学习工程师中间,他讲大脑的灵活性。

两个群体使用的语言不同,但归根结底在解同一个问题:「智能是什么?」在盖茨比中心的时光,是哈萨比斯创办DeepMind之前末尾的孵化期。

他在这里不仅吸收最新理论,还开始招募能把理论变成可运行代码的伙伴。盖茨比中心赠予他学术上的严谨(Rigour)。他学会了不依赖「大概行得通」的直觉,而是构建数学上可证明、生物学上站得住脚的模型。

这里奠定的理论基础,日后成为AlphaGo穿透围棋复杂性取得胜利的根基。2010年哈萨比斯创立DeepMind时,公司早期成员大多出身盖茨比中心或与之相关,绝非巧合。亨利·惠康研究员奖提供的时间与自由,加上盖茨比中心这一知识共同体,成为将青年哈萨比斯锻造为世界级AI领袖的决定性熔炉。伦敦阴沉的天空下,UCL的实验室却涌动着智识的热量。在这里遇到的彼得·达扬教授,对哈萨比斯而言如同一位能解答他长久困惑的

贤者。彼得·达扬是计算神经科学(Computational Neuroscience)的开拓者之一,用数学证明了人脑如何通过奖赏来学习。哈萨比斯与达扬的相遇,就像1980年代苹果公司乔布斯与沃兹尼亚克的碰面,不同天赋完美咬合的瞬间。

他们共同探索的核心课题是「强化学习(Reinforcement Learning)」。用通俗的话讲,强化学习类似训练小狗。小狗听到「坐下」的口令后坐下了,就给它零食。小狗便将「坐下」这个动作与「零食(奖赏)」联系起来,逐渐把这个动作做得更好。

哈萨比斯和达扬关心的是在生物学层面和计算机算法层面同时解释这一机制。彼得·达扬在1990年代中期重新定义了大脑中「多巴胺(Dopamine)」这种神经递质的作用。人们常把多巴胺当作「快感荷尔蒙」,但达扬和同事们揭示了多巴胺其实传递的是「奖赏预测误差(Reward Prediction Error)」信号。

这是什么意思?比方说你在自动售货机前投了币想买咖啡,结果什么也没出来。这时你的大脑从「期待咖啡」的状态撞上了「什么都没有」的结果。期望与实际结果之间的落差,就是「预测误差」。此时大脑的多巴胺神经元停止活动或急剧下降,发出「失望」信号。反过来,如果自动售货机掉出咖啡的同时莫名其妙弹出一张一万韩元纸币呢?因为奖赏远超预期,多巴胺神经元会爆发式地放电。这就是「正向预测误差」。

哈萨比斯为这一生物学发现与计算机科学中的「TD学习(Temporal Difference Learning)」算法精确吻合而震撼。计算机科学家为训练机器而设计出的数学公式,原来数亿年前就已在我们大脑中运行。这是一个重大发现。

它带来了一种确信:「造人工智能不需要发明外星科技,照着我们脑中现成的蓝图临摹就行。」

通过与达扬的合作,哈萨比斯看到的不是仅仅分类数据的AI,而是「自主行动并从结果中学习的AI」的可能性。当时大多数AI研究集中在看照片判断是猫还是狗的「监督学习(Supervised Learning)」上,也就是做有标准答案的题。但强化学习没有标准答案。

智能体(AI)通过与环境反复交互,经历数万次试错后自行摸索出策略。这和幼儿学走路的过程一模一样:摔倒、痛、爬起来,自己领悟平衡的诀窍。

这项研究给哈萨比斯提供了关于「通用性(Generality)」的重要线索。多巴胺系统在我们学骑自行车时、演奏乐器时、下围棋时,运作方式完全一样。换句话说,大脑中可能存在一种统管所有类型学习的统一算法。

哈萨比斯相信,只要能在计算机中实现这「一种算法」,这个AI就不只是会下棋,还能解开蛋白质结构,解决气候问题。在达扬实验室度过的时光,为DeepMind日后确立「打造通用学习算法」的创立使命奠定了决定性的理论基础。2013年,哈萨比斯与达扬合作中获得的洞察,凝结为DeepMind的第一件成果:「DQN(Deep Q-Network)」。

DQN是DeepMind扬名天下的契机,也是让谷歌以超过5000亿韩元巨资收购这家伦敦小型创业公司的关键技术。这项技术的核心灵感,出人意料地来自哈萨比斯博士期间研究的大脑「海马体(Hippocampus)」。DQN的目标是让AI玩1980年代的经典电子游戏「雅达利(Atari)」,水平超过人类。

但没有人告诉这个AI游戏规则。它只获得屏幕像素信息(视觉)和分数(奖赏)。一开始AI随机按按钮,做些莫名其妙的动作,但随着时间推移,它自行摸索出了得分方法。

这里有一个致命问题。计算机在学习连续游戏画面时,由于数据之间过于相似,

学习变得不稳定,甚至出现遗忘现象。这被称为「灾难性遗忘(Catastrophic Forgetting)」。面对这道难关,哈萨比斯拿出了脑科学家的知识储备。「人类是怎么一边学新东西,一边又不忘掉旧东西的?」

他注意到大脑海马体具有的「经验重播(Experience Replay)」功能。我们睡觉或休息时,大脑会以随机顺序、快速地重播白天经历的重要事件。就像备考时把重点内容打乱顺序反复复习。

通过这个过程,短期记忆被牢固地转存为长期记忆。哈萨比斯把这一生物学原理原样移植到了AI代码中。他让AI在玩游戏过程中经历的大量画面和体验不立即丢弃,而是存入一个叫「经验缓冲区(Experience Buffer)」的存储池。

学习时,AI不仅用当前经验,还从存储池中随机抽取过去的经验一起训练。这就是DQN的核心技术「经验回放(Experience Replay)」。效果立竿见影。

AI的学习变得异常稳定,性能爆发式提升。DQN在打砖块游戏(Breakout)中展现的表现是这样的:起初连球都接不住的AI,训练300轮后完美接球,超过500轮后,它自行发现了一种从未有人教过的「隧道(Tunneling)」策略。

它集中攻击砖墙的一端打出一个洞,再把球送到砖墙背后,让砖块自动崩塌。这是一种高级技巧。DeepMind的研究员大卫·西尔弗(David Silver)和同事们凌晨三点在显示器前目睹这一幕,目瞪口呆。那是机器展现创造力的瞬间。

通过与彼得·戴恩的研究确立的「奖励驱动学习」理论,与哈萨比斯从脑科学中引入的「记忆回放」机制相结合,由此诞生的DQN绝非一个普通的游戏AI。它是一个历史性事件,证明了生物智能的原理同样可以在硅芯片上运行。大脑中找到的线索,成为了AI算法中那块决定性的拼图。

这次成功给了哈萨比斯坚定的信念。「我们走在正确的道路上。」这份信念,正是日后在棋盘上震惊人类的AlphaGo诞生之前,那段宏大旅程的序幕。

对哈萨比斯而言,DQN是模仿人类大脑而创造的第一台「会思考的机器」的原型(Prototype)。生物神经元与人工神经元的结构对比

人工智能专家 金京镇律师

AI法律政策专家 · 前国会议员 · 著作等身

如果这本书曾在您身边短暂停留,请支持我们,让下一个故事得以问世。

(自愿赞助账户:农协 302-1096-0948-81 户名:金京镇)

金京镇

律师 · 前国会议员 · AI政策研究者

kimkj.com

© 2026 金京镇. All rights reserved.

#金京镇 #AI书房 #德米斯哈萨比斯 #DeepMind #GoogleDeepMind #AlphaGo #AlphaFold #人工智能 #科学AI
kimkj.com 首页
滚动至顶部
kimkj.com 首页