焦点精选!白天打工,晚上科研,谷歌大脑研究科学家破解了困扰数学界几十年的猜想
选自quantamagazine
作者:Kevin Hartnett机器之心编译编辑:蛋酱、小舟离开数学界七年后,一直从事 AI 领域工作的谷歌研究科学家 Justin Gilmer,却突破了研究生时期未曾获得进展的难题。
2022 年 10 月中旬,Justin Gilmer 从加利福尼亚飞往纽约,在东海岸拜访了他以前的导师 Michael Saks,一位罗格斯大学的数学家。
【资料图】
叙旧期间,他们并未谈及数学。事实上,自从 2015 年在罗格斯大学获得博士学位后,Gilmer 就再没认真思考过数学问题。那时候他决定不在学术界发展,同时开始自学编程。当他和 Saks 共同用餐时,Gilmer 向导师讲述了自己在谷歌的工作:机器学习和人工智能。
在校园的小路上,Gilmer 边走边回忆,2013 年,他花了一年多的时间走在这条路上,思考一个叫做「并封闭集猜想(又称Frankl猜想)」的问题。这一直是个没有结果的难题。Gilmer 所做的一切努力,只是成功地教会了自己,为什么这个关于数字集合的看似简单的问题会如此难以解决。
但在七年后的这次访问后,Gilmer 突然有了全新的灵感。他开始思考如何应用信息论来解决并封闭集猜想。经过一个月的研究后,通往证明的路径不断打开。11 月,他在 arXiv 上发布了研究结果,宣布在证明整个猜想方面取得了重大进展。
论文链接:https://arxiv.org/pdf/2211.09055.pdf
这篇论文掀起了后续研究的热潮。牛津大学、麻省理工学院和高等研究院等机构的数学家们迅速在 Gilmer 的新方法基础上开展工作。
什么是并封闭集猜想?
并封闭集猜想与数的集合相关,如 {1,2} 和 {2,3,4}。你可以对集合进行运算,包括取它们的并集,也就是合并它们。例如,{1,2} 和 {2,3,4} 的并集是 {1,2,3,4}。
如果该族中任何两个集合的并集等于族中任何现有的集合,这个集合或族被认为是「并集封闭」的。例如,考虑这个由四个集合组成的族:{1}, {1, 2}, {2, 3, 4}, {1, 2, 3, 4}。
将任何一对组合起来,你就会得到一个已经在族中存在的集合,所以说这个族是并封闭集的。
数学家们早在 20 世纪 60 年代就讨论过并封闭集猜想,但直到 1979 年它才得到了第一次正式陈述,是在 Péter Frankl 的一篇论文中,他是一位匈牙利数学家,80 年代移民到日本,除了数学还热爱街头表演。
Frankl 猜想,如果一个集合的族是并封闭集的,那么它必须至少有一个元素(或数字)出现在至少一半的集合中。这是一个自然存在的阈值,原因有二。
Justin Gilmer
首先,在现成的并封闭集族的例子中,其中所有元素正好出现在 50% 的集合中。比如说,你可以用数字 1 到 10 组成所有不同的集合,总共会有 1024 个这样的集合。它们构成了一个并封闭集族,10 个元素中的每一个都出现在其中的 512 个集合。
在 Frankl 提出这个猜想的时候,还没有人提出过一个猜想不成立的并封闭集族的例子。所以 50% 似乎是正确的预测。
这并不意味着它很容易被证明。在 Gilmer 的工作之前,很多论文只能设法建立了随族中集合数量变化的阈值(而不是对所有大小的集合族都是相同的 50% 阈值)。
哥伦比亚大学的 Will Sawin 说:「感觉它应该很容易,而且它与很多容易的问题相似,但它一直未被攻克。」
缺乏进展既反映了这个问题的棘手性质,也反映了许多数学家宁愿不去想它。他们担心自己会浪费多年的职业生涯,去追逐一个不可能解决的问题。Gilmer 记得 2013 年的一天,他去 Saks 的办公室提到这个并封闭集猜想,这些也曾经与这个问题搏斗过的导师把他赶出了房间。
不确定性的洞察
在访问罗格斯大学之后,Gilmer 的脑海中滚动着这个问题,试图理解为什么它是如此困难。他用一个基本事实提示自己:如果你有一个由 100 个集组合组成的族,有 4950 种不同的方式来选择二者并将他们结合起来。然后他想:如果没有任何元素至少以某种频率出现在这些结合中,那么 4950 种不同的结合又怎么可能映射到 100 个集合呢?
在这一点上,他已经在通往破解的路上了,尽管他还不自知。
信息论在 20 世纪上半叶得到发展,其中最著名的是 Claude Shannon 1948 年的论文《通信的数学理论》。这篇论文提供了一种精确的方法来计算发送信息所需的信息量,基于围绕着信息表达内容的不确定性的大小。这种信息和不确定性之间的关联,正是香农的卓越见解。
信息论经常出现在组合学中,这是一个与计数对象有关的数学领域,这也是 Gilmer 在研究生时期研究的内容。但当他飞回加州的家中时,他还担心将信息论与并封闭集猜想联系起来的方式是一个业余者的天真见解。
「说实话,我有点惊讶之前没有人想到这个,」Gilmer 表示。「但也许我不应该感到惊讶,因为我自己也想了一年,而且我是懂信息论的。」
探索难题
Gilmer 对数学的钻研来源于自己对数学的热爱。他工作日主要忙于谷歌的日常工作,闲暇时间就潜心研究数学问题。上班时他也带着一本数学教科书,以便随时查找忘记的公式。Gilmer 脚踏实地,也仰望星空 —— 他喜欢看著名数学家 Tim Gowers 的博客,这会让他备受鼓舞。
Gilmer 谦虚地说道:「也许你认为解决数学难题的人不应该查阅《Elements of Information Theory(信息论基础)》第 2 章,但我查阅了。」
Gilmer 提出的方法是设想一个并封闭集族,其中任何元素在所有集合中出现的概率都小于 1%。这是一个反例,如果它真的存在,将证伪 Frankl 的猜想。
假设从这个族中随机选择两个集合 A 和 B,问:集合 A 包含数字 1 的概率是多少?集合 B 呢?由于每个元素出现在任何给定集合中的概率略低于 1%,因此不应期望 A 或 B 包含 1。这意味着如果两者实际都不包含 1,我们也不会感到惊讶,当然也不会获得什么信息。
接下来,考虑 A 和 B 的并集包含 1 的概率。这仍然不太可能,但比 1 出现在任何一个单独集合中的概率大一些,是 1 出现在 A 中的概率与 1 出现在 B 中的概率之和减去 1 同时出现在两者中的概率。所以 A 和 B 的并集包含 1 的概率约低于 2%。
这仍然很低,但更接近 50% 的猜想,这意味着需要更多信息才能共享结果。换句话说,如果存在一个并封闭集族,其中任何元素在所有集合中出现的概率都小于 1%,则两个集合的并集比任何一个集合本身包含的信息要多。
「逐个元素证明猜想的思路非常聪明」,普林斯顿大学的 Ryan Alweiss 评价道。
Gilmer 的工作开始接近 Frankl 的猜想。这是因为很容易证明:在并封闭集族中,两个集合的并集包含的信息必然少于两个集合本身 —— 而不是更多。
原因很简单,以包含 1024 个不同集合的并封闭集族为例,每个集合中元素是 1 到 10 的数字。如果随机选择其中两个集合,平均会得到包含五个元素的并集。(在这 1024 个集合中,有 252 个包含五个元素,这是最常见的集合大小。)也有可能我们会得到一个包含大约七个元素的并集。但是只有 120 种不同的组合方法能得到包含七个元素的并集。
关键是,两个随机选择的集合包含的元素比其并集具有更多的不确定性。并集更像是一个具备更多元素、可能性更少的更大集合。当你在一个并封闭集族中对两个集合进行并集操作时,你可能会知道合并结果,就像是抛出一个有偏重的硬币,你很容易猜到硬币落向哪面,并集包含的信息少于两个集合本身的信息。
基于此,Gilmer 认为至少要有一个元素在集合中出现的概率大于等于 1%。
失之东隅,收之桑榆
当 Gilmer 在 11 月 16 日发布他的证明时,他附上了一条说明 —— 他认为使用他的方法可能更接近完整猜想的证明,有可能将阈值提高到 38%。
五天后,三个不同的数学家团体在几个小时内相继发表了论文,他们在 Gilmer 的工作基础上做到了这一点。这场爆发似乎已经将 Gilmer 的方法发挥到了极致,不过要想达到 50%,可能需要更多的新想法。
不过,对于后续论文的一些作者来说,他们想知道为什么 Gilmer 不自己做完相对简单的达到 38% 的研究。事实上,原因并不复杂:在脱离数学超过 5 年之后,Gilmer 只是不知道如何进行技术分析工作来实现这一目标。
「我有点生疏,老实说,我被困住了,」Gilmer 说。「但我很想知道数学社区会把它带到哪里。」
但 Gilmer 也认为,使他失去实践机会的同一原因,在某种程度上也使他的证明首先成为了可能:「这是唯一的解释 —— 为什么我在研究生院想了一年这个问题毫无进展,离开数学六年之后再回到这个问题上却取得了突破。除了机器学习让我的想法产生变化之外,我不知道还有什么解释。」
原文链接:https://www.quantamagazine.org/long-out-of-math-an-ai-programmer-cracks-a-pure-math-problem-20230103/
©THE END
转载请联系本公众号获得授权
投稿或寻求报道:content@jiqizhixin.com
焦点精选!白天打工,晚上科研,谷歌大脑研究科学家破解了困扰数学界几十年的猜想
2023-01-06
1个月港元拆息连跌14日|全球资讯
2023-01-06
振兴路上 中信环境技术为凉山发展谱新篇
2023-01-06
迪安诊断:1月5日获融资买入1106.24万元,占当日流入资金比例15.54% 资讯
2023-01-06
杭新景高速一小时发生三起同类型事故,返乡心切理解,但务必注意行车安全
2023-01-06
还呗逾期九天拖欠多久上征信系统|天天简讯
2023-01-05
电水壶里面的水质怎么清除?-世界最资讯
2023-01-05
热消息:国林科技拟投资1000万设立青岛国林陶瓷新材料科技有限公司
2023-01-04
【全球快播报】炼石航空: 关于董事(控股股东)股份变动的公告
2023-01-04
环球消息!韩国国民儿子李昇基亲揭剃头原因,称会继续活动,继续斗争下去
2023-01-04
1个月港元拆息连跌14日|全球资讯
振兴路上 中信环境技术为凉山发展谱新篇
迪安诊断:1月5日获融资买入1106.24万元,占当日流入资金比例15.54% 资讯
杭新景高速一小时发生三起同类型事故,返乡心切理解,但务必注意行车安全
还呗逾期九天拖欠多久上征信系统|天天简讯
电水壶里面的水质怎么清除?-世界最资讯
热消息:国林科技拟投资1000万设立青岛国林陶瓷新材料科技有限公司
【全球快播报】炼石航空: 关于董事(控股股东)股份变动的公告
环球消息!韩国国民儿子李昇基亲揭剃头原因,称会继续活动,继续斗争下去
地方两会密集点题促消费 今年消费有望明显好转|观热点
《苍兰诀》结局意难平,东方青苍复活有三大漏洞,番外不约
我与妈妈的对话作文400字(7篇) 全球速递
金盘科技(688676.SH)遭股东Forebright Smart减持1.23%股份 热点
新乡市辉县市交通违章处理的流程
世界新消息丨并购重组成内幕交易高发区,强化监管不可或缺
世界新动态:异动快报:西安旅游(000610)1月3日9点30分触及跌停板
当前焦点!研究表明:“长新冠”的影响不可被低估 提高免疫力再次被强调
环球信息:埃及安全部队同恐怖分子在苏伊士运河附近交火 致4死16伤
Power BI 医疗器械行业销售管理通用模板 全球要闻
环球百事通!如何切辣椒不辣手?
红豆补血粥的正确做法?_天天观焦点
被征地后给予多少补偿款-世界今日讯
电视盒子专用!无需折腾,超清秒播不卡顿!|当前信息
广哈通信(300711):聘任公司副总经理-全球头条
美媒:美国总统拜登签署1.65万亿美元支出法案 天天消息
2022重庆荣昌弘禹水资源公司招聘岗位
美丽田园医疗健康(02373.HK)12月30日起招股 发售价将为每股19.32港元
环球微头条丨辉瑞宣布B型血友病基因治疗候选药物的3期实验取得积极结果
当前快看:萌宝亮相!“2022级”大熊猫宝宝为游客送上新年祝福
- 湖南1-10月房地产开发投资、销售持续“双降”
- 警方通报!涉嫌非法集资 这家金融服务公司被立案侦查 主要嫌犯已被抓获归案|当前聚焦
- 全球热议:力勤资源(02245.HK):部分行使超额配股权、稳定价格行动及稳定价格期间结束
- 羊没羊,好像也没那么重要了!
- 环球头条:青海首个有机枸杞交易中心在格尔木市挂牌
- 全聚德(002186)12月28日主力资金净卖出7063.43万元|世界今热点
- 【时快讯】国网湖北电力:已在全省部署支持V2G技术的充电站
- 美国大豆压榨利润比前一周增长4.8%_全球速看
- 汉缆股份: 第六届董事会第一次会议决议公告
- 河北承德县:与时间赛跑医务人员争相上一线 即时看
- 前11月深圳直播带货1522亿元 世界热点
- 腾讯“全场的希望”视频号 何时担起赚钱重任?-世界今头条
- 环球速读:曾俊杰倒戈坐上高雄副议长 蓝市党部开铡
- 上市公司花式保壳财技引监管关注 投资者切莫火中取栗盲目押注
- 腾冲板栗炖鸡的做法?
- 聚焦数字经济,展望元宇宙未来——海南岛国际电影节全新独立单元元宇宙峰会圆满举办 天天最新
- 每日观点:提钱花逾期8个月延迟还款征信有什么影响
- 安徽建工: 安徽建工第八届董事会第二十四次会议决议公告
- 2022年12月23日白银价格多少一克 世界快消息
- 观焦点:华铁股份:12月22日融券卖出金额16.96万元,占当日流出金额的0.59%
- 豪鹏科技: 关于2023年度提供担保额度预计的公告|滚动
- 【独家】轻纺城(600790.SH):截至12月22日已累计回购4.11%股份
- 2023黑兔年生孩子好吗 黑兔年生孩子最好月份|世界球精选
- 疏通消费链 多地发放超亿元消费券带动年末消费 环球快报
- 进入了发展快车道 冷链行业市场规模正在快速膨胀
- 行业正站在风口 数字化时代在为传统的自行车产业赋能
- 以做强实体经济支撑为重点 成都单个项目年度计划投资同比提升
- 拥有多个国际赛事的直播版权 广州游戏电竞企业业绩向好
- 投诉量激增 直播带货存在这么多问题的主要原因是什么?
- 工作专班深入到各企业 春寒料峭挡不住松原市施工热情
- 引导企业向提供“产品+服务”转变 湖南加快智能农机服务化转型
- 创新平台建设和科技成果转化 德州加大力度重奖创新
- 潜在风险进一步放大 商品房现房销售已是大势所趋
- 有序复工复产 1—2月份工业经济发展新动能持续增强
- 多层次高频调度 1至2月河北省工业运行先行指标稳中有增
- 以车路协同为基础 智能交通推动城市交通绿色高质量发展
- 人才短板成为制约产业链高质量发展的关键节点
- 通过技术手段整合调配供给资源 家政行业不断提质扩容
- 强化产业链深层次合作 加强重大装备国产化“一条龙”模式构建
- 如何进一步提升纳税人缴费人的减税降费获得感?
- 探索建设大数据及网络安全示范试点城市有哪些积极意义?
- 对制造业中小微企业实施缓缴税费政策有哪些积极意义?
- 进一步增强自我保护意识 消费者需注意辨别谨慎消费
- 将“走出去”变“请进来” 西安贸易产业转移承接作用不断得到增强
- 厦门应如何融入“数字中国”的重大战略发展大局?
- 江苏省如何不断满足老人日益增长的养老服务需求?
- 建设一体化的职业健康信息管理平台 天津职业人群保障加强
- 潜力持续释放 1—2月乡村消费品市场恢复略好于城镇
- 直接对接社会化服务 楼宇调解室将整体提升青岛劳动争议水平
- 成功化解纠纷11.47万件 银保监会服务质量日趋提高