想象一下,如果每次想学习一道新的菜谱,你都必须重新学习如何切割、剥皮和搅拌在许多机器学习系统中,当面临新的挑战时,代理通常不得不从头开始学习然而,很明显,人们的学习效率比这要高:他们可以结合之前学到的能力就像有限的词典可以重新组合成几乎无限意义的句子一样,人们可以重复使用和重新组合他们已经掌握的技能来应对新的挑战
Leave a CommentMonth: July 2023
我们使用广泛认可且综合的游戏引擎Unity来创建更多样化、复杂化的虚拟模拟我们描述了为简化这些环境创作而开发的概念和组件,主要用于强化学习领域的应用
Leave a Comment在2016年,我们推出了AlphaGo,这是第一个能够在古老的围棋游戏中战胜人类的人工智能(AI)程序两年后,它的继任者AlphaZero从零开始学习,掌握了围棋、国际象棋和将棋现在,在《自然》杂志上的一篇论文中,我们描述了MuZero,这是在追求通用算法的道路上迈出的重要一步MuZero可以掌握围棋、国际象棋、将棋和Atari,而无需知道规则,这要归功于它能够在未知环境中规划获胜策略的能力
Leave a Comment在这项工作中,我们研究了多模态变压器(注意力,损失和预训练数据)在多模态预训练中的成功的关键因素我们发现,多模态注意力,即语言和图像变压器相互关注,对这些模型的成功至关重要具有其他类型注意力的模型(即使具有更深或更多参数)无法达到具有多模态注意力的更浅更小模型的可比结果
Leave a Comment现代人工智能系统处理识别图像中的物体和预测蛋白质的三维结构等任务,就像一个勤奋的学生为考试做准备一样通过在许多示例问题上进行训练,它们随着时间的推移减少错误,直到取得成功但这是一项孤独的努力,只是已知学习形式之一学习也可以通过与他人互动和游戏来进行一个人很少能够独自解决极其复杂的问题通过使问题解决具有类似游戏的特性,之前DeepMind的努力已经训练出能够玩捉旗战并在星际争霸中达到大师级别的AI代理这让我们想知道,基于博弈论的这种视角是否能够帮助解决其他基本的机器学习问题
Leave a Comment许多新颖的机器学习创新为AlphaFold目前的准确性做出了贡献我们在下面提供了一个高级概述;关于网络架构的技术描述,请参阅我们的AlphaFold方法论文,尤其是其详尽的附录信息部分
Leave a Comment去年12月我们宣布AlphaFold 2时,它被誉为解决了50年来的蛋白质折叠难题上周,我们发布了科学论文和源代码,解释了我们是如何创建这个高度创新的系统的,今天我们分享了人体中每一种蛋白质的形状的高质量预测,以及其他20种科学家在研究中依赖的生物体的蛋白质的预测
Leave a Comment近年来,人工智能代理在各种复杂的游戏环境中取得了成功例如,AlphaZero在开始时只知道如何玩基本规则,却击败了国际象棋、将棋和围棋的世界冠军程序通过强化学习(RL),这个单一系统通过不断重复的试错过程来通过一轮又一轮的游戏学习但是AlphaZero仍然要单独训练每个游戏,不能简单地学习另一个游戏或任务而不需要从头开始重复RL过程强化学习的其他成功案例,如Atari、捉旗、星际争霸II、Dota 2和捉迷藏等,也是如此DeepMind致力于解决智能问题,推动科学和人类进步,这使我们探索如何克服这个限制,创建具有更通用和适应性行为的AI代理这些代理不再一次学习一个游戏,而是能够适应全新的条件,并玩遍各种游戏和任务,包括以前从未见过的
Leave a Comment在我们的论文中,我们关注的是语言模型及其生成有毒语言的倾向我们研究了不同方法减轻语言模型毒性的有效性以及它们的副作用,并调查了基于分类器的自动毒性评估的可靠性和限制
Leave a Comment我们认为,仅仅将好奇心用于快速环境探索或作为特定任务的额外奖励,并不能充分发挥这种技术的潜力,也会错过一些有用的技能相反,我们建议将重点转向保留在好奇心学习中出现的行为我们认为,这些自我发现的行为可以作为一个代理人解决相关任务的宝贵技能
Leave a Comment我们的生活与天气息息相关根据一项研究,在英国的任何时刻,据说有三分之一的人在过去一小时内谈论过天气,反映了天气在日常生活中的重要性在各种天气现象中,雨水尤为重要,因为它对我们的日常决策产生影响我应该带把伞吗?对于经历大雨的车辆应该如何规划路线?对于户外活动我们应该采取哪些安全措施?会不会发生洪水?我们最新的研究和先进的模型推动了降水即时预报科学的发展,即对未来1-2小时内雨水(和其他降水现象)的预测在与英国气象局合作撰写并发表于《自然》杂志的一篇论文中,我们直接应对了这个重要的天气预报大挑战这种环境科学与人工智能的合作关注为决策者创造价值,为雨水即时预报开辟了新的途径,并指出了人工智能在支持我们应对不断变化环境下的决策挑战中的机会
Leave a Comment当人类基因组计划成功地绘制了人类基因组的DNA序列时,国际研究界对于能够更好地理解影响人类健康和发展的遗传指令感到兴奋DNA携带了决定从眼睛颜色到易感染某些疾病和疾病的遗传信息人体内大约有2万个DNA片段,即基因,包含有关蛋白质的氨基酸序列的指令,这些蛋白质在我们的细胞中执行许多重要功能然而,这些基因仅占基因组的不到2%剩下的碱基对——占基因组中30亿个“字母”的98%——被称为“非编码”,包含着关于基因在人体中何时何地应该产生或表达的较少理解的指令在DeepMind,我们相信人工智能可以解开这类复杂领域的更深层次理解,加速科学进步,并为人类健康带来潜在益处
Leave a Comment当你行走时,你的脚与地面接触当你写字时,你的手指与笔接触物理接触是实现与世界互动的关键然而,对于如此常见的事件来说,接触是一个令人惊讶的复杂现象接触发生在两个物体界面的微观尺度上,可以是软或硬、有弹性或有弹性、滑或粘难怪我们的指尖有四种不同类型的触觉传感器这种微妙的复杂性使得模拟物理接触——机器人研究的重要组成部分——成为一项棘手的任务
Leave a Comment当人们想象一个拥有人工通用智能(AGI)的世界时,更容易想到的是机器人,而不是解决社会最棘手问题的解决方案但我相信后者更接近于真相人工智能已经在解决基本挑战方面取得了巨大的进展:从解决蛋白质折叠到准确预测天气模式,科学家们越来越多地使用人工智能来推断支撑高度复杂现实世界领域的规则和原则,这些领域是他们可能从未在没有帮助的情况下发现的人工通用智能研究的进展将极大地增强社会应对和管理气候变化的能力,这不仅因为气候变化的紧迫性,还因为其复杂而多方面的性质
Leave a Comment我们的大脑拥有处理视觉信息的惊人能力我们只需匆匆一瞥复杂的场景,就能在毫秒内将其解析为对象及其属性,例如颜色或大小,并利用这些信息用简单的语言描述场景这种看似毫不费力的能力背后,是我们的视觉皮层进行的复杂计算,它涉及将从视网膜传来的数百万个神经脉冲转化为更有意义的形式,以便将其映射到简单的语言描述上为了完全理解这个过程在大脑中是如何工作的,我们需要弄清楚语义上有意义的信息如何在视觉处理层次的末端神经元的激活中表示,以及这种表示如何从大多数未教授的经验中学习
Leave a Comment一个多世纪之前,斯里尼瓦萨·拉马努金以他非凡的能力震惊了数学界,他能够看到其他人无法察觉到的数字中的显著规律这位来自印度的自学数学家将他的洞察力描述为深入的直觉和精神力量,往往是在生动的梦境中获得这些规律
Leave a Comment语言及其在展示和促进理解或智能方面的作用是人类生活的基本组成部分它赋予人们交流思想和概念、表达想法、创建记忆和建立相互理解的能力这些是社交智能的基础部分这也是为什么我们在DeepMind团队研究语言处理和交流方面的因素,无论是在人工智能代理中还是在人类中
Leave a Comment在这项工作中,我们使用深度强化学习来生成能够在测试阶段进行文化传播的人工智能代理一旦训练完成,我们的代理能够推断和回忆专家展示的导航知识这种知识传递是实时的,并且可以在以前未见过的广阔任务空间中进行泛化
Leave a Comment除了作为赞助商和定期的研讨会组织者外,我们的研究团队今年还将提交29篇论文,其中包括10个合作项目以下是我们即将进行的口头报告、重点报告和海报展示的简要概述
Leave a Comment为了使强化学习(RL)更适用于机器人等实际应用场景,我们提出了一种智能评估过程来选择用于部署的策略,称为主动离线策略选择(A-OPS)在 A-OPS 中,我们利用预先录制的数据集,并允许与真实环境的有限交互来提高选择质量
Leave a Comment受到大规模语言模型进展的启发,我们采用类似的方法来构建一个超越文本输出领域的通用单一智能体我们将这个智能体称为Gato,它是一个多模态、多任务、多具身的通用策略相同的网络和相同的权重可以在Atari游戏中进行游戏、为图像加标题、聊天、使用真实的机械臂堆叠方块等等,根据上下文决定是输出文本、关节扭矩、按钮按下或其他标记
Leave a Comment在我们最近的论文中,我们探讨了深度强化学习(deep RL)代理人群体如何学习微观经济行为,如生产、消费和商品交易我们发现,人工代理人学会做出经济理性的决策,包括生产、消费和价格,并对供求变化做出适当的反应
Leave a Comment如果你想进入DeepMind,就去争取吧申请,面试,只要尝试你可能第一次不成功,但这并不意味着你不能再试一次我从未想过DeepMind会接受我,当他们接受我时,我以为是个错误每个人都怀疑自己 – 我从未觉得自己是房间里最聪明的人我经常感到相反但我已经学到了,尽管这些感受,我确实属于这里,我确实值得在这样的地方工作对我来说,这个旅程就是从尝试开始的
Leave a Comment为了研究半参数问答模型及其基础的参数化语言模型(LMs)如何适应不断演化的知识,我们构建了一个新的大规模数据集,名为StreamingQA该数据集包含特定日期上人工编写和生成的问题,这些问题可以从14年时间戳新闻文章中回答我们每个季度对我们的模型进行评估,让它们阅读预训练中未见过的新文章我们证明了参数化模型可以进行更新,而无需完全重新训练,同时避免了灾难性遗忘
Leave a Comment我的工作日可能会有所不同,这取决于项目的哪个阶段假设我们想要为产品添加一个功能 – 我的任务可能包括设计解决方案并与团队合作找到最佳方案,部署新功能到生产环境并进行维护在此过程中,我会与利益相关者沟通变更,编写文档,编码和测试解决方案,构建分析仪表板,清理旧代码和修复错误
Leave a Comment在本论文中,我们评估了这些现有评估指标的优点,并提出了一种名为标准化测试套件(STS)的评估新方法STS利用从真实人类互动数据中挖掘出的行为场景
Leave a Comment研究科学家凯文·麦基(Kevin McKee)讲述了他对科幻和社会心理学的早期热爱如何激发了他的职业生涯,以及他如何在“性别公平”研究、支持人工智能与人类合作以及研究人工智能对LGBTQ+社群的影响方面推动研究进展
Leave a Comment尽管付出了大量努力,当前的人工智能系统在直觉物理理解方面仍远不及即便是非常年幼的儿童在本研究中,我们通过借鉴发展心理学领域来解决这个人工智能问题
Leave a Comment从2022年7月17日至23日,第39届国际机器学习会议(ICML 2022)将在美国马里兰州巴尔的摩会议中心举行,并以混合方式进行研究人员们将展示和发表他们在人工智能、数据科学、机器视觉、计算生物学、语音识别等领域的尖端机器学习工作
Leave a Comment今天,我们与EMBL的欧洲生物信息学研究所(EMBL-EBI)合作,正在发布几乎所有已知的目录蛋白质的预测结构,这将使AlphaFold数据库的规模扩大了200倍,从近100万个结构增加到超过2亿个结构,有可能极大地增进我们对生物学的理解
Leave a Comment