毫无疑问,最新的 XPrize 是迄今为止最奇怪的 XPrize。 它被称为TED 人工智能 XPrize,这个名字似乎说明了一切,但又不完全是。正如上周宣布的那样,这项比赛是“现代图灵测试,奖品是第一个在舞台上走上或滚上舞台并发表 TED 演讲的人工智能,演讲如此引人注目,以至于赢得观众的起立鼓掌。” 但实际奖项并未具体说明。所提出的规则只是比赛最终可能的样子,基于公众提交的想法。 然而,这句话的描述以及示例规则,让人对首届人工智能 XPrize 的有效性产生了疑问。机器发表的 TED 演讲与推动人工智能的发展有什么关系呢? 首先,这些示例规则。正如 XPrize 网站所述,“这个概念的元素可能会用到,也可能不会用到”,但细节仍然很有启发性。在提议的场景中,团队将提前获得 100 个讨论主题。其中一个主题将在 TED 会议上被选中(随机或由观众选择),然后人工智能将有 30 分钟的时间来提出 3 分钟的演讲。在 TED 演讲结束后,“观众将用掌声投票,如果合适,还会起立鼓掌。” 以往的 XPrize 竞赛都采用了完全基于经验的获胜条件——率先越过终点线,或者在两周内两次到达亚轨道高度。在这个虚构的例子中,集体分贝水平是否会将巨大的掌声推向礼堂天花板?如果两个机器人在同一次会议上获得起立鼓掌,情况会怎样?组织者会计算每次鼓掌的速度、发出的欢呼声或流下的眼泪吗? 虽然这些问题听起来有些可笑,但模糊的才艺表演机制与比赛的下一个阶段息息相关,而且这个阶段可能更具挑战性。 在观众评分的 TED 演讲结束后,人工智能必须回答《连线》杂志前主编、TED 大会策展人克里斯·安德森提出的两个问题。专家小组将“投票”。这可能是掌声对决的决胜局。或者也许每位专家的掌声都会放大二十倍? 可以这么说,AI XPrize 似乎不是由 AI 研究人员炮制出来的。样本规则表明 XPrize 的规则要宽松得多,更注重娱乐性,这是一种由真实研究支持的营销噱头。 除非研究人员只是假装。“我认为挑战的精神很酷,也很有用,”斯坦福大学认知科学家 Noah Goodman 说。“但就目前的情况来看,它很容易作弊。你可以找一群艺术家和知识分子,为这 100 个主题中的每一个编写一个脚本,然后在知道是哪个主题时播放正确的脚本。然后你就解决了第一部分,而根本不需要使用人工智能。” 问答环节不会那么容易被操纵,但到那时,起立鼓掌可能已经得到批准或被拒绝。这大致相当于为美国小姐加冕,然后问她地缘政治问题。 问答系统的目的在于提供一个独立的图灵测试,无论它最终如何构建,将经典、直接的人工智能研究元素与看似机器人的表演技巧相结合。图灵测试由计算机先驱艾伦·图灵于 1950 年首次提出,要求机器通过欺骗人类评委来证明其智能,通过一系列即兴的回答让他们相信它和他们一样是人类。 然而,图灵测试更像是科学史,而不是科学,这种方法已被绝大多数人工智能研究人员抛弃。每年,各团队都会争夺洛布纳奖,奖金将颁发给最像人类的聊天机器人。而且每年,除了比赛之外,没有人关心。“洛布纳奖很有趣,但在推动科学议程和吸引公众对人工智能的广泛兴趣方面,它完全失败了,”古德曼说。“图灵测试作为一个思想实验发挥了极其宝贵的作用。它不是一个可行的研究目标。” 在图灵测试的所有问题中,最大的问题之一与人类有关。评委经常被幽默搞晕——不是基于新信息的适应性、创造性的幽默,而是预先准备好的笑话,这些笑话会在有策略的间隔内释放,以避免必须设计更相关的回应。事实证明,人类并不是图灵测试的可靠仲裁者。“这次 XPrize 也会有同样的问题。任何看过很多 TED 视频的人都知道,他们的节奏非常引人注目,很容易辨认,风格平淡无奇,”古德曼说。“只要在笑话和特定的风格技巧中编程,就能获得相当多的好评。” 需要说明的是,古德曼对本次 XPrize 的批评并不像我那么严厉——他真的很期待看到组织者会拿出什么成果。赫特福德大学人工智能教授克斯廷·道滕哈恩则不那么热情。道滕哈恩说:“现在和未来机器人的主要挑战在于与世界的互动,而不是性能技巧。”道滕哈恩的工作涉及人工智能、人机互动和社交机器人。 对于 Dautenhahn 来说,人工智能机器人面临的主要挑战在于它们如何与无生命和社会环境互动——例如,如何在房间中穿行,以及如何进行对话。“我在 XPrize 中看不到这些元素,所以我不确定奖项规则涉及哪些有用的技能——在推动现实生活中的人工智能方面有用,”她说。 一旦实现,AI XPrize 完全有可能成为一项更有意义的研究,而不是一个滑稽的噱头。对于 Goodman 来说,这种转变可能很简单,只需迫使 AI 即兴发挥即可——这是人类智能的一个关键特征,也是机器的长期绊脚石。例如,不要介意 100 个主题集(一个需要预先录制的演示的框架)。相反,系统可以在现场随机获得一个主题,允许从互联网上汇编数据,然后进行演示。现在这是不可能的,”Goodman 说。“我可以想象 5 年后它会成为可能。” 我个人认为,AI XPrize 存在的问题比规则更大,尤其是与赞助商的关系。Progressive Automotive XPrize 并没有要求参赛团队制造保险费本来就很低的汽车。AI XPrize 以 TED 为中心,在 TED 场地上举行,其成功或失败将根据之前的 TED 演讲来衡量。不可否认这些会议的影响力以及 TED 机器人将获得的关注。但当你要求计算机科学家解决问题并赢得起立鼓掌时,这更像是狂欢表演而不是严肃的比赛。这是第一次,有可能赢得 XPrize 却不赢得任何人的尊重。 |
<<: 史上最雄心勃勃的 DNA 构建项目:科学家制造出人工酵母染色体
苹果公司准时在位于加利福尼亚州库比蒂诺的总部举行了一场活动,推出了其最新款智能手机和可穿戴设备。Po...
和这个国家的数百万人一样,我住在一间小公寓里,一直在寻找欺骗大脑的方法,让我相信公寓比实际要大。在寻...
蛭形轮虫是一种古老的、无性的、奇怪的生物。这种微小的淡水动物似乎在无性的情况下存活了下来,并因此获得...
《圣剑山:智慧的资格》:异世界奇幻题材的新魅力《灵剑山:智慧的资格》是一部于 2017 年播出的电视...
到现在为止,你可能已经听说了图灵测试,这是由数学先驱艾伦·图灵于 1950 年提出的一项古老的机器智...
“科学家刚刚发现了一种新形状”是一个很好的标题——也引出了很多问题。其中最主要的是:新形状到底是什...
怪物第 8 号 — 怪兽八护概述Kaiju No. 8 是松本直哉创作的日本漫画,在集英社的少年 J...
新猴子与螃蟹大战-Shinsarukani Gassen 的全方位评测与推荐概述1939年上映的《新...
当体育界正午等待 2010 年南非世界杯分组结果公布时,我们却对另一项四年传统垂涎三尺:世界杯官方用...
希望您的 Android 手机或平板电脑永远不会丢失、被盗、在事故中被砸毁或被冲入大海——但如果最坏...
每年冬天,大约有 50 万只灰海豹聚集在一个名为塞布尔岛的偏远沙洲上。塞布尔岛位于新斯科舍省海岸 2...
数百万年前,在陆地连接地球的北美洲和南美洲大陆之前,距离我们约 2100 万光年的地方,一颗衰老而肿...
一组古生物学家、公园管理员和地质学家在肯塔基州猛犸洞国家公园的岩层中发现了一种新的古代鲨鱼物种。它是...
变形金刚Z:新任总司令迪亚特拉斯登场!全面评论和推荐概述1990年7月21日发售的OVA《变形金刚Z...
肌肉学院综合评论及推荐■ 公共媒体电视动画系列■ 原创媒体动漫原创■ 播出时间2007年10月6日~...