解决起立鼓掌问题:人工智能研究人员是否应该费心构建 TED 机器人?

解决起立鼓掌问题:人工智能研究人员是否应该费心构建 TED 机器人?
TED@Tunis,TED2013 人才搜索活动的一部分。更多信息请访问 talentsearch.ted.com 照片:James Duncan Davidson James Duncan Davidson

毫无疑问,最新的 XPrize 是迄今为止最奇怪的 XPrize。

它被称为TED 人工智能 XPrize,这个名字似乎说明了一切,但又不完全是。正如上周宣布的那样,这项比赛是“现代图灵测试,奖品是第一个在舞台上走上或滚上舞台并发表 TED 演讲的人工智能,演讲如此引人注目,以至于赢得观众的起立鼓掌。”

但实际奖项并未具体说明。所提出的规则只是比赛最终可能的样子,基于公众提交的想法。

然而,这句话的描述以及示例规则,让人对首届人工智能 XPrize 的有效性产生了疑问。机器发表的 TED 演讲与推动人工智能的发展有什么关系呢?

首先,这些示例规则。正如 XPrize 网站所述,“这个概念的元素可能会用到,也可能不会用到”,但细节仍然很有启发性。在提议的场景中,团队将提前获得 100 个讨论主题。其中一个主题将在 TED 会议上被选中(随机或由观众选择),然后人工智能将有 30 分钟的时间来提出 3 分钟的演讲。在 TED 演讲结束后,“观众将用掌声投票,如果合适,还会起立鼓掌。”

以往的 XPrize 竞赛都采用了完全基于经验的获胜条件——率先越过终点线,或者在两周内两次到达亚轨道高度。在这个虚构的例子中,集体分贝水平是否会将巨大的掌声推向礼堂天花板?如果两个机器人在同一次会议上获得起立鼓掌,情况会怎样?组织者会计算每次鼓掌的速度、发出的欢呼声或流下的眼泪吗?

虽然这些问题听起来有些可笑,但模糊的才艺表演机制与比赛的下一个阶段息息相关,而且这个阶段可能更具挑战性。

在观众评分的 TED 演讲结束后,人工智能必须回答《连线》杂志前主编、TED 大会策展人克里斯·安德森提出的两个问题。专家小组将“投票”。这可能是掌声对决的决胜局。或者也许每位专家的掌声都会放大二十倍?

可以这么说,AI XPrize 似乎不是由 AI 研究人员炮制出来的。样本规则表明 XPrize 的规则要宽松得多,更注重娱乐性,这是一种由真实研究支持的营销噱头。

除非研究人员只是假装。“我认为挑战的精神很酷,也很有用,”斯坦福大学认知科学家 Noah Goodman 说。“但就目前的情况来看,它很容易作弊。你可以找一群艺术家和知识分子,为这 100 个主题中的每一个编写一个脚本,然后在知道是哪个主题时播放正确的脚本。然后你就解决了第一部分,而根本不需要使用人工智能。”

问答环节不会那么容易被操纵,但到那时,起立鼓掌可能已经得到批准或被拒绝。这大致相当于为美国小姐加冕,然后问她地缘政治问题。

问答系统的目的在于提供一个独立的图灵测试,无论它最终如何构建,将经典、直接的人工智能研究元素与看似机器人的表演技巧相结合。图灵测试由计算机先驱艾伦·图灵于 1950 年首次提出,要求机器通过欺骗人类评委来证明其智能,通过一系列即兴的回答让他们相信它和他们一样是人类。

然而,图灵测试更像是科学史,而不是科学,这种方法已被绝大多数人工智能研究人员抛弃。每年,各团队都会争夺洛布纳奖,奖金将颁发给最像人类的聊天机器人。而且每年,除了比赛之外,没有人关心。“洛布纳奖很有趣,但在推动科学议程和吸引公众对人工智能的广泛兴趣方面,它完全失败了,”古德曼说。“图灵测试作为一个思想实验发挥了极其宝贵的作用。它不是一个可行的研究目标。”

在图灵测试的所有问题中,最大的问题之一与人类有关。评委经常被幽默搞晕——不是基于新信息的适应性、创造性的幽默,而是预先准备好的笑话,这些笑话会在有策略的间隔内释放,以避免必须设计更相关的回应。事实证明,人类并不是图灵测试的可靠仲裁者。“这次 XPrize 也会有同样的问题。任何看过很多 TED 视频的人都知道,他们的节奏非常引人注目,很容易辨认,风格平淡无奇,”古德曼说。“只要在笑话和特定的风格技巧中编程,就能获得相当多的好评。”

需要说明的是,古德曼对本次 XPrize 的批评并不像我那么严厉——他真的很期待看到组织者会拿出什么成果。赫特福德大学人工智能教授克斯廷·道滕哈恩则不那么热情。道滕哈恩说:“现在和未来机器人的主要挑战在于与世界的互动,而不是性能技巧。”道滕哈恩的工作涉及人工智能、人机互动和社交机器人。

对于 Dautenhahn 来说,人工智能机器人面临的主要挑战在于它们如何与无生命和社会环境互动——例如,如何在房间中穿行,以及如何进行对话。“我在 XPrize 中看不到这些元素,所以我不确定奖项规则涉及哪些有用的技能——在推动现实生活中的人工智能方面有用,”她说。

一旦实现,AI XPrize 完全有可能成为一项更有意义的研究,而不是一个滑稽的噱头。对于 Goodman 来说,这种转变可能很简单,只需迫使 AI 即兴发挥即可——这是人类智能的一个关键特征,也是机器的长期绊脚石。例如,不要介意 100 个主题集(一个需要预先录制的演示的框架)。相反,系统可以在现场随机获得一个主题,允许从互联网上汇编数据,然后进行演示。现在这是不可能的,”Goodman 说。“我可以想象 5 年后它会成为可能。”

我个人认为,AI XPrize 存在的问题比规则更大,尤其是与赞助商的关系。Progressive Automotive XPrize 并没有要求参赛团队制造保险费本来就很低的汽车。AI XPrize 以 TED 为中心,在 TED 场地上举行,其成功或失败将根据之前的 TED 演讲来衡量。不可否认这些会议的影响力以及 TED 机器人将获得的关注。但当你要求计算机科学家解决问题并赢得起立鼓掌时,这更像是狂欢表演而不是严肃的比赛。这是第一次,有可能赢得 XPrize 却不赢得任何人的尊重。

<<:  史上最雄心勃勃的 DNA 构建项目:科学家制造出人工酵母染色体

>>:  以色列学生利用虚假交通拥堵情况恶搞 Waze 应用

推荐阅读

Garmi,德国老年人的机器人护士和陪伴者

慕尼黑机器人与机器智能研究所的一组研究人员最近推出了他们的新机器人助手 Garmi,以加米施-帕滕基...

对“ Lalalalalachan Uchu ni Muchu第3季”的吸引力和评估

对“ Lalalalalachan Uchu ni Muchu第3季”的吸引力和评估《LaLaLa ...

如何将照片移至云服务或从云服务移出

照片和视频可能是您最珍贵的数字资产。它们代表着亲人、特殊地点、难忘事件、精彩旅行的快照,甚至一些让您...

昆虫无人机的崛起

五年前,理查德·吉勒和汤姆·瓦内克坐在离办公室几个街区远的一家酒吧里,试图让自己忘记工作。近一年来,...

小熊米莎:探索迷人人物和故事的深度

小熊米莎——这部动画片中,一个怀旧吉祥物栩栩如生《小熊米莎》是1979年至1980年播出的一部以莫斯...

农作物在人造月球和火星土壤上生长

如果人类在月球或火星上建立永久基地,我们就需要能够在那里种植自己的食物。为了查明这是否真的可行,荷兰...

《TYO STORY》的魅力与评价:感人的故事、有深度的人物

东京物语 - TYO STORY概述《TYO STORY》是一部动画电影,于1999年10月23日上...

美国陆军尚未获得微软 AR 眼镜

陆军的增强现实眼镜配备摄像头和屏幕,有望提供超人视觉,本应在战斗中占据优势。然而,测试再次出现延迟,...

Ani x Para 第 2 集:残疾人田径运动回顾:谁是你的英雄?

Ani x Para - 谁是你的英雄? - 第 2 部分“第 2 集:残疾人田径运动” Ani ...

忍者乱太郎第 14 季:新的冒险和成长之路

《忍者乱太郎》第14季的魅力与评价《忍者乱太郎》是根据天子苍兵卫的原作漫画改编的电视动画,多年来深受...

6 个上坡徒步小贴士,让你的双腿不再软弱

如果有什么事情能让徒步旅行者心生恐惧,那就是绵延数英里的陡峭上坡。持续不断的攀登之所以困难,主要原因...

每个州最重要的科学政策问题

西部各地野火肆虐,海平面上升拍打着东部。动物粪便、煤灰和肥料污染了从卡罗莱纳州到中西部的水道。全国各...

遛狗的正确方法

您是否曾经希望能够窥视猫、狗、石龙子或斗鱼的大脑?这将使您对世界有更好的认识——或者至少帮助您成为更...

视频:经过机器人辅助康复和一剂化学药剂治疗后,瘫痪的老鼠重新行走

通过使用机器人背带和一种专门用于刺激脑细胞的特殊化学混合物进行精心训练,脊髓受伤的老鼠能够重新学会走...

《Brave Beats》的魅力与评价:大人小孩都能欣赏的英雄动画

勇敢的节拍 - 勇气和友谊的故事《Brave Beats》是一部动画系列,于 2015 年 10 月...