将“ Smart”写入智能扬声器的3个技巧

当我开始为第一个与Alexa相连的棋盘游戏以及其他Alexa技能写作时(请参阅Word Mine,这是Alexa开发人员在使用机器人金丝雀挖掘字母时的获胜技能-是的,您没看错),我完全低估了这些智能扬声器不是很智能。

我们大多数人都知道,在Alexas,Google Homes和Siri式设备的杂货店中并没有实际的感觉。 在这些机器中,没有鬼,只有我们自己告诉自己的鬼故事。

这听起来似乎很明显,但是值得承认。 即使这在某种程度上是我们所知道的,但一旦我们开始为这些设备分配诸如智能扬声器(或“人工智能”,或其他类似的词)之类的词,我们的感知方式以及因此为它们编写的方式- 变化。 因此,根据我写Alexa技能的时间,这是我发现的内容:

像Alexa这样的虚拟助手具有许多令人难以置信的特性。 最重要的是他们的语音处理能力。 如果您说了一系列单词,设备可以将它们映射到打印的单词! 但至关重要的是,它本身无法在这些词中找到含义。

让我们退后一步。 通常,对话是在具有共享上下文的两个用户之间进行的。 即使存在物理距离(例如,一个中等职位的作者和很多英里以外的读者),这两个人也拥有共同的社交和认知环境。 您有大脑,我有大脑,我们正在使用它们将具有共同上下文含义的单词注入其中。 举手击掌!

虚拟助手没有这些上下文,因此他们无法从收到的单词中推断出任何含义。 为了使他们对这些单词有用,人类需要在幕后做认真的工作,以将含义映射到这些单词上,同时考虑到它们可以使用的所有不同组合。

图片来自英国兄弟

毫不奇怪,几乎不可能将人们的谈话预期到这一水平。 只需问一个简单的问题:“您想要几张票?”。 如果您告诉一个人“只适合我和我的朋友”,他们会理解您的意思是两个。 虚拟助手能够接听电话的唯一方法是,如果一个人事先进入并故意将这组单词指定为“两个”……现在想象一下,需要一个人为触摸的地方来覆盖一个人的所有事物的数量可以在不同的情况下说,您可以看到它很快就会失控!

因此,总而言之,“智能扬声器”中的所有智能都是通过在编程和编写之间进行精心团队合作来制造和构造的。 在编写语音优先界面时,记住这一点非常有用,因为它们使您进入正确的思维方式来想象交互。

现在,介绍一些提示,以最自然,最“智能”的交互方式进行书写:

  1. 将问题分成小块,以最大程度地减少误解的机会。

作为一般经验法则,为语音设备编写内容时越具体(不会听起来过于繁琐和乏味)就越好。 这减少了用户回答问题的方式,从而缩小了程序员必须预期(和管理响应)的数量。

因此,例如,如果您需要找出用户需要多少张票,而他们又需要它们,则将其分为两个简洁的问题:“您需要多少张票?”,然后是“您需要什么日期?凭票?”。

2.指导用户进行直观的响应。

您向用户表达事物的方式将构成最自然的响应。 再次以上述示例为例,询问“您需要多少张票?” 让事情变得很开放:他们可以说“两个”,可以说“几个”,甚至可以与特定的人回应(“为我的朋友和我”)。 如果您将问题改写为专门问“您需要多少张票?”,这会促使用户给出数字答案-在这里说“两张”很自然,但是说“几张”或“几张”就不那么自然了。 “为了我和我的朋友”。

当然,直观构图和听起来过于固执之间的界线总是需要协商的。 在上面的例子中,基于整体用户体验,我认为稍微听起来像机器人的第二个问题仍然是更好的选择。 但是,要测试这一点的一种好方法就是完全做到这一点:测试它!

通过与朋友(甚至是您自己)的互动来进行观察,看看会发生什么样的反应。 它们是否被提示措辞的奇怪程度抛出? 用户的答复是您要管理的答复吗? 如果不是,您如何重新整理问题以引导用户获得所需的信息? 有时候,没有一个很好的答案,但是至少您会知道在哪里可以预测到您的技能方面的误解,并尽可能地对它进行解释。

3.遇到错误时,要保持谈话内容丰富。

语音设备交互过程从未如此顺利。 如果您曾经尝试使用虚拟助手,那么我相信您可以证明这一点。 作为一名作家,在这些情况下您能做的最有用的事情就是为用户提供尽可能多的信息,以帮助他们理解为什么不理解他们的输入的原因。

也许您问用户“您需要多少张票?” 他们说了“一对”,这句话对您来说是意料之外的。 与其简单地通过告诉用户“我没有得到”来进行响应,不如让他们知道如何给出可处理的响应,这会更有帮助-“我没有得到,请您用数字告诉我多少?你想要票吗? 这样做可以缩小一个人完成互动可能需要的尝试次数,这是这里最重要的事情。 这听起来不完全是人类的声音……但是,智能扬声器并非如此。