CN1522431A

Method and system for non-intrusive speaker verification using behavior model

Abstract

According to the present invention, a system and method for authenticating a user's identity includes a conversation system (114) for receiving input from a user (110) and converting the input into a formal command. The behavior checker (118) is coupled to the conversation system (114) to extract features from the input. The characteristics include user behavior patterns. The behavior checker (118) is adapted to compare the input behavior with a behavior model (214) to determine whether to approve the user to interact with the system.

CN1522431A, drawing sheet 1
Sheet 1 of 2

Term

Term ended

Projected expiry passed 12 December 2021, 4.8 years ago.

  1. Priority and filed
  2. Published
  3. Projected expiry
  4. Today

40 claims: 3 independent, 37 dependent

  1. 1
    一种用于验证用户身份的系统,包括:一个会话系统,用于接收来自用户的输入并将所述输入转换成形式命令;以及一个与会话系统相耦合的行为检验器,用于从输入中提取特征,这些特征包括用户的行为模式,行为检验器适于对输入行为以及一个行为模型进行比较,从而确定是否批准该用户与系统进行交互。
  2. 2
    如权利要求1所述的系统,其中会话系统包括一个自然语言理解单元,用于解释作为输入而被接收的语音。
  3. 3
    如权利要求1所述的系统,其中所述输入包括语音、笔迹、文本和手势中的至少一个。
  4. 4
    如权利要求1所述的系统,其中行为检验器包括一个特征提取器,用于从输入中提取特征向量。
  5. 5
    如权利要求4所述的系统,其中特征向量包括语言模型得分、声学模型得分、自然语言和理解得分中的至少一个。
  6. 6
    如权利要求4所述的系统,其中特征向量包括命令预测得分和发音得分中的至少一个。
  7. 7
    如权利要求4所述的系统,其中特征向量包括关于系统响应用户的信息。
  8. 8
    如权利要求4所述的系统,其中特征向量包括用户命令之间的持续时间以及用户和系统之间的对话状态中的至少一个。
  9. 9
    如权利要求4所述的系统,其中特征向量包括用户使用的输入模态类型。
  10. 10
    如权利要求1所述的系统,其中行为模型包括多个模型。
  11. 11
    如权利要求1所述的系统,其中行为检验器包括一个概率计算器,所述概率计算器适于根据用户行为来计算批准该用户与系统进行交互的第一概率。
  12. 12
    如权利要求11所述的系统,其中行为检验器包括一个模型构造器,用于为用户构造一个行为模型,所述行为模型由概率计算器使用,以便对其中的行为与用户的当前行为进行比较。
  13. 13
    如权利要求11所述的系统,还包括:一个声学和生物识别检验器,用于确定来自用户的声学和生物识别信息,并且根据用户的声学或生物识别信息来确定一个批准该用户与系统进行交互的第二概率;以及所述行为检验器包括一个概率混合器,所述概率混合器适于将第一概率与第二概率相结合,从而证实批准该用户与系统进行交互。
  14. 14
    如权利要求11所述的系统,其中将第一概率与一个阈值概率进行比较,以便确定是否批准该用户使用所述系统。
  15. 15
    一种基于行为来验证用户的方法,包括以下步骤:向一个用于接收来自用户的输入并将所述输入转换成形式命令的会话系统提供输入;从所述输入中提取包含了用户行为模式的特征;以及将输入行为与一个行为模型进行比较,从而确定是否批准该用户与系统进行交互。
  16. 16
    如权利要求15所述的方法,其中会话系统包括一个自然语言理解单元,所述方法还包括对作为输入而被接收的语音进行解释的步骤。
  17. 17
    如权利要求15所述的方法,其中所述输入包括语音、笔迹、文本和手势中的至少一个。
  18. 18
    如权利要求15所述的方法,其中行为检验器包括一个特征提取器,所述方法还包括从输入中提取特征向量的步骤。
  19. 19
    如权利要求18所述的方法,其中特征向量包括语言模型得分、声学模型得分、自然语言理解得分中的至少一个。
  20. 20
    如权利要求18所述的方法,其中特征向量包括命令预测得分和发音得分中的至少一个。
  21. 21
    如权利要求18所述的方法,其中特征向量包括关于系统响应用户的信息。
  22. 22
    如权利要求18所述的方法,其中特征向量包括用户命令之间的持续时间以及用户和系统之间的对话状态中的至少一个。
  23. 23
    如权利要求18所述的方法,其中特征向量包括用户使用的输入模态类型。
  24. 24
    如权利要求15所述的方法,其中行为检验器包括一个概率计算器,所述方法还包括根据在概率计算器上计算第一概率的步骤,所述第一概率指示的是:是否基于用户行为而批准该用户与系统进行交互。
  25. 25
    如权利要求24所述的方法,其中行为检验器包括一个模型构造器,所述方法还包括为用户构造一个行为模型的步骤,所述行为模型由概率计算器使用,以便对其中的行为与用户的当前行为进行比较。
  26. 26
    如权利要求24所述的方法,还包括:一个声学和生物识别检验器,用于确定来自用户的声学和生物识别信息,所述方法还包括步骤:基于用户的声学或生物识别信息来确定一个批准该用户与系统进行交互的第二概率;以及通过使用一个概率混合器将第一概率与第二概率相结合,以便证实批准该用户与系统进行交互。
  27. 27
    如权利要求24所述的方法,其中将第一概率与一个阈值概率进行比较,以便确定是否批准该用户使用所述系统。
  28. 28
    一种可以由机器读取的程序存储设备,其中实际包含了一个可以由机器执行的指令程序,以便执行根据行为来验证用户的方法步骤,所述方法步骤包括:向一个用于接收来自用户的输入并将所述输入转换成形式命令的会话系统提供输入;从所述输入中提取包含了用户行为模式的特征;以及将输入行为与一个行为模型进行比较,从而确定是否批准该用户与系统进行交互。
  29. 29
    如权利要求28所述的程序存储设备,其中会话系统包括一个自然语言理解单元,所述方法还包括对作为输入而被接收的语音进行解释的步骤。
  30. 30
    如权利要求28所述的程序存储设备,其中所述输入包括语音、笔迹、文本和手势中的至少一个。
  31. 31
    如权利要求28所述的程序存储设备,其中行为检验器包括一个特征提取器,所述方法还包括从输入中提取特征向量的步骤。
  32. 32
    如权利要求31所述的程序存储设备,其中特征向量包括语言模型得分、声学模型得分、自然语言理解得分中的至少一个。
  33. 33
    如权利要求31所述的程序存储设备,其中特征向量包括命令预测得分和发音得分中的至少一个。
  34. 34
    如权利要求31所述的程序存储设备,其中特征向量包括关于系统响应用户的信息。
  35. 35
    如权利要求31所述的程序存储设备,其中特征向量包括用户命令之间的持续时间以及用户和系统之间的对话状态中的至少一个。
  36. 36
    如权利要求31所述的程序存储设备,其中特征向量包括用户使用的输入模态类型。
  37. 37
    如权利要求28所述的程序存储设备,其中行为检验器包括一个概率计算器,所述方法还包括在概率计算器上计算第一概率的步骤,所述第一概率指示的是:是否基于用户行为而批准该用户与系统进行交互。
  38. 38
    如权利要求37所述的程序存储设备,其中行为检验器包括一个模型构造器,所述方法包括为用户构造一个行为模型的步骤,所述行为模型由概率计算器使用,以便对其中的行为与用户的当前行为进行比较。
  39. 39
    如权利要求37所述的程序存储设备,还包括:一个声学和生物识别检验器,用于确定来自用户的声学和生物识别信息,所述方法还包括步骤:基于用户的声学或生物识别信息来确定一个批准该用户与系统进行交互的第二概率;以及通过使用一个概率混合器将第一概率与第二概率相结合,以便证实批准该用户与系统进行交互。
  40. 40
    如权利要求37所述的程序存储设备,其中将第一概率与一个阈值概率进行比较,以便确定是否批准该用户使用所述系统。
Independent claims40