EP0865014A2

Method and device to enter by speech an address of destination in a navigation system in real time

Abstract

The invention relates to a method for voice input of a destination address in a route guidance system in real-time operation, in which input speech utterances of a user are recognized by means of a speech recognition device and classified according to their recognition probability, and that speech utterance with the greatest recognition probability is identified as the speech utterance entered, at least one speech utterance permissible voice command is which activates the operating functions of the route guidance system assigned to this voice command, all permissible utterances being stored on at least one database. According to the invention, at least one operating function of the route guidance system comprises at least one input dialog, wherein after the activation of the at least one operating function of the route guidance system, depending on the at least one input dialog, at least one lexicon is generated in real time from the permitted utterances uttered on at least one database and then the at least one lexicon is used as Vocabulary is loaded into the speech recognition device.

EP0865014A2, drawing sheet 1
Sheet 1 of 24

Term

Term ended

Projected expiry passed 3 March 2018, 8.6 years ago.

  1. Priority
  2. Filed
  3. Published
  4. Projected expiry
  5. Today

13 claims: 13 independent, 0 dependent

  1. 1
    Method for voice input of a destination address in a route guidance system in real-time operation, in which input speech utterances of a user are recognized by a speech recognition device and classified according to their recognition probability and that speech utterance with the greatest recognition probability is identified as the speech utterance entered, at least one speech utterance being a permissible voice command, which activates the operating functions of the route guidance system assigned to this voice command, all permissible utterances being stored on at least one database,characterized,that at least one operating function of the route guidance system comprises at least one input dialog, wherein after the activation of the at least one operating function of the route guidance system, depending on the at least one input dialog, at least one lexicon is generated in real time from the permitted utterances expressed in at least one database, and then the at least one lexicon is used as a vocabulary is loaded into the speech recognition device. Verfahren zur Spracheingabe einer Zieladresse in ein Zielführungssystem im Echtzeitbetrieb, bei welchem eingegebene Sprachäußerungen eines Benutzers mittels einer Spracherkennungseinrichtung erkannt und gemäß ihrer Erkennungswahrscheinlichkeit klassifiziert werden und diejenige Sprachäußerung mit der größten Erkennungswahrscheinlichkeit als die eingegebene Sprachäußerung identifiziert wird, wobei mindestens eine Sprachäußerung ein zulässiges Sprachkommando ist, welches die diesem Sprachkommando zugeordneten Bedienfunktionen des Zielführungssystems aktiviert, wobei alle zulässigen Sprachäußerungen auf mindestens einer Datenbasis gespeichert sind, dadurch gekennzeichnet, daß wenigstens eine Bedienfunktion des Zielführungssystems mindestens einen Eingabedialog umfaßt, wobei nach der Aktivierung der wenigstens einen Bedienfunktion des Zielführungssystems in Abhängigkeit des mindestens einen Eingäbedialogs aus den auf mindestens einer Datenbasis gespeicherten zulässigen Sprachäußerungen in Echtzeit mindestens ein Lexikon generiert und anschließend das mindestens eine Lexikon als Vokabular in die Spracherkennungseinrichtung geladen wird.
  2. 2
    Method according to claim 1,characterized,that at least one lexicon is generated from the permissible utterances uttered on at least one database in an 'off-line editing mode', and after the activation of the at least one operating function of the navigation system, depending on the at least one input dialog, the at least one in the 'off-line Editing mode 'generated lexicon is loaded in real time as vocabulary into the speech recognition device. Verfahren nach Anspruch 1, dadurch gekennzeichnet, daß mindestens ein Lexikon aus den auf mindestens einer Datenbasis gespeicherten zulässigen Sprachäußerungen in einem 'Off-Line-Editiermodus' generiert wird, wobei nach der Aktivierung der wenigstens einen Bedienfunktion des Zielführungssystems in Abhängigkeit des mindestens einen Eingabedialogs das mindestens eine im 'Off-Line-Editiermodus' generierte Lexikon in Echtzeit als Vokabular in die Spracherkennungseinrichtung geladen wird.
  3. 3
    Method according to claim 1 or 2,characterized,that at least one utterance is a place name and / or a street name, with all permitted place names being stored in a destination file, with all permitted street names being stored in a street list for at least one permitted place name. Verfahren nach Anspruch 1 oder 2, dadurch gekennzeichnet, daß mindestens eine Sprachäußerung ein Ortsnamen und/oder ein Straßennamen ist, wobei alle zulässigen Ortsnamen in einer Zieldatei abgelegt sind, wobei für wenigstens einen zulässigen Ortsnamen alle zulässigen Straßennamen in einer Straßenliste abgelegt sind.
  4. 4
    Method according to claim 1,characterized,that the speech recognition device comprises at least one speaker-independent speech recognizer and at least one speaker-dependent additional speech recognizer, where, depending on the at least one input dialog, the speaker-independent speech recognizer is used for recognizing individually spoken place names and / or street names and / or letters spoken individually and / or in groups and / or parts of words and the speaker-dependent additional speech recognizer for recognizing at least one spoken keyword is used. Verfahren nach Anspruch 1, dadurch gekennzeichnet, daß die Spracherkennungseinrichtung mindestens einen sprecherunabhängigen Spracherkenner und mindestens einen sprecherabhängigen Zusatz-Spracherkenner umfaßt, wobei abhängig von dem mindestens einen Eingabedialog der sprecherunabhängige Spracherkenner zur Erkennung von einzeln gesprochenen Ortsnamen und/oder Straßennamen und/oder von einzeln und/oder in Gruppen gesprochenen Buchstaben und/oder von Wortteilen verwendet wird und der sprecherabhängige Zusatz-Spracherkenner zur Erkennung von mindestens einem gesprochenen Schlüsselwort verwendet wird.
  5. 5
    Method according to claim 4,characterized,that the at least one keyword is assigned a specific destination address, the at least one spoken keyword being stored in a personal address register, and wherein a name lexicon is generated from the personal address register and loaded into the speech recognition device. Verfahren nach Anspruch 4, dadurch gekennzeichnet, daß dem mindestens einen Schlüsselwort eine bestimmte Zieladresse zugeordnet wird, wobei das mindestens eine gesprochene Schlüsselwort in einem persönlichen Adreßregister gespeichert wird, und wobei aus dem persönlichen Adreßregister ein Namen-Lexikon generiert und in die Spracherkennungseinrichtung geladen wird.
  6. 6
    Method according to claim 2,characterized,that a basic lexicon that was generated in the 'off-line editing mode' contains the 'p' largest places of a state. Verfahren nach Anspruch 2, dadurch gekennzeichnet, daß ein Grund-Lexikon, welches im 'Off-Line-Editiermodus' generiert wurde, die 'p' größten Orte eines Staates enthält.
  7. 7
    Method according to claim 6,characterized,that the basic lexicon is stored in an internal non-volatile memory of the navigation system. Verfahren nach Anspruch 6, dadurch gekennzeichnet, daß das Grund-Lexikon in einem internen nicht flüchtigen Speicher des Zielführungssystems gespeichert ist.
  8. 8
    Method according to claim 1,characterized,that an environment lexicon which is generated in real time contains 'a' locations in the vicinity of the current vehicle location, the environment lexicon being updated at regular intervals. Verfahren nach Anspruch 1, dadurch gekennzeichnet, daß ein Umgebungs-Lexikon, welches in Echtzeit generiert wird, 'a' Orte im Umkreis des aktuellen Fahrzeugstandortes enthält, wobei das Umgebungs-Lexikon in regelmäßigen Abständen aktualisiert wird.
  9. 9
    A method according to claim 8,characterized,that the environment lexicon is stored in an internal non-volatile memory of the route guidance system. Verfahren nach Anspruch 8, dadurch gekennzeichnet, daß das Umgebungs-Lexikon in einem internen nicht flüchtigen Speicher des Zielführungssystems gespeichert ist.
  10. 10
    Method according to claim 3,characterized,that after activating an input dialog 'spell destination' a partial word lexicon for spelling recognition is loaded into the speech recognition device, that the user then enters individual letters and / or letter groups as utterances, which are then compared in the speech recognition device with the partial word lexicon, whereby a hypothesis list with word hypotheses is formed from the recognized letters and / or groups of letters, that the first 'n' word hypotheses are then compared with the target file and a whole-word lexicon is generated from the result of the comparison and loaded into the speech recognition device for full-word recognition, and that subsequently a stored acoustic value in the speech recognition device for full-word recognition with the full-word lexicon is compared this acoustic value was generated from a speech uttered as a whole word before loading the partial word lexicon. Verfahren nach Anspruch 3, dadurch gekennzeichnet, daß nach der Aktivierung eines Eingabedialogs 'Zielort buchstabieren' ein Teilwort-Lexikon zur Buchstabiererkennung in die Spracherkennungseinrichtung geladen wird, daß anschließend der Benutzer einzelne Buchstaben und/oder Buchstabengruppen als Sprachäußerungen eingibt, welche anschließend in der Spracherkennungseinrichtung mit dem Teilwort-Lexikon verglichen werden, wobei aus den erkannten Buchstaben und/oder Buchstabengruppen eine Hypothesenliste mit Worthypothesen gebildet wird, daß danach die ersten 'n' Worthypothesen mit der Zieldatei abgeglichen werden und aus dem Ergebnis des Abgleichs ein Ganzwort-Lexikon generiert und zur Ganzworterkennung in die Spracherkennungseinrichtung geladen wird, und daß anschließend ein gespeicherter akustischer Wert in der Spracherkennungseinrichtung zur Ganzworterkennung mit dem Ganzwort-Lexikon verglichen wird, wobei dieser akustische Wert aus einer als Ganzwort gesprochenen Sprachäußerung vor dem Laden des Teilwort-Lexikons erzeugt wurde.
  11. 11
    Method according to claim 1,characterized,that after recognizing a 'rough destination' entered through an input dialog 'enter rough destination', 'm' locations in the vicinity of 'rough destination' are calculated in real time by the route guidance system and a fine destination lexicon is generated from these 'm' locations and in the speech recognition device is loaded. Verfahren nach Anspruch 1, dadurch gekennzeichnet, daß nach dem Erkennen eines durch einen Eingabedialog 'Grobziel eingeben' eingegebenen 'Grobziels', durch das Zielführungssystem in Echtzeit 'm' Orte im Umkreis um den Ort 'Grobziel' berechnet werden und aus diesen 'm' Orten ein Feinziel-Lexikon generiert und in die Spracherkennungseinrichtung geladen wird.
  12. 12
    Apparatus for carrying out the method according to one of the preceding claims, in which a route guidance system (2) is connected to a speech dialog system (1) via corresponding connections (12), wherein depending on at least one speech uttered by a user in a speech input device (5), if the spoken utterance is recognized as a permissible voice command by a speech recognition device (7), An operating function of the route guidance system (2) assigned to the voice command can be activated by means of a dialog and sequence control (8), wherein all permissible utterances can be stored on at least one database (9;4;3),characterized,that by means of the dialog and sequence control (8), depending on at least one input dialog, which is part of at least one operating function, at least one lexicon can be generated in real time from the permissible utterances expressed on the at least one database (9;4;3) and as a vocabulary can be loaded into the speech recognition device (7). Vorrichtung zum Ausführen des Verfahrens nach einem der vorhergehenden Ansprüche, bei welcher ein Zielführungssystem (2) über entsprechende Verbindungen (12) mit einem Sprachdialogsystem (1) verbunden ist, wobei abhängig von mindestens einer von einem Benutzer in eine Spracheingabeeinrichtung (5) gesprochene Sprachäußerung, wenn die gesprochene Sprachäußerung als ein zulässiges Sprachkommando von einer Spracherkennungseinrichtung (7) erkannt wird, mittels einer Dialog- und Ablaufsteuerung (8) eine dem Sprachkommando zugeordnete Bedienfunktion des Zielführungssystems (2) aktivierbar ist, wobei alle zulässigen Sprachäußerungen auf mindestens einer Datenbasis (9;4;3) speicherbar sind, dadurch gekennzeichnet, daß mittels der Dialog- und Ablaufsteuerung (8) in Abhängigkeit von mindestens einem Eingabedialog, welcher Teil mindestens einer Bedienfunktion ist, in Echtzeit wenigstens ein Lexikon aus den auf der mindestens einen Datenbasis (9;4;3) gespeicherten zulässigen Sprachäußerungen generierbar und als Vokabular in die Spracherkennungseinrichtung (7) ladbar ist.
  13. 13
    Device according to claim 12,characterized,that by means of the dialog and sequence control (8), depending on at least one input dialog, at least one lexicon generated in the 'off-line editing mode' and stored on at least one database (9;4;3) in real time as a vocabulary in the Speech recognition device (7) can be loaded. Vorrichtung nach Anspruch 12, dadurch gekennzeichnet, daß mittels der Dialog- und Ablaufsteuerung (8) in Abhängigkeit von mindestens einem Eingabedialog mindestens ein im 'Off-Line-Editiermodus' generiertes Lexikon, welches auf mindestens einer Datenbasis (9;4;3) gespeichert ist, in Echtzeit als Vokabular in die Spracherkennungseinrichtung (7) ladbar ist.
Independent claims13