05 August 2008

Test: Philips LFH 331 Ohrhörer-Mikrofon-Kombination

Ich habe mir testweise die Philips-Ohrhörer-Mikrophon-Kombination LFH 331 8zu sehen unter http://www.dictation.philips.com/index.php?id=53&CC=DE) für das digitale Diktiergerät DPM 9600 kommen lassen und gestern unter verschärften Bedingungen getestet - im doch recht starken Wind, an der Kreuzung Skalitzer Straße/Schlesische Straße in Berlin-Kreuzberg.

Vorgabe war festzustellen, ob das Gerät eine vernünftige Geräuschunterdrückung bietet.

Leider scheint es so zu sein, dass das Mikrophon keine spürbare Verbesserung bei der Aufnahme bringt. Dies mag am Wind liegen, der alles andere übertönt; aber auch was die Nebengeräusche durch Autos angeht, kann ich nicht wirklich eine qualitative Veränderung feststellen. Dies bezieht sich explizit auf die Spracherkennung eines aufgenommen Diktats, die Qualität des Diktats scheint mir subjektiv besser zu sein. Die Sprache selbst klingt klarer als durch das eingebaute Mikrophon des Diktiergerätes.

Das erste Fazit ist also, dass das Gerät durchaus dafür geeignet ist, in vertraulichen Situationen zu diktieren, in denen man nach Möglichkeit niemand mithören lassen will. Vor allem das abhören des Diktats geschieht für die Außenwelt geräuschlos; das Diktat selbst produziert natürlich immer noch gesprochene Sprache :-) Auch ein Diktat im Auto, bei dem ich die Hände weitgehend frei haben will, ist gut möglich; der Vorteil besteht halt darin, die Hände frei zu haben.

Um aber in einer lauten Umgebung Nebengeräusche herauszufiltern, würde ich ein anderes Gerät nehmen, also eines der Aufsteckmikrofone, die alle drei Anbieter im Programm haben.

So ist das eben - für jede Situation die passende Lösung. Leider nicht eine Lösung für alle Situationen...

22 Juli 2008

Fußschalter neu erfunden! (Belesenheit schützt vor Neuentdeckungen)

Michael Spehr macht mich aufmerksam auf einem Beitrag des hessischen Rundfunks, indem die Erfinder des Fußschalters für computergestützte Konstruktion von digitalen Diktaten erfunden werden - und Überraschung: es handelt sich um zwei Studenten aus Hessen. "Belesenheit schützt vor Neuentdeckungen" - pflegte mein verehrter Lehrer zu sagen.

Den Vorwurf brauchen wir den Erfindern gar nicht zu machen. Wie der Webseite der beiden Studenten zu entnehmen ist, sind sie sich durchaus dessen bewusst, dass es auch professionelle Diktiersysteme anderer Hersteller mit entsprechenden Fußschaltern gibt. Der Redakteur des hessischen Rundfunks scheint allerdings die nötigen Klicks nicht gemacht zu haben; er porträtiert die beiden tatsächlich so, als wäre ihr Gerät - welches übrigens mit einer einzigen Taste auskommt und daher für jede Sekretärin indiskutabel ist - tatsächlich der erste seiner Art für Computer.

Und weil ich im Gegensatz zum hessischen Rundfunk Webseiten gerne etwas genauer anschaue, erfahre ich bei der Gelegenheit, dass es tatsächlich die Firma NCH in Australien noch gibt, die irgendwann eine kostenlose Software zur Verfügung gestellt haben, mit der sich DSS-Dateien abspielen lassen - sehr zum Ärger der drei Großen, die nicht nur das Format erfunden haben, sondern auch eifrig Lizenzgebühren dafür kassieren.

Letztlich eine Bastellösung, die für Studenten sicherlich vollkommen ausreicht, aber kein professionelles Diktatmanagement ersetzen kann. Deshalb wird auf der Website auch das Diktiersystem von Olympus als professionelle Workflow-Lösung mit verkauft.

Als Fußnote:

Die Betreiber haben das Sonderangebot von Olympus, ein WS-110 digitaler Notetaker im Paket mit Dragon NaturallySpeaking "Recorder Edition", getestet, stellen den Test inklusive Korrekturen auf der Webseite zur Verfügung, und siehe da - die Spracherkennung schlägt sich mehr als tapfer! Wenn wir davon ausgehen, dass die meisten Wörter, die nicht erkannt wurden, nicht vorher zum Wortschatz hinzugefügt worden, wie sich das eigentlich gehören würde, ist die Umsetzung tatsächlich fast fehlerfrei.

21 Juli 2008

Vortrag: Spracherkennung für Übersetzer - jetzt erhältlich

Der Vortrag "Spracherkennung als Hilfsmittel für einen modernen Übersetzer-Arbeitsplatz", den Cornelia Soldat und ich am 24.06.2008 in der Humboldt-Universität zu Berlin gehalten haben, ist jetzt transkribiert und als Manuskript erhältlich. Interessenten senden bitte eine kurze Mail an
cornelia.soldat [at] cs-spracherkennung.de.

16 Juli 2008

Google Lets You Search for Text in Some Videos

Google lässt Sie in Videos nach Text suchen - schreibt das Blog www.blogscoped.com.

Was hier vorgestellt ist, ist eigentlich Audio Mining und als solches eine schon lange gehegte Begehrlichkeit: Große Mengen von gesprochenem Text werden per automatischer Spracherkennung verschriftlicht und nach bestimmten Schlüsselwörtern durchsucht. (Erinnert sich noch jemand an die Witze nach dem 11. September, als man am Telefon so Sätze wie "Ich bin laden, sprach der LKW-Fahrer" sagte, um den CIA einzuschalten?)

Google hat dies jetzt weitergeführt: YouTube-Videos können nach bestimmten Wörtern durchsucht werden und die Suchmaschine gibt das passende Video aus, komplett mit Markierung, wo der Suchbegriff zu hören ist. Verfügbar ist das im Moment für Videos der amerikanischen Präsidentschaftskandidaten; die direkte URL ist http://speech.clients.google.com/elections2008videosearch/gadget.

Nun ist nicht jede Technologie, die Google den Massen anbietet, unbedingt der Durchbruch, aber es freut uns doch, wieder ein Beispiel für funktionierende Spracherkennung zu sehen!

(Dank an Michael Spehr für den Hinweis)

15 Juli 2008

Tipp: Eigenschaften bearbeiten, um falsche Erkennungen auszuschalten

Wenig bekannt ist die Möglichkeit, Eigenschaften einzelner Wörter zu bearbeiten. Dazu werde ich in der nächsten Zeit einige Beiträge verfassen. Heute geht es darum, mit Hilfe der Eigenschaften eines Wortes die ärgerlichen Fehlerkennungen zu vermeiden, bei denen trotz hartnäckigem Training immer wieder das selbe falsche Wort hingeschrieben wird.

Wenn ein Wort konstant falsch verstanden wird und immer dieselbe Alternative auftaucht (z.B. PDS statt PDF), ist es verlockend, im Fenster "Vokabular bearbeiten" einfach "PDS" als gesprochene Form für "PDF" einzutragen. Jedoch kann das zu Verwirrungen in Dragons akustischem Modell führen, in dem u.a. die Informationen über die Aussprache einzelner Laute gespeichert werden. Besser ist es daher, im Fenster "Vokabular bearbeiten" unter "Eigenschaften" die gewünschte Form einzutragen. Dies berührt das akustische Modell nicht.

Unter "Vokabular bearbeiten" wählen Sie das Wort aus, was statt des richtigen Wortes erkannt wird, und klicken auf "Eigenschaften". Setzen Sie einen Haken vor "Alternative Form" und tragen Sie in das Feld daneben das Wort ein, welches geschrieben werden soll. Bestätigen Sie mit OK.

Denken Sie daran, dass jetzt immer das andere Wort erscheint, Sie also z.B. "PDS" nicht mehr diktieren können! Aber die gibt es ja sowieso nicht mehr...

14 Juli 2008

Vergleich: Diktiergeräte für Spracherkennung

Welches Diktiergerät eignet sich am besten für Spracherkennung? Um dieser Frage nachzugehen, habe ich einen identischen Text von circa 150 Wörtern Länge mit vier verschiedenen Diktiergeräten gelesen und jeweils von Dragon NaturallySpeaking 9.5 mit einem neuen, nicht auf das Diktiergerät trainierten Profil umsetzen lassen. Beim Diktat des Referenztextes mit einem Handmikrophon oder Headset habe ich in der Regel keinen Fehler (es handelt sich um einen Demo-Text aus dem Bereich Radiologie, den ich bei Präsentationen verwende).

Geräte, die sowohl das DSS-Format als auch das DSS pro-Format unterstützen, habe ich (nach Möglichkeit) mit beiden Formaten getestet.

Bei den getesteten Diktiergeräten handelt es sich um die derzeit aktuellen Modelle der führenden Hersteller:

- Olympus DS-4000
- Olympus DS-5000
- Philips Digital Pocket Memo 9600
- Grundig Digta 420

Jetzt die Überraschung: die Abweichungen waren minimal. Egal ob DSS oder DSS pro, egal welches Gerät - die Fehlerquote bewegte sich zwischen zwei und vier Fehlern. Interessanterweise war beim DSS pro-Format keine Verbesserung gegenüber dem DSS-Format feststellbar, obwohl beim Abhören der Diktate ein deutlicher Qualitätsunterschiede zu hören ist.

Die Frage bleibt, wie sich dieses Ergebnis bewerten lässt: sind vier Fehler auf 150 Wörter statistisch aussagekräftig oder nicht? Auf den ersten Blick handelt es sich natürlich um eine doppelt so hohe Fehlerquote; aber der Text ist zu kurz, um wirklich zu entscheiden, ob es sich um einen statistisch nicht aussagekräftigen Zufall handelt oder tatsächlich um eine deutlich schlechtere Qualität des Diktiergerätes. Hier wäre es interessant, alle Diktiergeräte einmal mit einem deutlich längeren Text zu testen. Das Olympus DS-5000, welches ich im Moment als mein Arbeitsgerät benutze, hat im kurzen Test vier Fehler gemacht; bei einem Diktat von 15 Minuten Länge aber nur sieben echte Erkennungsfehler provoziert.

Offensichtlich gilt also: die Geräte sind praktisch identisch, was die Leistung mit Spracherkennung angeht. Wichtiger ist der Stil beim Diktieren, die Nebengeräusche, wie konzentriert man ist. Und für die Entscheidung für oder gegen eines der Diktiergeräte bleibt nach wie vor eher der persönlich empfundene Komfort bei der Bedienung ausschlaggebend als die Qualität.

Fazit dieses Tests also: Diktiergeräte sind Gefühlssache :-)

19 Juni 2008

Vortrag: Spracherkennung und Übersetzungswissenschaft

Der für die Lange Nacht der Wissenschaften in Berlin angekündigte, dann aber verschobene Vortrag

„Spracherkennung und Übersetzungswissenschaft“

von Cornelia Soldat und mir wird jetzt endgültig nachgeholt am

Dienstag, 24.6. 16.00 Uhr, Humboldt-Universität zu Berlin, August-Boeckh-Haus Raum 5.42
Dorotheenstr. 65, 10117 Berlin, S + U Friedrichstraße

Alle Interessenten sind herzlich eingeladen!

16 Juni 2008

Neu bei Olympus: WS-110 DNS Version

Olympus bietet den digitalen Recorder WS-110 jetzt im Bundle mit einer Dragon NaturallySpeaking Recorder Edition an. Diese habe ich mir mal genauer angesehen, denn das Paket klingt wirklich verlockend: ein digitales Diktiergerät (der Einsteigerklasse) und ein Dragon mit nicht weniger als sechs Erkennungssprachen für ca. 100 € - wer kann dazu schon nein sagen?

Die Firma Olympus hat mir dankenswerterweise eine DVD zur Verfügung gestellt, von der aus ich die Recorder Edition auch ohne Probleme installieren konnte (ein Diktiergerät war nicht dabei, so das ich hierzu leider nichts weiter sagen kann). Allerdings wurde ich schon zu Beginn stutzig (ich hatte vorher eine ältere Version von Dragon auf dem Rechner): Der Installer warnt davor, dass die Funktionalität, direkt in den PC zu diktieren, mit diesem Upgrade verloren geht.

So war es dann auch: zwar kann ich Englisch, Spanisch, Französisch, Italienisch, Niederländisch und Deutsch als Erkennungssprachen installieren, doch als Diktierquelle steht mir nur "Pocket PC" und "Audiodateien auf Festplatte" zur Verfügung. Damit bewahrheitet sich der Name: Die Recorder Edition unterstützt nur das sogenannte Offline-Diktat, d.h. die Umsetzung von zuvor aufgenommenen Aufnahmen.

Dies tut sie in gewohnter Dragon-Qualität und in sechs Sprachen, insofern kann man sie wirklich als Schnäppchen bezeichnen. Unter der Haube arbeitet eine Dragon NaturallySpeaking Preferred 9.5.

Startet man das Programm, wird man auf eine britische Website geführt, wo sich die Vollversion Dragon NaturallySpeaking Preferred für nur 99,99 Britische Pfund erwerben lässt. Doch Obacht: Diese Preferred ist dann eine ganz normale Preferred ohne die sechs Sprachern (ich frage mich sofgar, ob Deutsch dabei ist). Auch der Umrechnungskurs hat es in sich: rechne ich die 100 Pfund in Euro um, kostet die Preferred plötzlich 199 EUR - laut amtlichem Wechselkurs wären es ca. 125 EUR. Da bestellt man doch lieber woanders.

Bei der Beschreibung der Software ist ebenfalls Vorsicht geboten: automatische Zeichensetzung und Ausfiltern von Ähs und Öhs stehen z.B. im Deutschen nicht zur Verfügung, wie auch in allen anderen Dragon-Versionen nicht. Im Englischen sieht das anders aus; andere Sprachen beherrsche ich nicht so weit, dass ich damit diktieren könnte.

Fazit: Was kann die Recorder Edition und was nicht?

- Sie kann Diktate in sechs Sprachen von (beliebigen) digitalen Diktiergeräten umsetzen. Das mitgelieferte Olympus WS-110 ist übrigens für sein gutes Mikrofon bekannt und für Spracherkennung sehr gut geeignet.
- Sie kann nicht direktes Diktat in den Rechner ermöglichen. Dazu braucht man die Dragon NaturallySpeaking Preferred Edition oder eine der professionellen Editionen. Damit werden allerdings die sechs Sprachen eingeschränkt auf höchstens zwei; und der Bezug über den eingebauten Link ist nicht wirklich ratsam.

Wer braucht das Angebot also? Die Recorder Edition in Verbindung mit dem WS-110 ist für mich (andere mögen das anders sehen) eine sehr günstige Möglichkeit, Sprachnotizen aufzuzeichnen und hinterher per Spracherkennung umzusetzen. Dies ist für mich ein wichtiges Einsatzgebiet, welches ich in letzter zeit fast täglich nutze. Wer sich ohnehin mit dem Gedanken trägt, ein Diktiergerät der Notetaker-Klasse anzuschaffen, ist mit dem Paket hervorragend bedient. Als Einstieg in die Spracherkennung bietet die Recorder Edtition von Dragon NaturallySpeaking lediglich einen Vorgeschmack auf die Möglichkeiten, die das direkte Diktat in den PC - immer noch die Königsdisziplin der Spracherkennung - bietet. Für die paar Euro mehr kann ich aber jedem nur raten, die Spracherkennung mit zu kaufen und dann bei Gelegenheit umzusteigen.

Lange Nacht der Wissenschaften - fand leider nicht statt

Will sagen: natürlich fand die lange Nacht der Wissenschaften statt, aber leider ohne unsere Beteiligung. Da der Vortrag "Spracherkennung als Hilfsmittel für einen modernen Übersetzer-Arbeitsplatz" von Cornelia Soldat und mir erst sehr spät ins Programm genommen wurde, gab es bei der Veranstaltung ein Missverständnis, aufgrund dessen wir uns schließlich ohne Ort und ohne Beamer wiederfanden und beschlossen haben, den Vortrag demnächst in einem anderen Rahmen an der Humboldt-Universität zu wiederholen.

Die Ankündigung werde ich rechtzeitig veröffentlichen.

Vorteil: der Vortrag wird nicht zu ganz so nachtschlafender Zeit stattfinden, und der Eintritt wird frei sein.

Ich freue mich auf Ihren Besuch, man lernt seine LeserInnen gern mal persönlich kennen!

11 Juni 2008

Spracherkennung in der Langen Nacht der Wissenschaft, Berlin

Am kommenden Samstag, 14.6.2008, führen meine Kollegin Dr. Cornelia Soldat und ich im Rahmen der Langen Nacht der Wissenschaften in Berlin Spracherkennung vor. Die Einladung stammt vom Institut für Slawistik der Humboldt-Universität zu Berlin (wo ich promoviert habe, falls noch mal jemand nach der Herkunft meines Doktortitels fragt), weshalb der Vortrag überschrieben ist mit "Spracherkennung als Hilfsmittel für einen modernen Übersetzer-Arbeitsplatz". Auch Nicht-Übersetzer werden aber auf ihre Kosten kommen, und sei es in der anschließenden Diskussion.

Themen sind u.a. die Erstellung und Bearbeitung von Fachwortschätzen, das technische Rüstzeug für Spracherkennung, aber auch die Funktionsweise solcher Anwendungen und die lingustischen Hintergründe.

Der Vortrag beginnt um 21h im Foyer der "Kommode", August-Bebel-Platz 1, Berlin-Mitte (gegenüber von Staatsoper und Humboldt-Universität).

Anschließend findet auf dem Platz - 1933 Ort der Bücherverbrennung - eine Lesung statt zum Thema: Verb(r)annte Interkulturalität Auch übersetzte Bücher fremdsprachiger Autoren wurden vor 75 Jahren dem Feuer anheim gegeben.

Am Bebelplatz, dem Ort der Bücherverbrennung, lesen Studierende Texte in Originalsprache und auf Deutsch. LESUNG: 22.00-23.30 Uhr

Herzliche Einladung an alle Interessierten! Weitere Informationen, Eintrittspreise usw. entnehmen Sie bitte der Website der Langen Nacht der Wissenschaften.

29 Mai 2008

BlackBerry zum Diktat – Diktiersoftware für BlackBerrys von Thax

BlackBerry zum Diktat – Diktiersoftware für BlackBerrys - kündigt Golem.de an. Thax Software hat eine Ergänzung des Findentity-Diktiersystems für Anwälte vorgestellt, bei dem sich der Blackberry als Diktiergerät verwenden lässt. Die Features - Tastenbedienung, Einfügen, Überschreiben, Indexmarken usw. - klingen völlig professionell; im Unterschied zu dem Versuch von Dictanet sollen die die Aufzeichnungen auch mit Spracherkennung bearbeiten lassen. Ein wenig Gedanken machr mir der verwendete Audio-Codec .amr statt des (lizenzpflichtigen) DSS. Das sieht nach proprietärer Lösung aus... einen PC-Player gibt es aber kostenlos dazu, notfalls lässt sich auch der Real Player verwenden. Spracherkennung braucht allerdings WAV; mal schauen, wir das gelöst wird.

Die Software soll 149 € zzgl. Mwst. kosten; derzeit gibt es sie zum kostenlosen Download zur Evaluation.

Ich warte seit Jahren auf eine vernünftige Lösung für den Pocket PC; Thax verspricht da was für "in ca. 3 Monaten". Ich bin gespannt!

(Dank an Ronny Jaekel)

16 Mai 2008

Test Headsets für Spracherkennung: Logitech vs. Terratec - wer hört besser zu?

Test Headsets für Spracherkennung: Logitech vs. Terratec - wer hört besser zu?

Der Titel sagt alles. Einen Hinweis habe ich noch: Die Zahl im Audioassistenten von Dragon gibt lediglich das Verhältnis von Sprache zu Nebengeräuschen an und ist kein Indikator für die spätere Erkennungsgenauigkeit! Ich hatte mal 37 Punkte mit einem Mikrofon, das so leise war, dass es überhaupt keine Nebengeräusche, aber auch nur sehr wenig Sprache aufgezeichnet hat. Wenn übrigens am Notebook alle Mikrofone brummen, würde ich mal den USB-Anschluss checken.
Das aber nur am Rande - Danke für den aufwändig recherchierten Test an Wolf-Dieter Roth (von dem wir auch nur Gutes gewöhnt sind).

Ich bleibe trotzdem bei meinem GN 9350, alternativ VXI Parrott Talk Pro - aber ich muss ja nicht auf den Pfennig schauen, was diese Geräte angeht. Abgesehen davon lohnt sich die Ausgabe für ein gutes Mikro immer - aber noch mehr der Aufwand, vernünftig zu diktieren (ceterum censeo...)

Nuance - Sprechen Sie Dragon?

Der Welt will ich diesen Wettbewerb nicht vorenthalten: Nuance - Sprechen Sie Dragon?

Ich spreche Dragon, um mein Blog schneller zu betexten :-)

Tipps und Tricks: Eigenschaften bearbeiten

Eine wenig genutzte Funktionen im Menü "Vokabular bearbeiten" ist die Möglichkeit, Worteigenschaften zu definieren. Hier hat man beispielsweise Gelegenheit festzulegen, ob vor oder nach einem Wort eine Leerstelle kommt, groß oder klein weitergeschrieben wird und dergleichen mehr. Außerdem -- und für die tägliche Anwendung meist wichtiger -- lässt sich das Verhalten von Zahlen vor oder nach einem Wort regeln und eine alternative Form in Abhängigkeit vom Kontext eingeben.

Dragon NaturallySpeaking bietet die Möglichkeit, Worteigenschaften zu ändern. Dazu öffnet man den Vokabulareditor (in Dragon NaturallySpeaking: Wörter - Vokabular anzeigen/bearbeiten), sucht das betreffende Wort und klickt dann auf „ Eigenschaften". Im folgenden Dialog lassen sich verschiedene Eigenschaften eines Wortes definieren, zum Beispiel ob das Wort mit oder ohne vorhergehende oder nachfolgende Leerstelle geschrieben wird, oder ob in einem bestimmten Kontext eine alternative Form geschrieben werden soll.

Über diese Funktion lässt sich zum Beispiel definieren, dass vor einer Zahl das Wort "Paragraph" als § geschrieben wird. Dazu wählt man unter "alternativen Schreibweise" die korrekte Schreibweise - in diesem Fall das § - und wählt zusätzlich "Immer alternativen Schreibweise verwenden - vor einer Zahl" und unter "Abstände": mit Leerstelle.

Analog lässt sich zum Beispiel definieren, dass das Wort "zirka" vor einer Zahl immer als "ca." geschrieben wird.

Über die Funktion "Zahlen immer als Ziffern schreiben" lassen sich auch Maßeinheiten definieren: wenn ich angebe, dass eine Zahl immer als Ziffer geschrieben werden soll, wenn sie vor diesem Wort steht, kann ich auch so exotische Maßeinheiten wie „ pmol/kg Körpergewicht" so bearbeiten, dass zahlen immer als Ziffern geschrieben werden, wenn sie vor der Maßeinheit stehen (und ich nicht sowieso grundsätzlich alle Zahlen immer als Ziffern schreiben will).

Damit Dragon NaturallySpeaking in einem Ausdruck wie "drei bis 4 cm" das Wort drei korrekt als Ziffer und "bis" als "-" schreibt, lässt sich über die Funktion "Eigenschaften" das Wort "bis" mit der alternativen Form "-"versehen. Diese alternative Form soll nur dann gebraucht werden, wenn vorher eine Zahl diktiert wurde.

Natürlich sind hier verschiedene Möglichkeiten, je nach Kontext, möglich. Leider können aber verschiedene Formatierungen nicht miteinander kombiniert werden; diese wird vielleicht in späteren Versionen der Software einmal der Fall sein.

15 Mai 2008

Tipps und Tricks: Zahlenformatierung

So erreicht man in Dragon NaturallySpeaking 9.5, dass Zahlen von null bis neun immer als Ziffern geschrieben werden, unabhängig vom Kontext:

Unter "Vokabular bearbeiten" ruft man sich jedes einzelne Zahlwort auf und bearbeitet die Eigenschaften so:

- Alternative Schreibweise: hier die Ziffer eingeben
- Abstände/Groß- und Kleinschreibung: "verbindet 2 Elemente mit dieser Eigenschaft" wählen

Zahlen werden jetzt unabhängig vom Kontext immer als Ziffern geschrieben, eine Reihe von Zahlen - z.B. eine Telefonnummer - wird ebenfalls korrekt geschrieben, das heißt ohne Lehrstellen zwischen den einzelnen Ziffern.

Anm.: Nicht beseitigt wird dadurch der Fehler, dass bei einem Datum mit nachfolgendem Punkt das Datum falsch geschrieben wird, also zum Beispiel "15.05.2000 8." anstatt "15.05.2008." - hier muss man eine Pause zwischen dem Datum und dem Punkt machen, damit das Datum korrekt geschrieben wird.


Wichtig: auch die groß geschriebenen Zahlwörter müssen mit diesen Eigenschaften versehen werden, ansonsten wird am Anfang eines Absatzes eine Zahl weiterhin als Wort geschrieben.

Richtig: 5 Wochen
Falsch: Fünf Wochen

Da mit diesen Einstellungen Zahlen immer als Ziffer geschrieben werden, sollte man sich überlegen, ob man wirklich diesen Weg geht - der Duden sieht als Standard vor, dass die Zahlwörter bis 10 ausgeschrieben werden, wer sich nach diesem Standard richten will oder richten muss, sollte eine Alternative dazu wählen:

Um die Zahlen von 0-9 nur im Kontext von anderen Zahlen als Ziffern zu schreiben (z.B. bei Postleitzahlen), gehen Sie so vor wie oben beschrieben. Setzen Sie aber zusätzlich in den Eigenschaften unter "Alternative Schreibweise" noch einen Haken vor "Immer alternative Schreibweise verwenden nach einer Zahl" und wählen Sie "Abstände - ohne Leerstelle".

Nuance liefert für DNS 9.5 folgende Hinweise zum Standard-Verhalten von Zahlen, die man sich natürlich auch angewöhnen kann:

Zur Eingabe von fünf- oder mehrstelligen Zahlen im Standardmodus möchten wir Sie auf die unterschiedlichen Eingabemöglichkeiten und die daraus resultierenden Zahlendarstellungen hinweisen:

1. "Direktes" Diktat der Zahl liefert als Ausgabe die Zahl formatiert mit Tausendertrennzeichen, z.B. "dreiundsiebzigtausendfünfhundert" - "73.500"
2. Eingabe der Zahl durch Diktieren von Ziffern liefert dies als Fließtext, z.B. "sieben drei fünf null null" - "sieben drei fünf null null"
3. Eingabe der Zahl durch Diktieren von Ziffern gefolgt von "Schreib das als Zahl" liefert diese als Ziffern getrennt durch Leerschritte, z.B. "sieben drei fünf null null" "Schreib das als Zahl" - "7 3 5 0 0"
4. Eingabe der Zahl durch Diktieren des Wortes "Ziffer" gefolgt von den Ziffern liefert die Zahl ohne Formatierung, z.B. "Ziffer sieben drei fünf null null" - "73500" 5. Eingabe der Zahl durch diktieren des Wortes "Nummerierung" gefolgt von den Ziffern liefert die Zahl ohne Formatierung, z.B. "Nummerierung sieben drei fünf null null" - "73500"
Bitte beachten Sie, dass im Zahlenmodus die letzten beiden Möglichkeiten nicht zur Verfügung stehen und die zweite Möglichkeit als Ergebnis "7 3 5 0 0" liefert.
Für weitere Möglichkeiten zur Eingabe von Zahlen und Ziffern bitten wir Sie, sich auf das Kapitel "Zahlen diktieren" in der Online-Hilfe zu beziehen.


Dies als Update zu diesem Beitrag.

FAZ-Bericht über Olympus-Recorder

Im Zusammenhang mit dem FAZ-Test des Olympus-Aufsteckmikrofons hatte ich bereits darauf hingewiesen, dass Olympus auch hochwertige Recorder herstellt, die die technischen Werte eines Diktiergerätes bei weitem überschreiten. Bevor jetzt alle Diktierer anfangen, bessere Tonqualität einzufordern, sei allerdings darauf hingewiesen, dass es sich hierbei um mehr oder weniger professionelle Aufnahmegeräte zum Beispiel für Interviews, Musik und anderes handelt, die auch in den entsprechenden Branchen vermarktet werden. Während die Aufnahmequalität dieser Recorder CD-Qualität hat, fehlen wichtige Sachen, wie z.B. Zurückspulen, Überschreiben und Einfügen einzelner Passagen und dergleichen mehr, die für einen Diktanten relevant sind. Demgegenüber steht die Qualität der Aufnahme bei einem Diktiergerät nicht besonders weit oben auf der Prioritätenliste - digitale Aufnahmen sind grundsätzlich besser als Tonbänder, und mit dem neuen DSS pro-Standard bleiben für eine Sprachaufzeichnung, die geschrieben und danach weggeworfen wird, eigentlich keine Wünsche offen, was die Aufnahmequalität betrifft.

Vorgestern testete die FAZ dann das in diesem Zusammenhang auch schon von mir erwähnte Olympus LS 10, und zwar genau im Hinblick auf die Aufnahmequalität von Musik und Interviews hin. Wer möchte, kann den Artikel bei mir beziehen, E-Mail an stephan.kuepper [at] 4voice.de genügt. Aber wie gesagt - die Zielgruppe ist eine andere, wie mir am selben Tage eindrucksvoll vor Augen geführt wurde: nämlich durch eine ganzseitige Anzeige im neuen Katalog des Sound and Drumland. Dort gibt es das Gerät übrigens für 399 € zu kaufen, empfohlener Preis bei Olympus ist 449 €.

08 Mai 2008

Sprachmakros für Windows Vista

Das Blog speech @ microsoft veröffentlicht die Beta-Version von Sprachmakros für Windows Vista. Eine recht ausführliche Beschreibung findet sich in Rob Chambers' Blog, d.i. der Teamleiter Speech Recognition. Zeit, den Vista-Rechner zu aktivieren und mit der Arbeit zu beginnen - die Vista-Spracherkennung beginnt gerade nützlich zu werden. Wenn es auf Deutsch funktioniert...

07 Mai 2008

Schnurlose Spracherkennung - Übersicht

Da mich in letzter Zeit immer wieder Fragen erreichen, hier meine Tipps zum Thema Schnurlose Headsets und Eingabegeräte.

Für Spracherkennung gibt es derzeit zwei geeignete schnurlose Headsets, das Plantronics CS 60 USB und das Jabra GN9330 bzw. GN9350. Das Jabra GN 9350 hat gegenüber den anderen Geräten den Vorteil, dass es sich außerdem an das Telefon anschließen lässt und es somit erlaubt, mit dem selben Gerät zu diktieren und zu telefonieren. Preis und Qualität der Spracherkennung sind bei Plantronics und Jabra praktisch gleich; wegen der Telefon-Funktion ist das Jabra GN 9350 ca. 120 EUR teurer. Die ungefähren Preise (inkl. Mwst.):

  • Plantronics CS60 - ca. 320 EUR
  • Jabra GN9330 - ca. 320 EUR
  • Jabra GN9350 - ca. 440 EUR

Bestellen kann man sie z.B. hier (auf "Funkheadsets" klicken).

Preislich unschlagbar ist natürlich die Dragon NaturallySpeaking Wireless-Version, ein Dragon Preferred mit beigelegtem CS 60, das für ca. 300 EUR erhältlich ist. Mein Tipp für Einsteiger, aber auch das ebste Preis-Leistungs-Verhältnis für alle, die ein Wireless-Headset suchen!

Die Entscheidung für ein Modell kann ich Ihnen nicht abnehmen - letztlich ist es, wie immer, eher eine Frage des persönlichen Geschmacks als der Technik. Daher kann ich im weiteren auch nur für mich sprechen (aber dazu ist ein Blog ja da):

Ich selbst arbeite derzeit mit dem Jabra GN 9350 und bin sehr zufrieden - das Headset ist leicht und bequem, Probleme sind bisher nicht aufgetreten und auch von Kunden nicht bekannt, der Akku hält einen Arbeitstag lang durch (auch wenn ich empfehle, ihn während der Mittagspause aufzuladen), nur zu Umschalt-Funktion zum Telefon kann ich leider nichts sagen, weil ich kein geeignetes Telefon habe. Wenn man wie ich Voice over IP und privat schnurlose Handgeräte benutzt, ist es eben nicht möglich, das Headset zwischen Telefon und Hörer einzuschleifen.

Schnurlos arbeitet außer den genannten Headsets nur noch das Revolabs Solo Desktop-Ansteckmikrofon, das ebenfalls eine hervorragende Qualität der Erkennung bietet - wenn es möglichst weit oben am Hemd befestigt wird und man den Kopf beim Diktieren nicht bewegt. Abweichungen von der korrekten Haltung bestraft es leider sehr schnell.

Das Grundig Digta Cordex, ein schnurloses Handmikrofon, soll demnächst nun wirklich auf den Markt kommen; Dictanet bietet außerdem ein proprietäres Gerät an, das aber für Spracherkennung nur bedingt geeignet ist und außerdem die Dictanet-Software benötigt. Ein anscheinend baugleiches Gerät ist neulich mal in meinem Blickfeld aufgetaucht; vielleicht werden ja inzwischen bessere Komponenten verbaut. Zur Software weiß ich nichts. Weitere Lösungen aus dem Musikbereich sind bei technisch versierten Diktanten im Einsatz, dies sind aber m.W. nur vereinzelte Anwender.

Die Erkennungsgenauigkeit ist inzwischen bei den schnurlosen Headsets genauso gut wie bei den schnurgebundenen. Ein schnurloses Headset ist für mich aber immer nur im Büro einsetzbar, weil ich immer eine Basisstation an den Rechner anschließen muss. Wenn ich mit einem Notebook viel unterwegs bin, möchte ich dieses Gerät nicht mit schleppen müssen (damit dann im kritischen Moment die Batterie leer ist); hier würde ich also auf jeden Fall zu einem schnurgebundenen Headset raten.

Hier empfehle ich das VXI Parrott TalkPro-Headset, das ich an meinem Testrechner und als Back-up einsetze. Meine Erfahrungen finden Sie, wenn sie in den letzten Notizen nach "Parrott" suchen oder einfach folgenden Link anklicken: http://voiceberlin.blogspot.com/search?q=parrott. Bestellen können Sie das VXI Parrott TalkPro USB-Headset hier.

Bluetooth-Headsets sind dagegen für Spracherkennung nicht wirklich geeignet, da der Bluetooth-Standard keine ausreichende Übertragungsqualität gewährleistet. Einzige Ausnahme: das BlueParrott-Headset, und auch nur dann, wenn das Notebook Bluetooth eingebaut hat. Das Headset ist gut, aber mit dem Geräteanschluss durch Bluetooth hatte ich immer nur Ärger - übrigens unabhängig vom Gerät genauso mit Mäusen, Tastaturen und anderen Geräten.

Soweit zu den von mir getesteten Geräten. Ich freue mich über Erweiterungen meines Horizontes - wer von den Lesern hat eine Empfehlung? Nutzen Sie die Kommentar-Funktion oder mailen Sie an stephan [at] soldatkuepper.de!

30 April 2008

FAZ-Bericht über Olympus-Aufsteckmikrofon

Am 29.4. berichtete Michael Spehr in der FAZ über das Olympus ME-12 Aufsteckmikrofon für Diktiergeräte, das Nebengeräusche sehr effektiv ausfiltert und damit nach seinen Angaben die Spracherkennungsgenauigkeit beim Diktat im Auto von 80-90% auf 98 % steigert. Für viele Diktierer sicher ein großer Nutzen!

Das Gerät selbst ist gar nicht so neu, aber das ist schließlich kein Hindernis für eine Berichterstattung. Wer es moderner liebt: Ein Kollege weist mich darauf hin, dass es inzwischen weitaus bessere Aufnahmesysteme von Olympus gibt, die allerdings dann auch entsprechend viel kosten, oder aber zum Diktat nicht gedacht sind. Beispiele sind die derzeit leider nicht verfügbaren Olympus LS 10 und Olympus DS 50.

Wirklich beeindruckend fand ich aber den Einsatz des Testers, der mit Tempo 140+ im Rhein-Main-Gebiet über die Autobahn braust und dabei noch diktiert! Sehr hübsch auch das Foto zum Artikel, das das Olympus-Mikro auf einem Philips-Diktiergerät zeigt und solcherart beweist, dass es mit allen gängigen Geräten kompatibel ist.

Den Artikel bestellen Sie bei mir per E-Mail an stephan.kuepper [at] 4voice.de. Das Aufsteckmikro gibt es z.B. im 4voice-Shop für ca. 20 EUR.

11 April 2008

Testbericht: Olympus DS 5000

Das neue digitale Diktiergerät von Olympus, dass Olympus DS 5000, ist bisher noch gar nicht auf dem Markt erhältlich. Das hier von mir vorgestellt Gerät wurde mir vorab von der Firma Olympus zur Verfügung gestellt, um es auf der Messe zu benutzen und dort vorzuführen. Dafür herzlichen Dank!

Das Olympus DS 5000 zeichnet ausschließlich im DSS Pro-Modus auf. Dafür gibt es zwei Qualitäten, SP und QP. Ich habe denselben Text in beiden Qualitäten aufgenommen; die höhere Qualität gab tatsächlich eine bessere Wiedergabe. Die Spracherkennung der beiden Dateien gab allerdings ein nahezu identisches Ergebnis; interessanterweise war der in der höheren Qualität aufgenommenen Text etwas schlechter umgesetzt. Der Fairness halber muss ich sagen, dass ich die Spracherkennung nicht auf das Gerät trainiert habe, sondern einfach mein normales lokales Profil gewählt habe.

Das Design des Gerätes ist wie immer Geschmackssache, ich habe etwas gebraucht, um mich mit der Farbe der Metallteile anzufreunden. Die schwarze Gehäusefarbe stört nicht wirklich, die metallfarbenen Teile wirken allerdings, als wäre das Gerät schon einige Zeit in Gebrauch. Inzwischen finde ich es aber angenehm. Der Schiebeschalter liegt hervorragend in der Hand, auch ansonsten sind zahlreiche kleine Verbesserungen vorgenommen worden.

Ob man wirklich die ganzen Bedienelemente auf der Vorderseite braucht, sei dahingestellt. Jedenfalls lassen sich die wesentlichen Funktionen im Kontext aufrufen, und auch das Bedienfeld zum Vor und Zurückspulen ist intuitiv zu bedienen, die Tasten allerdings "für Chirurgenhände zu klein" (Zitat einer Dame, die vor einigen Jahren ein digitales Diktatmanagement in einem Krankenhaus eingeführt hat).

Das Gerät enthält fest eingebaut ein Mikro-SD-Karte, außerdem eine herkömmliche SD-Karte als Wechselspeicher. Dies führt dazu, dass sich beim Anschluss des Gerätes gleich zwei Windows Explorer-Fenster öffnen, weil es als doppelter Wechseldatenträger erkannt wird. Im Gerät ist einstellbar, ob es als Wechseldatenträger oder als USB-Gerät fungieren soll.

Viele Verbesserung liegen im Detail, so z.B. in dem doppelten Speicher, der wirklich bequemen Ladestation, die sich mit einer Hand bedienen lässt und nicht mit der anderen Hand festgehalten werden muss, dem USB-Anschluss, der jetzt auch den Standards genügt, der leicht zu wechselnden Karte, dem neugestalteten Schiebeschalter usw. Olympus schließt mit diesem Gerät zu den neuen Modellen von Philips und Grundig auf, welches Gerät man bevorzugt, ist jetzt wieder mehr denn je Frage der persönlichen Vorlieben.

Nuance-Sonderaktion: Dragon-Testversion beim Kauf eines Plantronics Headset

Tipp aus der Voice Community:
Mit dem Kauf eines .Audio 310 oder .Audio 610 USB-Headsets von Plantronics haben Kunden noch bis Jahresende die Möglichkeit, die Spracherkennungssoftware Dragon NaturallySpeaking 9 kostenlos zu testen. Dies haben die beiden Hersteller Plantronics und Nuance im Rahmen einer strategischen Partnerschaft vereinbart. Die Kunden erhalten beim Kauf des Plantronic Headsets einen Code, mit dem sie die Testversion unter www.nuance.co.uk/plantronics kostenlos herunterladen und 15 Tage lang ausprobieren können. Danach können sie die Spracherkennungssoftware zu einem vergünstigten Preis erwerben.


Meine Neugier war nicht so groß, dass ich alles stehen und liegen gelassen hätte, um den Link auszuprobieren, aber neulich war es so weit: auch ohne Code kann man sich dort immer noch für die Testversion registrieren und sie herunterladen - zunächst nur eine kleine EXE-Datei von 385 KB, die dann einen Download Manager startet. Der ganze Download hat 250 MB.

Mein Augenmerk lag weniger auf dem Test der Spracherkennung - die funktioniert nicht schlechter als in anderen Versionen - als auf den Features der Standard. Hier muss ich sagen, dass ich nur die Eischätzung meines Kollegen Stefan Osterland bestätigen kann, der die Standard als "kostenpflichtige Demoversion" bezeichnet. Alles, was mir aus der Preferred (ca. 200 €) und Professional (ca. 800 € netto) liebgeworden ist, geht in der Standard nicht, angefangen mit dem Diktat außerhalb von DragonPad und MS Word bis hin zur raschen Vokabularbearbeitung und Befehlserstellung. Umsetzung vom Diktiergerät und Diktat auf Englisch kann man zu einem Ladenpreis von 69 € sowieso nicht erwarten.

Wer also schon immer mal probieren wollte, wie sich Spracherkennung anfühlt, kann sich 14 Tage lang mit der Standard beschäftigen und dann auf eine anständige Version umsteigen - Dragon NaturallySpeaking Preferred für Heimanwender, Dragon NaturallySpeaking Professional für Profis. Ich hoffe nur, dass jetzt nicht wieder eine Flut von "Spracherkennung funktioniert doch gar nicht"-Artikeln in den Medien folgt. Spracherkennung schlecht zu machen ist noch einfacher als sie gut zu machen, und liest sich allemal flotter, ob berechtigt oder nicht - siehe diesen Eintrag.

Foren: Nachtrag

Nachtrag 11.4. zu meinem Beitrag über das alte Nuance Forum und seine Alternativen, nach Rücksprache mit den beiden deutschen Dragon-Verantwortlichen:

Gleichzeitig zu dem inkriminierten Download-Link wurden im Forum irgendwelche Sex-Links gepostet. Weil das Forum zwar von deutschen Nuance-Mitarbeitern gelesen, aber von Amerika aus verwaltet wurde, war das Monitoring des Forums sehr weit unten auf der Prioritätenliste, und so wusste man sich nicht anders zu behelfen als es abzuschalten. Das belegt zwar (entgegen anderslautenden Gerüchten), dass das Forum durchaus von Nuance gelesen wurde, auch wenn der Hersteller viele angesprochene Probleme nie einer Lösung zugeführt hat, aber auch, dass Deutschland offenbar weit unten auf der Prioritätenliste steht (s. auch diese deutsche Forumsdiskussion und diesen Thread in einem amerikanischen Forum).

Im deutschsprachigen Raum gibt es neben diesem Blog diese ernstzunehmenden Anlaufstellen:

  • das OASA-Forum von Willy Sander

  • eine Yahoo-Newsgroup "Dragonanwender"


  • - wobei viele Beiträger identisch sind.

    Wer Hilfe vom Doktor persönlich möchte, der schreibt mir am besten direkt an stephan [at] soldatkuepper.de!

    10 April 2008

    FAZ-Bericht über Philips Diktiersystem

    Wegen der Conhit-Messe in Berlin komme ich erst am Tag nach Erscheinen des Artikels in der FAZ dazu, auf den jüngsten Test eines digitalen Diktiersystems hinzuweisen: Michael Spehr berichtet über das Philips Digital Pocket Memo 955. Dabei handelt es sich um ein System zur Aufzeichnung von Konferenzen mit (wahlweise) einem Aufsteckmikrofon oder bis zu 6 Kontaktflächenmikrofonen auf das digitale Diktiergerät DPM 955, das dem DPM 9370 täuschend ähnlich sieht, aber über keine Funktionen zum Einfügen etc. verfügt. In einer Konferenz werden diese Funktionen auch nicht benötigt, so dass sie niemandem fehlen werden. Damit bietet nun auch Philips eine einfache, handhabbare Lösung zur Aufzeichnung von Interviews und Sitzungen an.

    PDF-Versionen des Artikels sende ich gern auf Anfrage.

    Ich selbst habe (endlich) ein Grundig DigtaSonic 420 und (schon) ein Olympus DS-5000 im Test, die ich in den nächsten Tagen hier genauer unter die Lupe nehmen werde - beides allerdings keine Konferenzgeräte, sondern digitale Diktafone für den professionellen Einsatz. Stay tuned!

    Mailboxbotschaft per Software von Ton in Text verwandeln

    Ist dies Nuance's Antwort auf Spinvox? - fragt mich einer meiner treuesten Leser.

    Möglicherweise ist sie das, aber - Spinvox hat einen fertigen Dienst, Nuance nur ein Produkt.

    Weitere solcher Dienste werden kommen. Zumindest der Voicemail-Dienst von Spinvox ist genial, der SMS-Dienst ausbaufähig (ich würde gern SMS an jeden meiner Kontakte per Sprache senden können, nicht nur an eine vordefinierte Liste). Ich empfehle weiterhin jedem den Test.

    (Mit Dank an Ronny Jaekel)

    31 März 2008

    BBC NEWS über Spinvox

    Über Spinvox habe ich hier schon einige Male berichtet - im wesentlichen handelt es sich um einen Dienst, den man vom Handy anrufen kann, um eine gesprochene Botschaft in Text umsetzen zu lassen. Das funktioniert sehr gut mit SMS und Mailbox, nicht ganz so gut mit Blog-Einträgen und Notizen.

    Einen Hintergrundbericht zu dieser Technik gibt es jetzt auf der BBC-Website - immerhin handelt es sich um eine britische Technologie. Dort ist zum Beispiel auch zu erfahren, dass das System in Fällen, in denen die Spracherkennung meint, ein Wort nicht zu verstehen, um menschliche Hilfe bittet.

    In Deutschland scheint man noch nicht so weit zu sein, denn zumindest die Nachrichten auf meiner Mailbox weisen gerade bei Eigennamen meistens Lücken auf. Da aber der Absender angezeigt wird, ist das im praktischen Einsatz nicht weiter tragisch. Ich würde mir jedenfalls wünschen, dass viel mehr Leute auf meine Mailbox sprechen und nicht so ungeduldig sind, nach dem fünften Klingeln abzubrechen und mich zurückrufen zu lassen.

    Wer sich anmelden will, um den Dienst selbst zu nutzen:

    www.spinvox.com

    (mit Dank an Michael Spehr)

    20 März 2008

    Anlaufstellen für Fragen zur Spracherkennung

    Weil mich in letzter Zeit immer mal wieder Fragen zum alten Scansoft-Dragon-Forum erreichen:

    das Forum wurde abgeschaltet, als dort der Link zur Dragon 9.5 Update gepostet wurde - wohl der letzte Tropfen, der das Fass zum Überlaufen brachte, denn die Diskussion der Merkwürdigkeiten unseres geliebten Drachen hielt man wohl nicht unbedingt für die beste Werbung.

    Die Reaktion kam insofern überraschend, weil der Hinweis, Nuance könne sich die Beiträge mal lesen und ggf. Abhilfe bei immer wieder diskutierten Bugs schaffen, sich durch alle Beiträge des Forums zog - ohne dass darauf jemals eine Reaktion gekommen wäre. Auch eine Art der Kundenkommunikation.

    Folgt man dem alten Link, wird man aufgefordert, ein Passwort anzugeben. Das Passwort ist ein Ablenkungsmanöver. Ich hatte eines, das hier aber nicht gilt.

    Im deutschsprachigen Raum gibt es neben diesem Blog als ernstzunehmende Anlaufstellen:

  • das OASA-Forum von Willy Sander

  • eine Yahoo-Newsgroup "Dragonanwender"


  • - wobei viele Beiträger identisch sind.

    Wer Hilfe vom Doktor persönlich möchte, der schreibt mir am besten direkt an stephan [at] soldatkuepper.de!

    Frohe Ostern!

    Ihr Osterei finden Sie, indem Sie in Dragon NaturallySpeaking "Info" aufrufen und dann Umschalt + F1 drücken.

    Viel Spaß dabei!



    Nachtrag: Dieses Ei habe ich gerade in DNS Legal gefunden. Die hübschen Ukrainerinnen haben wohl bei der Lokalisierung nicht genau hingeschaut...

    Diese Fehlermeldung verhütet man übrigens, indem man in den Optionen, Registerkarte "Daten", den für die Wiedergabe reservierten Speicherplatz von 40 MB auf z.B. 200 MB erhöht.

    04 März 2008

    Voice on the Go Inc.

    Voice on the Go nennt sich ein Dienst, mit dem sich über das Handy E-Mails abrufen und vorlesen, verwalten und sogar per Spracherkennung beantworten lassen. Auch der Kalender lässt sich darüber verwalten.

    Ich bin zu selten im Auto unterwegs, als dass ich es unbedingt nützen würde, und habe mir statt dessen eine Bluetooth-Tastatur für meinen PDA gekauft. Da der Service demnächst ins O2-Paket aufgenommen werden soll, bekomme ich es aber vielleicht sowieso.

    Wer herausfinden will, ob es für ihn/sie das Richtige ist, der/die sehe das Video, das von der Startseite aus verlinkt ist.

    08 Februar 2008

    MacSpeech's Dictate: high quality voice recognition for the Mac - AppleInsider

    MacSpeech's Dictate: high quality voice recognition for the Mac - AppleInsider

    Gute Nachrichten für Mac-User: Laut dieser Website wird es Macspeech, die neue Spracherkennung für Mac mit Nuance (Dragon)-Technologie auch bald auf Deutsch geben!

    Die Forenkommentare lassen größtenteils den üblichen Sermon zur Spracherkennung ab oder wünschen sich Spracherkennung für das iPhone. Auf Spinvox habe ich schon hingewiesen, welches ein Schritt in die richtige Richtung ist. Offline-Spracherkennung auf einem Smartphone oder Handheld Computer ist aber wohl wegen der benötigten Rechnleistung noch utopisch. Interessant ist, dass iListen nach Aussage aller Forenteilnehmner Dragon klar unterlegen ist. So groß hatte ich den Abstand gar nicht in Erinnerung - aber Dragon hat ja auch einen Versionsspsrung gemacht, seit ich iListen getestet habe.

    29 Januar 2008

    FAZ-Bericht über Spinvox Voicemail

    "Die Frankfurter Allgemeine Zeitung berichtet heute über den Voicemail-Dienst von SpinVox, bei dem eine aufgenommene Voicemail, also eine Ansage auf der Mailbox, automatisch in geschriebenen Text umgesetzt wird und per SMS an Handy gesendet wird. Anstatt die Mailbox abzuhören, kann man einfach die SMS lesen. Das tolle ist, es funktioniert."

    spoken through SpinVox



    Jetzt spreche ich mit Dragon NaturallySpeaking weiter, weil der Blog-Dienst von Spinvox nämlich eine Aufzeichnung nach einer halben Minute abbricht:

    Bis jetzt habe ich wirklich gute Erfahrungen mit Spinvox gemacht, vor allen Dingen mit der Voicemail und dem SMS-Dienst. Auch ein Memo kann über das Telefon aufgenommen werden und als E-Mail an eine vordefinierte Adresse verschickt werden; hier gilt aber ebenfalls die Beschränkung auf 30 Sekunden, was für mich zu wenig ist. Egal, man spricht einfach mehrere Memos auf.

    Das übliche, nämlich die Eigennamen, machen Schwierigkeiten; ansonsten ist aber die Erkennung praktisch hundertprozentig. Und das bei wirklich schlechten Voraussetzungen: Eingabe über das Telefon, keine spezifische Diktier-Intonation und dergleichen mehr.

    Respekt, das hat Spinvox wirklich gut hingekommen!

    Abgesehen von der reinen Empfehlung liefert der Artikel interessante Hintergrund-Informationen. Empfohlene Lektüre, und wer heute die FAZ nicht kauft, schickt wie gewohnt einfach eine E-Mail an stephan.kuepper [at] 4voice.de und ich sende eine Kopie als PDF-Datei.

    24 Januar 2008

    MacDragon

    MacSpeech ist Eingeweihten bekannt als Anbieter einer Spracherkennung (iListen) für Apple MacIntosh-Computer, die qualitativ gar nicht mal so schlecht war (als ich sie vor nunmehr 3 Jahren mal getestet habe, war sie ungefähr auf dem Niveau von Dragon NaturallySpeaking 7).

    Jetzt lizensiert Nuance seine Dragon NaturallySpeaking-Technologie an Macspeech. Will sagen: demnächst wird es Dragon NaturallySpeaking auch auf dem Mac geben! Das ist doch mal eine gute Nachricht für uns, die wir das Design der Geräte schon immer cool fanden, aber trotzdem nicht von Windows weg wollten, weil wir dann unseren geliebten Drachen nicht mehr zur Verfügung hätten.

    Davon abgesehen bin ich gespannt, wie die Resonanz in der traditionell technikaffinen Mac-Gemeinde aussieht - wenn sich erst mal herumspricht, wie viel Spaß es macht, mit dem Computer zu sprechen, wird die Welle vielleicht wieder zurück schwappen, und mehr Leute werden sich für Spracherkennung begeistern - so wie Sie und ich jetzt schon :-)

    Der Name für das Produkt steht auch schon fest: MacSpeech Dictate (nicht unbedingt der Gipfel an Kreativität). Für verschiedene Dialekte des Englischen (ganz zufällig natürlich die, die auch in Dragon NaturallySpeaking enthalten sind) wird es das Produkt "bald" - angeblich ab dem 15.2. in den USA für 199 $ - zu kaufen geben. Ich bin gespannt auf die deutsche Version - vielleicht stellt mir die Firma ja mal einen von den coolen neuen Mac Airs zur Verfügung.

    20 Januar 2008

    Speaking Freely - bloggen vom Handy per Spracherkennung

    "SpinVox Block. So nennen sich alle neue Lösungen die in der letzten Zeit durch ___ Pressemitteilungen gingen und im Internet auftauchte. Man spricht v. einer Blockbeitrag(?) einfach in sein Handy zwar sind die auf eine Mailbox und auf einem Server der Spracherkennung das gesprochene in geschriebenen Text verwandelt und im Block veröffentlicht."

    spoken through SpinVox



    Das sollte heißen:
    Spinvox Blog - so nennt sich eine neuen Lösung, die in der Letzen Zeit durch mehrere Pressemitteilungen ging und im Internet auftauchte. Man spricht seinen Blogbeitrag einfach in sein Handy praktisch wie auf eine Mailbox und auf einem Server wird per Spracherkennung das Gesprochene in geschriebenen text verwandelt und im Blog veröffentlicht.

    Schon nicht schlecht, oder? V.a. wenn man die Anzahl meiner Tippfehler beachtet. Dragon erkennt zwar besser, aber nicht durch das Telefon. Großer Nachteil ist jedoch die Beschränkung auf eine Minute - das reicht mir nicht für einen Beitrag.

    Trotzdem: Der Service rockt. Sehr cool die Möglichkeit, eine Mailbox einzurichten, die alle Anrufe aufzeichnet, transkribiert und als SMS auf das Handy schickt. SMS zu diktieren geht auch schon mit einem kleinen Trick (Spinvox Blast), und schließlich kann man sich selbst ein Memo schicken, das allerdings auch nur eine Minute lang sein darf. Ich bin recht begeistert und werde den Service nutzen; wer ihn ausprobieren will, kann sich unter www.spinvox.com kostenlos registrieren. Im Moment fallen höchstens Telefongebühren an; da der Server über eine deutsche Festnetznummer errreichbar ist, sind die in meiner Flatrate schon enthalten :-)

    10 Januar 2008

    Beim Diktieren sollst du...

    - ins Mikrophon sprechen und nicht in das Display oder den Lautsprecher an deinem Diktiergerät
    - das Diktiergerät nicht direkt unter die Nase halten und sich dann über die lauten Atemgeräusche wundern
    - den Abstand zwischen Mund und Mikrophon einigermaßen konstant halten
    - das Diktiergerät so halten, dass die Finger auch tatsächlich die Tasten erreichen können
    - keine Äpfel essen.

    Fünf Erkenntnisse aus ein und derselben Klinik. Wie mag es erst woanders aussehen?

    11 Dezember 2007

    Orégano!

    Ein Autor von Kochbüchern wird das Wort "Oregano" mit größerer Wahrscheinlichkeit benutzen als ein Rechtsanwalt.

    Wie oft habe ich diesen Satz schon während des Dragon-Trainings gehört und mich gefragt, wer Recht hat: die Mehrheit, die "Oregano" auf dem A betont, oder die Minderheit, die das E betont?

    Als ich meine Nudelsosse würzte, beschloss ich, es nachzuprüfen, und siehe da, der Duden sagt eindeutig: Orégano, mit Betonung auf dem E.

    Was nur zeigt, dass die Mehrheit (und ich) nicht immer Recht hat.

    06 Dezember 2007

    Artikel: Diesen Artikel hat ein Computer geschrieben - WELT ONLINE

    Diesen Artikel hat ein Computer geschrieben - Nachrichten Webwelt - WELT ONLINE

    - meinen Kommentar dazu hat auch ein Computer geschrieben, und ich habe ihn mit Spracherkennung diktiert. Im Unterschied zum Journalisten kann ich aber damit umgehen.

    Wieder ein Artikel aus der Serie " Technik-Journalisten müssen sich ihren Lebensunterhalt irgendwie verdienen, auch wenn ihnen das Thema tendenziell fremd ist".

    Wie langweilig.

    27 November 2007

    FAZ, 27.11.2007: Spracherkennung als Erfolgsgeschichte

    Die FAZ berichtet heute über das derzeit wohl größte Spracherkennungsprojekt Deutschlands: die Ausstattung von ca. 900 Richtern im Lande Hessen mit Spracherkennung durch die 4voice AG.

    Entstanden ist der Artikel bei einer Schulung, die ich vor ein paar Wochen gehalten habe. Bei diesen Schulungen werden Richter als Multiplikatoren ausgebildet, die dann in ihren Dienststellen das Training und die Schulung weiterer Richter durchführen sollen.

    Dort nahm man kein Blatt vor den Mund: Spracherkennung soll die durch massiven Personalabbau extrem gestiegene Belastung der sog. Serviceeinheiten (d.h. Schreibbüros) reduzieren, die Richter möglichst viel der anfallenden Arbeiten selbst erledigen. Dass dies nicht überall auf Gegenliebe stößt, ist zu erwarten; bei dem Schulungstermin wurde denn auch massiv Kritik geübt.

    Allerdings zeigte sich eben auch, dass eine gute Schulung notwendig ist, um Spracherkennung gewinnbringend einzusetzen. "Vokabular und Schulung sind entscheidend für die Akzeptanz" - heißt die Unterzeile, und man muss kein Dragon-Dienstleister sein, um das unterschreiben zu können. Denn dann...

    stellt sich [...] ein Aha-Erlebnis ein: Schulungsleiter Stephan Küpper diktiert ganze Absätze fehlerfrei, ohne jede Schummelei. Wir haben viel gelernt an diesem Tage, obwohl Dragon bei uns seit Jahren im Einsatz ist. Und man sollte auf eine solche Schulung durch Profis nicht verzichten. Nun trauen sich etliche Teilnehmer, ihre positiven Erfahrungen zu schidern. Ein Richer ist mit Dragon sehr zufrieden und beschreibt den immensen Gewinn an Freiheit, und damit meint er die Unabhängigkeit von den Launen des Schreibbüros. Jetzt könne er bis zum Fristende an der Akte arbeiten.

    Dies, so sei hinzugefügt, ist kein Einzelfall. Andere Richter loben, dass mit Spracherkennung die Akte nach dem Diktat tatsächlich abgeschlossen sei und nicht Wochen später noch einmal durchgesehen werden müsste - auch dies ein nicht zu unterschätzender Vorteil.

    Schließlich zum Vokabular:

    4voice hat für die einzelnen juristischen Spezialgebiete wie Arbeits- oder Familienrecht eigene Vokabulare von Linguisten mit bis zu 50.000 weiteren Einträgen herstellen lassen. Dazu wurden repräsentative Texte der Justizbehörden ausgewertet und beispielsweise alle Entscheidungen des Oberlandesgerichts Frankfurt in der Landesrechtsprechungsdatenbank komplett eingewiesen. Wer Dragon im Kaufhaus erwirbt und damit nur auf das Standardvokabular zurückgreifen kann, ist jedenfalls als Jurist falsch beraten. Auf die Feinheiten kommt es an: für einen Strafrichter oder Staatsanwalt sind Begriffe wie "Angeklagter" wichtiger als einen Zivilrichter, der mehr mit "Klägern" und "Beklagten" konfrontiert ist.

    Wie immer: wer die FAZ nicht liest und heute nicht kaufen will, schreibe mir an stephan.kuepper [at] 4voice.de. Sie erhalten eine Kopie umgehend per E-Mail.

    16 November 2007

    Heiser!

    Wirklich erstaunlich: während der ganzen Messe bin ich schwer erkältet und heiser. Trotzdem versteht Dragon mein Diktat so wie immer. Die Spracherkennung wird wirklich immer stabiler - ich bin mal wieder begeistert!

    Was mich daran erinnert, dass ich vor kurzem einen chinesischen Arzt am Stand hatte, der sich einfach mein Mikrofon griff und losdiktierte - mit einer Genauigkeit, die so gut war wie meine, und trotz seines Akzents. Respekt!

    Mondegreen (Wumbaba auf Englisch)

    Heute morgen auf der Medica wollte ich meine Kollegen beeindrucken und ein wenig auf Englisch diktieren. Dies tue ich im wahren Leben nicht wirklich, habe aber für alle Fälle einen Benutzer angelegt.

    Welcher Satz würde sich für diese Situation besser eignen als der Klassiker aus der Rocky Horror Picture Show: "I see you shiver with anticipation"? Spreche ich den Satz mit normaler Intonation aus, wird er wunderbar verstanden. Mit der herrlich zerdehnten Pause, die Tim Curry im Wort "antici - pation" macht, schreibt Dragon folgende köstliche Variante:
    I see you shiver with aunties who patiently ...

    Ist das nicht schön?

    13 November 2007

    Testbericht: Headsets in der c't

    In der aktuellen c't, Heft 24/2007, befindet sich ein ausführlicher Test von Stereo-Headsets, eigentlich unter dem Gesichtspunkt Musik und Games, aber auch mit einer Sektion zum Thema Diktat. In den Test geht unter anderem der Audio-Assistent von Dragon NaturallySpeaking ein.

    Überraschend gut bewertet wurden zwei Modelle, die mir bisher noch nicht aufgefallen waren: das Sony DR-260 USB zum Preis von 50 €, als einziges der getesteten Geräte mit einer Mikrophon-Lautstärkeregelung und einem Wert von 23 im Audio-Assistenten; sowie das Microsoft Lifechat LX-3000 zum Preis von nur 30 € und einem Wert im Audioassistenten von 22. Dies ist allerdings laut Test vom Sound "für Musik, Filme und Spiele ungeeignet".

    Ich habe mich bis jetzt immer nur mit Mono-Headsets auseinander gesetzt, weil ich gerne ein Ohr während der Arbeit frei habe, um nötigenfalls auch mal telefonieren zu können, während ich hätte tragen. Wer aber beides sucht, Diktat und Musik, sollte sich den Test mal genauer ansehen.

    Dass der Wert im Audio-Assistenten nicht alles ist, wissen meine geneigten Leser allerdings seit diesem Beitrag.

    Tipps und Tricks: Wörter verteilen über das Custom-Verzeichnis

    Wer mit mehreren Benutzern auf dem selben PC arbeitet, hat das Problem, dass er Wörter und Befehle von einem zum anderen Benutzer transferieren möchte. Zumindest geht es mir so: einige Sprachbefehle und zahlreiche Wörter (z.B. meinen Namen) benötige ich eigentlich in jedem Wortschatz, unabhängig davon, ob es mein Arbeits-Vokabular ist, ein medizinisches Vorführvokabular oder ein Testwortschatz.

    Dragon NaturallySpeaking Professional 9 stellt ein Werkzeug bereit, welches sich Data Distribution Tool nennt. Man findet es im Programm-Menü unter "Start - alle Programme - Dragon NaturallySpeaking - Dragon NaturallySpeaking-Werkzeuge - Data Distribution Tool". Wer sich darein einarbeiten will, ist mit der Hilfe-Funktion ganz gut bedient. Wer technischer veranlagt ist, kann auch das NSAdmin-Werkzeug nutzen, was schon in älteren Versionen enthalten ist, allerdings nicht unbedingt den besten Ruf genießt.

    Hier der Hinweis, wie man Befehle und Wortlisten auch ohne Data Distribution Tool ganz einfach verteilen kann:

    Legen Sie folgendes Verzeichnis an:

    C:\Dokumente und Einstellungen\All Users\Anwendungsdaten\Nuance\NaturallySpeaking9\Custom\deu

    (Für Dragon NaturallySpeaking 9 unter Windows XP)

    Exportieren Sie alle benutzerdefinierte Wörter in einer Wortliste im Format TXT in dieses Verzeichnis. Am einfachsten geht das in Dragon NaturallySpeaking über das Menü "Wörter - exportieren" oder über den Sprachbefehl "Wörter exportieren". Fortgeschrittene Benutzer können dort aber natürlich auch eine eigene Wortliste erstellen, die exportierte Wortliste bearbeiten und dergleichen mehr.

    Wird jetzt ein neuer Benutzer geöffnet, werden die Wörter aus dieser Wortliste in das Vokabular des neuen Benutzers importiert und erscheinen dort mit einem roten Stern als vom Benutzer neu hinzugefügte Wörter. Natürlich funktioniert das auch, wenn sich mehrere Benutzer denselben PC teilen. So können zum Beispiel zwei Ärzte in einer Praxis die Wörter, die sie hinzufügen, an den jeweils anderen weitergeben.

    Achtung: wer Fachvokabulare einsetzt, exportiert unter Umständen sämtliche Wörter eines Fachvokabulars, nämlich dann, wenn diese Wörter als benutzerdefiniert mit einem roten Stern gekennzeichnet wurden. Das ist natürlich wenig zielführend, zumal das Sprachmodell nicht mit exportiert wird und daher ein neuer Benutzer mit den Wörtern alleine nicht viel anfangen kann.

    [Edit:] Das gleiche funktioniert auch mit Befehlen, allerdings nur bei neu angelegten Benutzern. Um Befehle von einem vorhandenen Nutzer zu einem anderen vorhandenen zu transferieren, muss das Data Distribution Tool benutzt werden.

    Um Befehle eines Users für alle anderen, in der Zukunft noch zu erstellenden User bereitzustellen, gehen Sie so vor:

    Gehen Sie in das Befehlcenter von Dragon NaturallySpeaking über "Extras - Befehlcenter" oder sagen Sie einfach "Befehlcenter öffnen". Unter "Verwalten" haben Sie eine Liste aller verfügbaren Befehle. Markieren Sie die, welche sie exportieren wollen, und exportieren Sie sie ebenfalls in dieses Verzeichnis im Format DAT.

    Wenn man routinemäßig neu hinzugefügte Wörter in dieses Verzeichnis exportiert, hat man seine benutzerdefinierten Einträge immer auf dem neuesten Stand. Dabei kann man die vorhandene Wortliste einfach überschreiben - Dragon NaturallySpeaking exportiert immer alle benutzerdefinierte Wörter, auch wenn sie vorher über eine Liste hinzugefügt wurden.

    30 Oktober 2007

    Fernsehbeitrag: Ratgeber Technik - Computer zum Diktat! - Möglichkeiten und Grenzen aktueller Spracherkennungssoftware

    Am 27.3. lief im Ersten der ARD Ratgeber Technik mit einem Beitrag über "Computer zum Diktat! - Möglichkeiten und Grenzen aktueller Spracherkennungssoftware".

    Erste Reaktion: Können die sich eigentlich mal einen anderen Titel für solche Beiträge einfallen lassen? "Computer zum Diktat" ist ungefähr so originell wie "Lufthansa-Aktie im Sinkflug". Nächste Reaktion: Lach- und Sachgeschichten für Erwachsene. Wie Computer und Sekretärin im Boxring gegeneinander antreten, ist für einen öffentlich-rechtlichen Sender grenzwertig. Aber egal, schauen wir auf den Inhalt -

    - und da zeigt sich, dass der Tester das Expertenwissen eines, nun ja, Journalisten an den Tag legt. No offence meant, aber offenbar hat er sich mal ein paar Tage oberflächlich mit Spracherkennung auseinandergesetzt und dabei mehr Energie in die Präsentation gesteckt als in die Recherche. Dem geübten Auge entgeht z.B. nicht, dass er für die ersten beiden Tests betont langsam diktiert, um den Rechner dann mit einem - seiner Meinung nach extrem schnellen - Diktat aus dem Konzept zu bringen.

    Ich kann dazu nur sagen: Abgesehen davon, dass ich keine Schlagertexte diktiere, spreche ich normalerweise so schnell wie er im "Härtetest" und habe eine sehr gute Erkennung. Wenn man aber beim Ablesen des Trainingstextes langsam liest und auch sonst langsam diktiert, wird eine Spracherkennung beim schnellen Sprechen Schwierigkeiten haben müssen - wie übrigens auch umgekehrt. Wenn ich schnell vorlese und danach langsam diktiere, erkent mein Drache mich auch nur halb so gut. Aber wie heißt es in dem Teil des Trainingstextes, der nur von uns Schnellesern erreicht wird: "Das wichtigste ist eine deutliche und konstante Aussprache. Versuchen Sie, Ihre Gedanken zu ordnen, bevor Sie mit dem Diktieren beginnen" - ein Rat, der übrigens für alle Textproduzenten gilt :-)

    Ein Test der Rechtschreibung ist völlig am Thema vorbei. Wenn ich Kunden beeindrucken will, lasse ich den Computer "schwierige Wörter" erkennen. Wenn ich zeigen wollte, was die Spracherkennung nicht kann, nehme ich "einfache", alltägliche Wörter, die ähnlich wie andere häufige Wörter klingen - "einen" vs."einem" zum Beispiel.

    Spracherkennung macht systembedingt keine Tippfehler! Ich habe schon Schreibkräfte gesehen, die das Dragon-Wörterbuch zum Nachschlagen benutzen. Natürlich muss das Programm die Wörter kennen - aber das ist bei einer Sekretärin auch nicht anders.

    Und jetzt grundsätzlich: "Mensch gegen Maschine"-Kämpfe, erst recht gegen Spitzenleister, sind so alt wie die mAschinen. Ich erinnere nur mal an John Henry. Und dass die Sekretärin mit "jahrelanger Erfahrung" von der Software eingeholt wird, weist doch eher darauf hin, dass sie so gut ist wie eine Sekretärin - Training vorausgesetzt, von Spracherkennung, Diktant und Sekretärin. Insofern ist das Fazit der Sendung nur zum Schein beruhigend - der Mensch hat gewonnen, weil die Versuchsanordnung auf ihn abgestimmt war.

    Und der zitierte Praxistest (im Begleittext) ist auch wenig aussagekräftig: wer aus genau einem Beispiel eine Regel herleiten will, hat wenig von Statistik verstanden. Da muss man schon mehr analysieren - aber wer tut das schon? Zugegebenermaßen hat außer den Herstellern keiner ein Interesse daran, und die werden nur eindeutig für sie positive Daten veröffentlichen.

    Mein Fazit zum Beitrag lautet: wer nur konsequent die falschen Kriterien anlegt, erhält das schlechte Ergebnis, das er erwartet. Aber was erwartet man von jemand, der die Spracherkennung unter Vista erst gar nicht ans Laufen bekommt?

    (Dank an Ronny Jaekel u.a. für Input)

    25 Oktober 2007

    Spezialmikrofon: Ohrwurm II

    Der Ohrwurm II von Ohrwurm Audio ist ein Kunstkopf-artiges Mikrophon(schwer zu erklären - lieber selbst mal anschauen!), welches speziell für Aufnahmen mit Videokameras entworfen wurde, es liefert aber einen so lupenreinen Klang, dass ich ihn am liebsten mit Spracherkennung ausprobieren würde. Zwei hörgerätegroße Teile setzt man sich auf die Ohren, eine 3,5 mm-Klinke in die Kamera, Soundkarte o.ä. - und ab gehts. Sehr schön die Klangbeispiele, von Musik im Wohnzimmer über die Antarktis bis zum Bremer Weihnachtsmarkt.

    Aufmerksam gemacht auf das Gerät wurde ich von einem Kunden, der es sich bestellt hat und jetzt mit Spracherkennung ausprobieren will. Ich bin gespannt, wie die Rückmeldung ist. Für 71 € kann man ja eigentlich nicht viel verkehrt machen.

    21 Oktober 2007

    Bill Gates liebt Spracherkennung

    Aus dem Blog Rob's Rhapsody : Bill Gates talks about Speech Recognition -- again!:

    Bill Gates scheint Spracherkennung zu lieben - er hat in einem Interview mal wieder darauf hingewiesen, und was ich interessant finde, ist, dass er uns Anwender zwar für nur einen kleinen Prozentsatz, aber trotzdem eine signifikante Zahl hält:

    When you sell a product to hundreds of millions of users, there are features that millions of users love that you can call an obscure feature because, percentage wise, it's not very many.


    Im Interview geht es mal wieder um die Spracherkennung in Vista sowie das letztlich veröffentlichte Sprachinterface für Windwos Live - leider nur in Amerika, aber kann ja noch kommen.

    Ich sags doch - Spracherkennung macht Spaß und bringt Nutzen.

    17 Oktober 2007

    FAZ, 16.10.2007: "Ein Muss für jeden Dragon-Nutzer"

    Dieser Artikel aus der FAZ von gestern (Dienstag, 16.10.2007) berichtet derart positiv über die Spracherkennungslösungen von 4voice, dass ich seit gestern damit beschäftigt war, Anfragen und Bestellungen zu bearbeiten - nicht dass ich mich beschweren würde, aber so komme ich erst heute Abend dazu, meine treue Leserschaft auf den Artikel hinzuweisen.

    Weil es die FAZ von gestern heute nicht mehr zu kaufen gibt, sende ich eine Kopie des Artikels gerne an alle, die bei mir anfragen. E-Mail-Adresse: stephan.kuepper [at] 4voice.de.

    Einige Auszüge gefällig? "Die perfekte Diktier-Software für den Profi... wir waren von Anfang an begeistert... die 4voice-Software ist genau das, was wir immer gesucht haben".

    Glücklicherweise beruhigt sich der Artikel zwischendurch ein wenig und nennt auch Gründe: zum Beispiel die Möglichkeit, die Spracherkennung mit einem Handmikrophon mit einem Schiebeschalter zu steuern (z.B. ein Olympus DR-2000 oder ein Philips SpeechMike Classic); die Verwendung der 4voice Local als Ersatz für DragonDictate und das Diktierfenster, jeweils mit wesentlich mehr Möglichkeiten; Hintergrunddiktat, Umsetzung von Diktaten von einem digitalen Diktiergerät per Drag & Drop und dergleichen.

    Natürlich bin ich stolz auf einen derart positiven Artikel - einerseits weil er das Produkt lobt, das ich seit einem Jahr verkaufe, andererseits auch, weil der Kontakt zum Autor über diese Netznotizen zustandegekommen ist.

    Link zum Produkt nicht vergessen: im Shop unter  Http://s100202421.einsundeinsshop.de/

    25 September 2007

    Diktieren im Auto

    In der FAZ von heute werden verschiedene Möglichkeiten besprochen, im Auto mit dem Handy oder dem Diktiergerät zu diktieren und Diktate von unterwegs, zum Beispiel per E-Mail von einem Smartphone, ins Büro zu senden. Dazu gehört auch die Philips-Software, die ich vor ein paar Tagen hier besprochen habe.

    Der Redakteur, der mehrfach zitierte Dr. Michael Spehr, macht eine ganz richtige Bemerkung: im Moment sind die Kosten für die Übertragung prohibitiv. Und bezüglich der Philips-Software stellt sich ebenfalls die Frage, inwieweit man 100 € zuzüglich Mehrwertsteuer für eine Software ausgeben soll, wenn man die Diktate genauso gut als Anhang an eine E-Mail senden kann - und dann auch die Möglichkeit hat, Diktate zu versenden, die nicht mit einem Philips-Diktiergerät aufgenommen worden. Zumal Philips empfiehlt, die Software auf die Speicherkarte zu installieren und nicht auf das Gerät. Das heißt, man muss auf jeden Fall Speicherkarten wechseln, was je nach Handy auch nicht unbedingt die reine Freude ist. (Selbst wenn man die Software auf das Handy installiert - wie ich es ohne Probleme getan habe - muss man ja immer noch die Diktate per Speicherkarte übertragen.)

    Ausgereift ist noch keine dieser Methoden. Was fehlt, ist entweder eine vernünftige Diktiersoftware für das Handy, die sich auch so bedienen lässt, dass es Freude macht, oder eine preiswerte Übertragungsmöglichkeit. Also eigentlich ein Diktiergerät mit eingebautem UMTS :-) aber ob der Markt das hergibt?

    21 September 2007

    Hinweis: neues Anwenderforum bei OfficeAutomation Sander

    Das OfficeAutomation Sander - Anwenderforum ersetzt in Bälde das alte, wenig praktisch zu bedienende, aber dafür sehr hilfreiche Forum bei Forum Romanum. Das alte Forum lohnt sich noch als Referenz, aber posten werde ich nur noch im neuen :-)

    Erste Mitteilungen gibt es auch schon.

    Problemlösung: NaturallySpeaking kann keine weiteren Sprachdateien speichern

    Diese Meldung erscheint, wenn man längere Zeit intensiv diktiert hat, insbesondere beim Diktat nach Microsoft Word.

    Hintergrund: Dragon NaturallySpeaking speichert, wie bekannt, auch das Diktat als Audio-Datei. Diese Datei wird nun im Laufe der Zeit sehr groß (Faustregel: eine Minute Diktat entspricht einem Megabyte). Der Standardwert, wie viel Diktat gespeichert wird, liegt bei 40 MB. Gemeiner Weise lügt Dragon NaturallySpeaking, weil der Rest der Meldung nämlich lautet, dass das Diktat fortgesetzt werden kann - dann die Meldung aber alle 2 Sekunden wieder erscheint.

    Es gibt mehrere Möglichkeiten, dieses Problems Herr zu werden:

    Im Menü "Optionen - Daten" setzt man den Standard-Wert bei "für die Wiedergabe reservierter Speicherplatz" von 40 MB auf (z.B.) 200 MB, wenn man nämlich Wert darauf legt, dass das Diktat gespeichert wird. Wenn man diese Funktion überhaupt nicht benötigt, setzt man den Wert auf Null. Dann werden lediglich die jeweils letzten 100 Äußerungen temporär gespeichert.

    Praktischer Wert dieser Funktion: hat man ein längeres Word-Dokument diktiert und will erst dann korrigieren, wenn der erste Entwurf fertig ist, lernt Dragon NaturallySpeaking dann und nur dann hinzu, wenn die Audio-Informationen noch verfügbar sind. Wenn sie nicht mehr verfügbar sind, weil der verfügbare Speicherplatz auf null gesetzt wurde, hat Dragon auch keine Chance mehr zu lernen. Wenn man also während des Diktates direkt die Fehler korrigiert, benötigt man diese Option nicht.

    18 September 2007

    DNS-Tipp: Nummerierung und Aufzählungen

    • "Nummerieren" nummeriert eine Reihe von Absätzen.

    • "Aufzählungszeichen" setzt Aufzählungszeichen vor einer Reihe von Absätzen

    Um die Formatierung vorzunehmen, einfach die entsprechenden Absätze markieren und den Befehl sagen. Funktioniert, sobald der erste Absatz diktiert wird, man sagt "nummerieren" oder "Aufzählungszeichen", und dieser sowie alle folgenden Absätze wird fortlaufend nummeriert beziehungsweise mit den Zeichen versehen.
    • Der Befehl "Nummerierung" vor einer Folge von Zahlen sorgt dafür, dass diese Zahlen als Ziffern geschrieben werden. Dieser Befehl ist praktisch zum Beispiel beim Diktat von Postleitzahlen oder Telefonnummern in DNS 9.5, wo diese nicht automatisch richtig formatiert werden.

    Spracherkennung im Bezirksamt Neukölln

    Mein heimisches Bezirksamt Berlin-Neukölln, konkret: das Jugendamt (mit dem ich bisher nur wegen Kindergärten und Hortplätzen zu tun hatte) arbeitet seit neuestem mit Spracherkennung. Die Ausstattung mit dem System stammt von meinen ehemaligen Kollegen abitz.com Multilingual Software - Glückwunsch, Kollegen!

    Leider ist der Artikel der Berliner Zeitung schlecht recherchiert. Weder ist das Neuköllner Jugendamt die "bundesweit erste Behörde, die mit einem Computerprogramm für digitale Spracherkennung arbeitet" - das Justizministerium Baden-Württemberg arbeitet seit Jahren damit, und das Justizministerium Hessen wurde vor zwei Jahren von der 4voice AG damit ausgestattet; ganz zu schweigen von anderen Gerichten wie dem Landesarbeitsgericht Berlin, in dem ich auch mal die Finger im Spiel hatte.

    Sehr hübsch auch der Satz "die Neuköllner Firma Abitz hat das digitale Spracherkennung entwickelt und während der vergangenen sieben Monate in die Computer installiert" - ein Satz, der nicht nur die völlige Unkenntnis des Autors über Computer, sondern auch seine Schwierigkeiten mit der deutschen Sprache demonstriert. Auch ist nicht ganz erklärlich, warum "alle Mitarbeiter zu Beginn ihrer Schulung 25 Minuten lang ein Märchen vorlesen" mussten. Wenn ich direkt in den Computer diktiere, lese ich zum Training 7 Minuten, und zwar kein Märchen. Wenn ich ein Diktiergerät benutzt, bin ich mit 15 Minuten auch fertig. Wollen wir es der Unkenntnis des Autors zu Grunde halten.

    Testbericht: Philips LFH 751 Software zur Übertragung vom Diktiergerät auf das Handy und Weiterleitung per E-Mail/WLAN

    Am Freitag ist die Philips LFH 751-Software bei mir eingetroffen. Mit dieser Software kann man die Karte, die auf einem Philips Pocket Memo-Diktiergerät erstellt wurden, von einem PDA per E-Mail versenden. Das heißt: um von unterwegs Diktate, die ich mit meinem Diktiergerät aufgenommen habe, zu verschicken, brauche ich kein Notebook mehr, sondern kann es mit dem PDA machen - vorausgesetzt, das Gerät ist E-Mail-fähig und hat einen SD-Karteneinschub. Auch eine Version für Windows Smartphones gibt es schon, für Blackberry folgt im Oktober.

    Die Software wird geliefert auf einer Micro-SD Karte, mit einem Adapter, so dass man sie überhaupt erst in das Diktiergerät oder das Handy/den PDA einlegen kann. Bei der Installation ist es wichtig, zunächst das .NET-Framework auf den PDA zu installieren, dann erst die Philips-Software. Ich habe es natürlich zunächst mal umgekehrt gemacht, woraufhin die Installation nicht funktioniert hat. Das kommt davon, wenn man entgegen der Anweisung auf der Packung die Readme-Datei nicht liest :-)

    Es empfiehlt sich, das Programm in den Hauptspeicher des Geräts zu installieren und nicht auf die Speicherkarte, es sei denn, man verwendet die Speicherkarte sowohl im Diktiergerät als auch für die Übertragung der Programme. Dann muss man aber immer diese Speicherkarte verwenden, was vermutlich wenig praxistauglich ist (hat da jemand echte Erfahrung mit?). Ist das Programm im Hauptspeicher installiert, kann ich eine beliebige Speicherkarte einlegen und die Diktate werden übertragen, sobald ich die Speicherkarte einstecke.

    Übertragungsmöglichkeiten bestehen über E-Mail an einen vorkonfigurierten Empfänger, inklusive der Möglichkeit für cc und bcc. Eine andere Möglichkeit ist, über WLAN die Diktate in einem UNC-Pfad zu speichern. Da ich hier im Moment kein WLAN habe, konnte ich das nicht ausprobieren. Schließlich gibt es einen Automatik-Modus, in dem erst versucht wird, über WLAN zu speichern, wenn das nicht geht, werden die Diktate per E-Mail verschickt.

    Übrigens funktioniert es nicht, Diktate auf einem Grundig- oder Olympus-Diktiergerät aufzuzeichnen und zu versenden. Es erscheint eine Fehlermeldung "Bitte nehmen Sie Ihre Diktate auf einem Philips Pocket Memo auf".

    Interessanterweise verschwinden die Installationsdateien im CAB-Format nach der Installation von der SD Karte, so dass die Software nur noch vom PC aus installiert werden kann. In der entsprechenden PC-Installationsroutine ist das .NET-Framework mit enthalten.

    Getestet habe ich auf einem XDA neo mit Windows Mobile 5. Die Software soll auf allen Geräten mit Windows Mobile 5 und 6 laufen, außerdem braucht man einen gültigen E-Mail-Account auf dem Gerät, um die Diktate zu versenden. Und natürlich sind die Diktate auch spracherkennungstauglich, wenn man sie vom PDA zum Beispiel direkt in den Eingangsordner einer Spracherkennung versendet.

    Und der Preis? z.B. 99 € zzgl. MWst.
    Philips SpeechExec Mobile PDA im 4voice-Shop.

    10 September 2007

    Ein neues Blog bei Microsoft zum Thema Sprache / Speech

    Unter speech @ microsoft ist seit kurzem ein neues Blog online, in dem MS-Entwickler Sprachen rund um die Windows Vista-Spracherkennung beantworten. Die ersten Antworten sind schon da, u.a. zu den Sprachen, in denen die Spracherkennung erhältlich ist (darunter Deutsch), und eine Möglichkeit, zusätzliche Sprachen herunterzuladen - was den Effekt hat, dass man das ganze Windows in dieser Sprache lokalisiert. So ghet's natürlich auch, wenn man Spracherkennung als Eingabehilfe konzipiert und nicht als Diktiersystem.

    06 September 2007

    Wiedergabe bei der Korrektur nicht verfügbar

    Gelegentlich kommt es vor, dass bei einer Korrektur im Buchstabierfenster die Wiedergabefunktion nicht verfügbar ist. Der Button "Wiedergabe" ist dann ausgegraut. Dies liegt daran, dass man in das Korrekturfenster mehrere Wörter aufgenommen hat, zwischen denen eine deutliche Sprechpause liegt, also eine Korrektur über die Grenzen von zwei Phrasen hinweg versucht.

    Das kann Dragon NaturallySpeaking leider nicht. Das Ende einer Phrase und den Anfang der nächsten Phrase gleichzeitig ins Korrekturfenster laden überfordert den armen Drachen.

    Markieren und Abspielen funktioniert hingegen problemlos, weil einfach die verschiedenen Phrasen nacheinander abgespielt werden. Wenn Sie also irgendwann nicht mehr wissen, was Sie gesagt haben, können Sie immer noch diese Wörter markieren und im Menü "Audio" - "Aufnahme wiedergeben" wählen.

    Neue Tipps und Tricks

    • Der Befehl "Auslassungspunkte" fügt die berühmten ... ein.
    • Der Befehl "einzelnes Wort hinzufügen" öffnet ein Fenster, in das man ein neues Wort eingeben kann, welches dann zum Wortschatz hinzugefügt wird.
    • Der Befehl "als Ausdruck hinzufügen" fügt die Markierung - ein einzelnes Wort oder eine Wortgruppe mit bis zu 255 Zeichen - zum Wortschatz hinzu. Dieser Befehl ist unter anderem auch dann nützlich, wenn man neugebildete Komposita zum Wortschatz hinzufügen will - aber zum Thema "Komposita" schreibe ich demnächst mal ein bisschen mehr.
    • Ein Befehl "ein Zeichen nach rechts löschen" löscht das nachfolgende Zeichen, funktioniert also ähnlich wie die löschen-Taste. Ein Tastendruck ist einfacher? Schon, aber der Befehl funktioniert auch mit mehreren Wörtern und in beide Richtungen, also z.B. auch mit "drei Wörter nach links löschen".
    • einen Befehl "lösche [Wort oder Wörter]" gibt es leider nicht.
    Das wäre mal eine Idee - so wie man jetzt schon ein Wort markieren oder korrigieren kann, kann man es mit einem einzigen Sprachbefehl auch löschen, ohne es vorher zu markieren. (Und das merkwürdige ist: neue Benutzer versuchen intuitiv genau diesen Befehl und sind ganz verwirrt, wenn er nicht funktioniert.) Hat jemand so einen Befehl mal selbst programmiert? Dann nehme ich ihn gerne entgegen. Und leitete ihn an Nuance weiter - vielleicht schaffen sie es ja in Version 13, ihn aufzunehmen.

    15 August 2007

    Solo Desktop Ansteckmikrophon

    Nachdem ich über das Internet auf das Ansteckmikrophon Solo Desktop der Firma Revolabs aufmerksam geworden bin, habe ich mal einen Tag lang mit dem Gerät diktiert und möchte hier die Ergebnisse mitteilen.

    In das Gerät selbst habe ich große Hoffnungen gesetzt: ein Mikrophon, das ungefähr so groß ist wie ein Lippenstift und am Kragen angesteckt werden kann. Die Übertragung erfolgt schnurlos zu einer Basisstation auf dem Schreibtisch. Diese wird über USB angeschlossen, die Verbindung geht automatisch, also ganz einfache Bedienung.

    Schon im Internet wird davor gewarnt, dass das Mikrophon gegenüber Nebengeräusche nicht sehr tolerant ist. Da ich in meinem Büro meist alleine bin und niemand anders redet, kann ich schlecht beurteilen, wie sich das zum Beispiel in einer Arztpraxis verhält. Leise Nebengeräusche scheinen es nicht zu stören. Auch ein Staubsauger im Nebenzimmer macht nichts aus, wenn die Tür geschlossen ist.

    Allerdings erreicht es beim Test nur 15 Punkte, und wie ich festgestellt habe, muss es tatsächlich am Kragen möglichst weit oben befestigt werden - schon wenn man es unterhalb des zweiten Knopfes am Hemd feststeckt, ist die Erkennungsgenauigkeit indiskutabel. Hierauf muss man also auf jeden Fall achten.

    Am Mikrophon und an der Basisstation ist ein Stummschalter, so dass man es sowohl am Gerät selbst wie auch an der Basisstation einschalten und ausschalten kann. Natürlich kann man auch die entsprechende Taste an der Tastatur verwenden, die Dragon NaturallySpeaking einschaltet und ausschalten. Die beiden Tasten beeinflussen sich nicht, verhalten sich also wie Stummschalter an normalen Headsets. Man hat die Möglichkeit, entweder die Spracherkennung auszuschalten oder das Headset stumm zu schalten. Aus bekannten Gründen sollte man sich für einen der beiden Möglichkeiten entscheiden - ansonsten wird man früher oder später aus Versehen Sprache aufzeichnen, oder ein Diktat wird nicht geschrieben werden, weil aus Versehen das Headset nicht eingeschaltet wurde.

    Die Erkennungsgenauigkeit ist besser, wenn man sich beim Diktieren zurücklehnt, beugt man sich vor, wird offensichtlich die Sprache nicht so gut aufgenommen (das liegt an der Charakteristik des Mikrophons). Außerdem sollte man darauf achten, dass das Mikrophon tatsächlich nach oben zeigt und nicht zur Seite. Die Unterschiede in der Erkennungsgenauigkeit sind eklatant. Wenn das Mikrophon richtig befestigt ist, ist die Erkennungsgenauigkeit ausgezeichnet. Das Diktat geht flüssig und wird praktisch fehlerfrei erkannt. Von dieser Seite kann ich das Mikrophon nur uneingeschränkt empfehlen.

    Bewegungen beim Diktieren, also z.B. wenn man sich mit dem Stuhl dreht, den Kopf bewegt, aufsteht, läuft, stören den Diktierfluss anscheinend nicht besonders. Was die Möglichkeit angeht, beim Diktieren im Zimmer herum zu laufen - im Prinzip funktioniert es. Ich würde allerdings niemandem empfehlen, sich allzu weit vom Rechner zu entfernen, während er diktiert - einfach nur um die Sicherheit zu haben, dass tatsächlich das Diktat auch ankommt. Dies ist aber unabhängig vom Gerät und gilt auch für ein schnurloses Headset. Ein Versuch ergab übrigens, dass es nicht empfehlenswert ist, in die Küche zu gehen und dabei zu diktieren.

    Noch ein paar technische Hinweise: es handelt sich bei dem Solo Desktop um ein reines Mikrophon ohne Lautsprecher. Ein Ohrhörer kann angesteckt werden, um ein Feed-back über das Diktat zum Beispiel während der Korrektur zu haben. Dann ist man aber schon wieder sehr nahe an einem schnurlosen Headset, was den Zweck des Gerätes nicht ganz trifft. Immerhin ist es gedacht als Ersatz für Leute, die nicht mit einem schnurlosen Headset auf den Kopf gesehen werden wollen - Ärzte in der Praxis oder in der Klinik sind da oft sehr empfindlich. Wenn man also nicht einen externen Lautsprecher benutzt, sollte man die Option "Diktat wiedergeben bei Korrektur" abschalten.

    Durch seine Größe kann das Solo Desktop unauffällig getragen werden und muss deswegen auch nicht abgenommen werden, wenn man das Zimmer verlässt.. Wer in verschiedenen Zimmern arbeitet, kann nicht einfach von Raum zu Raum gehen und das Mikrophon verbindet sich dort automatisch mit der jeweiligen Basisstation.

    Die Informationen von Hersteller zu dem Thema:

    es ist möglich, ein Mikrofon an verschiedenen Basisstationen zu benutzen. Dazu muss das Mikrofon jedesmal mit der Basisstation verbunden werden. Dazu muss das Mikrofon durch langes Drücken der Mute Taste ausgeschaltet werden. Danach wird es in den sogenannten Pairing-Modus versetzt, indem die Mute Taste wieder gedrückt wird, bis die LED an der Oberseite erst grün, dann rot aufleuchtet. Nun muss innerhalb von 5 Sekunden die Mute Taste an der Basisstation gedrückt werden und darf nicht losgelassen werden. Die LED an der Basis leuchtet erst rot und nach ein paar Sekunden, wenn die Verbindung zum Mikrofon aufgebaut ist, beginnt sie rot zu blinken. Das Mikrofon blinkt dann im gleichen Rythmus wie die Basis. Die Geräte sind jetzt verbunden.

    Es ist nicht möglich, mehrere Mikrofone gleichzeitig mit einer Basisstation zu verbinden. Wenn ein weiteres Mikrofon mit der Basis verbunden wird, ist das ursprüngliche Mikrofon nicht mehr dieser Basis zugewiesen.

    Dies erscheint mir zu umständlich, als dass man wirklich empfehlen könnte, dasselbe Mikrophon an mehreren Rechnern zu benutzen. Hier dürfte besser sein, an jedem Rechner ein SpeechMike zu installieren oder, wenn es dann unbedingt schnurlos sein muss, an jedem Rechner ein Solo Desktop zu installieren, das man sich schnell an den Kragen klemmt.

    Das Mikrophon wird aufgeladen, indem man es in die Basisstation stellt. Die Basisstation wird über USB mit dem Computer verbunden und erhält von dort den Strom. Um das Mikrophon aufzuladen, wenn der Computer ausgeschaltet ist, muss man die Basisstation mit einem Netzgerät verbinden, das einen Mini-USB-Stecker hat .

    Hinweis vom Hersteller:

    Man kann einen ganz normalen USB Adapter benutzen. Revolabs verwendet hier einen Adapter von eMicrophones.com. Der Preis liegt bei ca. 15 US Dollar. Sie können aber selbstverständlich auch einen beliebigen anderen Adapter verwenden.

    Hier die Links zu weiteren Informationen:

    Hersteller: http://www.revolabs.com/

    Deutscher Vertrieb: http://www.prodytel.de/products/revolabs.html

    Forumsdiskussion (englisch): http://www.knowbrainer.com/pubforum/index.cfm?page=viewForumTopic&topicId=2300

    http://www.knowbrainer.com/pubforum/index.cfm?page=viewForumTopic&topicId=2123

    Forumsdiskussion (deutsch): http://www.forumromanum.de/member/forum/forum.php?action=std_show&entryid=1100438854&USER=user_115572&threadid=2

    Und was kostet der Spaß? Im 4voice-Shop z.B.
    274 € zzgl. Mwst.

    10 August 2007

    HIGHLIGHT DER WOCHE! (Zit. Nuance)

    Okay, aus ihrer Sicht vielleicht :-)

    Das Dragon NaturallySpeaking-Video “Liebesbrief” wird an diesem Samstag in der MyVideo-Show auf Sat.1 um 18:00 Uhr ausgestrahlt. Viel Spaß beim Fernsehen!

    Wer keine Zeit zum Fernsehen hat, findet es unter http://www.endlich-versteht-dich-jemand.de/video-tv-spots/index.htm.

    Viel Spaß!

    PS Das "Hilfe"-Video finde ich schöner.

    01 August 2007

    Berichte aus dem FAZ-Archiv

    Drei aktuelle Testberichte aus dem Archiv der FAZ können jetzt kostenlos als PDF-Datei heruntergeladen werden (mit Dank an die Firma Philips, die diese als Werbematerial bereitstellt):

    Vergleich von Eingabegeräten
    Vorstellung und Test des Philips DPM 9600
    Das Telefon als Diktiergerät

    Ein neuer Bericht ist am vergangenen Dienstag, 24.7.2007, in der FAZ erschienen, als ich noch im Urlaub war und daher nicht sofort reagieren konnte. Hier geht es um eine Aktion von Nuance, die einige ihrer liebsten Benutzer angeschrieben haben (warum eigentlich nicht mich?) und sie gebeten haben, ihnen einmal einen Blick in ihr Diktierprofil zu gewähren. Online wurden Daten gesammelt, übertragen und ausgewertet, die Benutzer, die an der Aktion teilnahmen, erhielten von Nuance ein verbessertes Vokabular zugeschickt. Der Hersteller selbst verspricht sich durch die Auswertung von weiteren Profilen eine Verbesserung der Erkennungsgenauigkeit in der nächsten Version, Dragon NaturallySpeaking 10. Also eigentlich eine klassische Win-Win-Situation.

    Personalisierung von Wortschätzen und Erstellung von ganzen Fachwortschätzen für bestimmte Bereiche - Medizin, Jura, Architektur und vieles andere mehr - war ja seit jeher eine Domäne der Dragon NaturallySpeaking-Fachhändler. Auch hierauf wird nicht versäumt hinzuweisen, mit lobender Erwähnung der 4voice AG, für die ich auch schon den einen oder anderen Fachwortschatz bearbeitet habe.

    Den Artikel selbst darf ich aus Copyright-Gründen nicht hier veröffentlichen. Wer mich aber lieb darum bittet, und seinen Namen preisgibt, hat vielleicht eine Chance auf eine Kopie.

    10 Juli 2007

    Befehl: "Weiter bei" für Dragon NaturallySpeaking

    Mit dem Befehl "Weiter bei [Wort/Wörter]" lässt sich in Dragon NaturallySpeaking unabhängig von „streich das" und irgendwelchen Markierungen gezielt der letzte Teil des Diktates löschen und nach einem bestimmten Wort weiter diktieren. Dragon NaturallySpeaking streicht dann alles, was hinter dem genannten Wort kommt, so dass man dort wieder neu ansetzen kann. Vom Gedanken her ähnlich wie ein schnelles Zurückspulen und Übersprechen beim Diktiergerät - die schnellste Methode, um eine Änderung der letzten Äußerung vorzunehmen.

    Ausprobieren und noch komfortabler diktieren!

    05 Juli 2007

    Tastenkombinationen für Sonderzeichen in Dragon NaturallySpeaking

    Einige Sonderzeichen sind im Wortschatz von Dragon NaturallySpeaking nicht enthalten, können aber nachgetragen werden. Dazu gibt man im Fenster „Vokabular bearbeiten“ das Zeichen über seinen ASCII-Code als geschriebene Form ein; unter „Gesprochene Form“ trägt man den Ausdruck ein, der das Zeichen aufrufen soll. Zur Eingabe die Alt-Taste gedrückt halten und den Zeichencode über den Nummernblock rechts eingeben!

    Alt + 0132: Anfürungszeichen
    Alt + 0147 Abführungszeichen
    Alt + 0130: einfaches Anführungszeichen
    Alt + 0146: einfaches Abführungszeichen
    Alt + 0150: halber Geviertstrich
    Alt + 0151: Geviertstrich
    Alt + 0173: Geschützter Trennstrich (verhindert einen Zeilenumbruch zwischen zwei Wortteilen)
    Alt + 0160: geschütztes Leerzeichen (verhindert einen Zeilenumbruch zwischen zwei Wörtern)

    (Update:) Bei allen Sonderzeichen müssen die Eigenschaften so bearbeitet werden, dass die Zeichen korrekt ohne Leerstelle vor oder hinter dem Wort stehen. Dazu das Wort markieren, auf "Eigenschaften" klicken und dort je nachdem „keine vorhergehende Leerstelle", „keine nachfolgende Leerstelle" oder „keine vorhergehende oder nachfolgende Leerstelle" auswählen.

    Das geschützte Leerzeichen kann ins Vokabular nur als Bestandteil eines feststehenden Ausdrucks aufgenommen werden. Das geschützte Leerzeichen selbst muss als Befehl abgelegt werden: in MS Word Strg+Umsch+Leertaste. Dazu wählt man „Extras – Neuen Befehl erstellen“, Befehlstyp: „Schritt für Schritt“, wählt „Einfügen – Systemtasten“ und gibt dort die Kombination Strg+Umsch+Leertaste ein. Mit „Speichern“ wird der neue Befehl gespeichert; um einen geschützten Leerschritt zu diktieren, muss man vor und nach dem Befehl eine kurze Sprechpause einlegen.

    Mehr Sonderzeichen findet man z.B. in MS Word unter „Einfügen – Symbol“, dort „Ascii-dezimal“ wählen, um den Zeichencode des gewünschten Sonderzeichens anzuzeigen.

    03 Juli 2007

    Spracherkennung im ComputerClub 2

    Der ComputerClub 2 hat in seiner Sendung vom 2.7.2007 einen Beitrag über Spracherkennung gesendet, bei dem Michael Spehr von der FAZ als Studiogast aus der Praxis erzählt. Auf der Website gibt es Links zum Download der gesamten Sendung, der Spracherkennungsbeitrag kommt bei ca. 10:00 Minuten und dauert ca. 8 Minuten. 

    Themen sind Diktat, Erkennungsgenauigkeit und Diktierstil, Spracheingabe in Navigationssysteme, Sprachsteuerung des Computers; ein Schwerpunkt liegt auf Vista, auch wenn Dr. Spehr natürlich mit Dragon 9.5 arbeitet.

    Hier ist das Sendungs-Archiv zur späteren Referenz.