Digital diktieren am Computer mit Spracherkennung und digitalen Diktiergeräten: Tipps und Tricks, Erfahrungsberichte und Links zu Dragon NaturallySpeaking und anderen Hilfsmitteln.
25 September 2007
Diktieren im Auto
Der Redakteur, der mehrfach zitierte Dr. Michael Spehr, macht eine ganz richtige Bemerkung: im Moment sind die Kosten für die Übertragung prohibitiv. Und bezüglich der Philips-Software stellt sich ebenfalls die Frage, inwieweit man 100 € zuzüglich Mehrwertsteuer für eine Software ausgeben soll, wenn man die Diktate genauso gut als Anhang an eine E-Mail senden kann - und dann auch die Möglichkeit hat, Diktate zu versenden, die nicht mit einem Philips-Diktiergerät aufgenommen worden. Zumal Philips empfiehlt, die Software auf die Speicherkarte zu installieren und nicht auf das Gerät. Das heißt, man muss auf jeden Fall Speicherkarten wechseln, was je nach Handy auch nicht unbedingt die reine Freude ist. (Selbst wenn man die Software auf das Handy installiert - wie ich es ohne Probleme getan habe - muss man ja immer noch die Diktate per Speicherkarte übertragen.)
Ausgereift ist noch keine dieser Methoden. Was fehlt, ist entweder eine vernünftige Diktiersoftware für das Handy, die sich auch so bedienen lässt, dass es Freude macht, oder eine preiswerte Übertragungsmöglichkeit. Also eigentlich ein Diktiergerät mit eingebautem UMTS :-) aber ob der Markt das hergibt?
21 September 2007
Hinweis: neues Anwenderforum bei OfficeAutomation Sander
Erste Mitteilungen gibt es auch schon.
Problemlösung: NaturallySpeaking kann keine weiteren Sprachdateien speichern
Hintergrund: Dragon NaturallySpeaking speichert, wie bekannt, auch das Diktat als Audio-Datei. Diese Datei wird nun im Laufe der Zeit sehr groß (Faustregel: eine Minute Diktat entspricht einem Megabyte). Der Standardwert, wie viel Diktat gespeichert wird, liegt bei 40 MB. Gemeiner Weise lügt Dragon NaturallySpeaking, weil der Rest der Meldung nämlich lautet, dass das Diktat fortgesetzt werden kann - dann die Meldung aber alle 2 Sekunden wieder erscheint.
Es gibt mehrere Möglichkeiten, dieses Problems Herr zu werden:
Im Menü "Optionen - Daten" setzt man den Standard-Wert bei "für die Wiedergabe reservierter Speicherplatz" von 40 MB auf (z.B.) 200 MB, wenn man nämlich Wert darauf legt, dass das Diktat gespeichert wird. Wenn man diese Funktion überhaupt nicht benötigt, setzt man den Wert auf Null. Dann werden lediglich die jeweils letzten 100 Äußerungen temporär gespeichert.
Praktischer Wert dieser Funktion: hat man ein längeres Word-Dokument diktiert und will erst dann korrigieren, wenn der erste Entwurf fertig ist, lernt Dragon NaturallySpeaking dann und nur dann hinzu, wenn die Audio-Informationen noch verfügbar sind. Wenn sie nicht mehr verfügbar sind, weil der verfügbare Speicherplatz auf null gesetzt wurde, hat Dragon auch keine Chance mehr zu lernen. Wenn man also während des Diktates direkt die Fehler korrigiert, benötigt man diese Option nicht.
18 September 2007
DNS-Tipp: Nummerierung und Aufzählungen
- "Nummerieren" nummeriert eine Reihe von Absätzen.
- "Aufzählungszeichen" setzt Aufzählungszeichen vor einer Reihe von Absätzen
Um die Formatierung vorzunehmen, einfach die entsprechenden Absätze markieren und den Befehl sagen. Funktioniert, sobald der erste Absatz diktiert wird, man sagt "nummerieren" oder "Aufzählungszeichen", und dieser sowie alle folgenden Absätze wird fortlaufend nummeriert beziehungsweise mit den Zeichen versehen.
- Der Befehl "Nummerierung" vor einer Folge von Zahlen sorgt dafür, dass diese Zahlen als Ziffern geschrieben werden. Dieser Befehl ist praktisch zum Beispiel beim Diktat von Postleitzahlen oder Telefonnummern in DNS 9.5, wo diese nicht automatisch richtig formatiert werden.
Spracherkennung im Bezirksamt Neukölln
Leider ist der Artikel der Berliner Zeitung schlecht recherchiert. Weder ist das Neuköllner Jugendamt die "bundesweit erste Behörde, die mit einem Computerprogramm für digitale Spracherkennung arbeitet" - das Justizministerium Baden-Württemberg arbeitet seit Jahren damit, und das Justizministerium Hessen wurde vor zwei Jahren von der 4voice AG damit ausgestattet; ganz zu schweigen von anderen Gerichten wie dem Landesarbeitsgericht Berlin, in dem ich auch mal die Finger im Spiel hatte.
Sehr hübsch auch der Satz "die Neuköllner Firma Abitz hat das digitale Spracherkennung entwickelt und während der vergangenen sieben Monate in die Computer installiert" - ein Satz, der nicht nur die völlige Unkenntnis des Autors über Computer, sondern auch seine Schwierigkeiten mit der deutschen Sprache demonstriert. Auch ist nicht ganz erklärlich, warum "alle Mitarbeiter zu Beginn ihrer Schulung 25 Minuten lang ein Märchen vorlesen" mussten. Wenn ich direkt in den Computer diktiere, lese ich zum Training 7 Minuten, und zwar kein Märchen. Wenn ich ein Diktiergerät benutzt, bin ich mit 15 Minuten auch fertig. Wollen wir es der Unkenntnis des Autors zu Grunde halten.
Testbericht: Philips LFH 751 Software zur Übertragung vom Diktiergerät auf das Handy und Weiterleitung per E-Mail/WLAN
Die Software wird geliefert auf einer Micro-SD Karte, mit einem Adapter, so dass man sie überhaupt erst in das Diktiergerät oder das Handy/den PDA einlegen kann. Bei der Installation ist es wichtig, zunächst das .NET-Framework auf den PDA zu installieren, dann erst die Philips-Software. Ich habe es natürlich zunächst mal umgekehrt gemacht, woraufhin die Installation nicht funktioniert hat. Das kommt davon, wenn man entgegen der Anweisung auf der Packung die Readme-Datei nicht liest :-)
Es empfiehlt sich, das Programm in den Hauptspeicher des Geräts zu installieren und nicht auf die Speicherkarte, es sei denn, man verwendet die Speicherkarte sowohl im Diktiergerät als auch für die Übertragung der Programme. Dann muss man aber immer diese Speicherkarte verwenden, was vermutlich wenig praxistauglich ist (hat da jemand echte Erfahrung mit?). Ist das Programm im Hauptspeicher installiert, kann ich eine beliebige Speicherkarte einlegen und die Diktate werden übertragen, sobald ich die Speicherkarte einstecke.
Übertragungsmöglichkeiten bestehen über E-Mail an einen vorkonfigurierten Empfänger, inklusive der Möglichkeit für cc und bcc. Eine andere Möglichkeit ist, über WLAN die Diktate in einem UNC-Pfad zu speichern. Da ich hier im Moment kein WLAN habe, konnte ich das nicht ausprobieren. Schließlich gibt es einen Automatik-Modus, in dem erst versucht wird, über WLAN zu speichern, wenn das nicht geht, werden die Diktate per E-Mail verschickt.
Übrigens funktioniert es nicht, Diktate auf einem Grundig- oder Olympus-Diktiergerät aufzuzeichnen und zu versenden. Es erscheint eine Fehlermeldung "Bitte nehmen Sie Ihre Diktate auf einem Philips Pocket Memo auf".
Interessanterweise verschwinden die Installationsdateien im CAB-Format nach der Installation von der SD Karte, so dass die Software nur noch vom PC aus installiert werden kann. In der entsprechenden PC-Installationsroutine ist das .NET-Framework mit enthalten.
Getestet habe ich auf einem XDA neo mit Windows Mobile 5. Die Software soll auf allen Geräten mit Windows Mobile 5 und 6 laufen, außerdem braucht man einen gültigen E-Mail-Account auf dem Gerät, um die Diktate zu versenden. Und natürlich sind die Diktate auch spracherkennungstauglich, wenn man sie vom PDA zum Beispiel direkt in den Eingangsordner einer Spracherkennung versendet.
Und der Preis? z.B. 99 € zzgl. MWst.
Philips SpeechExec Mobile PDA im 4voice-Shop.
10 September 2007
Ein neues Blog bei Microsoft zum Thema Sprache / Speech
06 September 2007
Wiedergabe bei der Korrektur nicht verfügbar
Das kann Dragon NaturallySpeaking leider nicht. Das Ende einer Phrase und den Anfang der nächsten Phrase gleichzeitig ins Korrekturfenster laden überfordert den armen Drachen.
Markieren und Abspielen funktioniert hingegen problemlos, weil einfach die verschiedenen Phrasen nacheinander abgespielt werden. Wenn Sie also irgendwann nicht mehr wissen, was Sie gesagt haben, können Sie immer noch diese Wörter markieren und im Menü "Audio" - "Aufnahme wiedergeben" wählen.
Neue Tipps und Tricks
- Der Befehl "Auslassungspunkte" fügt die berühmten ... ein.
- Der Befehl "einzelnes Wort hinzufügen" öffnet ein Fenster, in das man ein neues Wort eingeben kann, welches dann zum Wortschatz hinzugefügt wird.
- Der Befehl "als Ausdruck hinzufügen" fügt die Markierung - ein einzelnes Wort oder eine Wortgruppe mit bis zu 255 Zeichen - zum Wortschatz hinzu. Dieser Befehl ist unter anderem auch dann nützlich, wenn man neugebildete Komposita zum Wortschatz hinzufügen will - aber zum Thema "Komposita" schreibe ich demnächst mal ein bisschen mehr.
- Ein Befehl "ein Zeichen nach rechts löschen" löscht das nachfolgende Zeichen, funktioniert also ähnlich wie die löschen-Taste. Ein Tastendruck ist einfacher? Schon, aber der Befehl funktioniert auch mit mehreren Wörtern und in beide Richtungen, also z.B. auch mit "drei Wörter nach links löschen".
- einen Befehl "lösche [Wort oder Wörter]" gibt es leider nicht.
15 August 2007
Solo Desktop Ansteckmikrophon
In das Gerät selbst habe ich große Hoffnungen gesetzt: ein Mikrophon, das ungefähr so groß ist wie ein Lippenstift und am Kragen angesteckt werden kann. Die Übertragung erfolgt schnurlos zu einer Basisstation auf dem Schreibtisch. Diese wird über USB angeschlossen, die Verbindung geht automatisch, also ganz einfache Bedienung.
Bewegungen beim Diktieren, also z.B. wenn man sich mit dem Stuhl dreht, den Kopf bewegt, aufsteht, läuft, stören den Diktierfluss anscheinend nicht besonders. Was die Möglichkeit angeht, beim Diktieren im Zimmer herum zu laufen - im Prinzip funktioniert es. Ich würde allerdings niemandem empfehlen, sich allzu weit vom Rechner zu entfernen, während er diktiert - einfach nur um die Sicherheit zu haben, dass tatsächlich das Diktat auch ankommt. Dies ist aber unabhängig vom Gerät und gilt auch für ein schnurloses Headset. Ein Versuch ergab übrigens, dass es nicht empfehlenswert ist, in die Küche zu gehen und dabei zu diktieren.
Noch ein paar technische Hinweise: es handelt sich bei dem Solo Desktop um ein reines Mikrophon ohne Lautsprecher. Ein Ohrhörer kann angesteckt werden, um ein Feed-back über das Diktat zum Beispiel während der Korrektur zu haben. Dann ist man aber schon wieder sehr nahe an einem schnurlosen Headset, was den Zweck des Gerätes nicht ganz trifft. Immerhin ist es gedacht als Ersatz für Leute, die nicht mit einem schnurlosen Headset auf den Kopf gesehen werden wollen - Ärzte in der Praxis oder in der Klinik sind da oft sehr empfindlich. Wenn man also nicht einen externen Lautsprecher benutzt, sollte man die Option "Diktat wiedergeben bei Korrektur" abschalten.
Durch seine Größe kann das Solo Desktop unauffällig getragen werden und muss deswegen auch nicht abgenommen werden, wenn man das Zimmer verlässt.. Wer in verschiedenen Zimmern arbeitet, kann nicht einfach von Raum zu Raum gehen und das Mikrophon verbindet sich dort automatisch mit der jeweiligen Basisstation.
Die Informationen von Hersteller zu dem Thema:
es ist möglich, ein Mikrofon an verschiedenen Basisstationen zu benutzen. Dazu muss das Mikrofon jedesmal mit der Basisstation verbunden werden. Dazu muss das Mikrofon durch langes Drücken der Mute Taste ausgeschaltet werden. Danach wird es in den sogenannten Pairing-Modus versetzt, indem die Mute Taste wieder gedrückt wird, bis die LED an der Oberseite erst grün, dann rot aufleuchtet. Nun muss innerhalb von 5 Sekunden die Mute Taste an der Basisstation gedrückt werden und darf nicht losgelassen werden. Die LED an der Basis leuchtet erst rot und nach ein paar Sekunden, wenn die Verbindung zum Mikrofon aufgebaut ist, beginnt sie rot zu blinken. Das Mikrofon blinkt dann im gleichen Rythmus wie die Basis. Die Geräte sind jetzt verbunden.
Es ist nicht möglich, mehrere Mikrofone gleichzeitig mit einer Basisstation zu verbinden. Wenn ein weiteres Mikrofon mit der Basis verbunden wird, ist das ursprüngliche Mikrofon nicht mehr dieser Basis zugewiesen.
Dies erscheint mir zu umständlich, als dass man wirklich empfehlen könnte, dasselbe Mikrophon an mehreren Rechnern zu benutzen. Hier dürfte besser sein, an jedem Rechner ein SpeechMike zu installieren oder, wenn es dann unbedingt schnurlos sein muss, an jedem Rechner ein Solo Desktop zu installieren, das man sich schnell an den Kragen klemmt.
Das Mikrophon wird aufgeladen, indem man es in die Basisstation stellt. Die Basisstation wird über USB mit dem Computer verbunden und erhält von dort den Strom. Um das Mikrophon aufzuladen, wenn der Computer ausgeschaltet ist, muss man die Basisstation mit einem Netzgerät verbinden, das einen Mini-USB-Stecker hat .
Man kann einen ganz normalen USB Adapter benutzen. Revolabs verwendet hier einen Adapter von eMicrophones.com. Der Preis liegt bei ca. 15 US Dollar. Sie können aber selbstverständlich auch einen beliebigen anderen Adapter verwenden.
Hier die Links zu weiteren Informationen:
Hersteller: http://www.revolabs.com/
Deutscher Vertrieb: http://www.prodytel.de/products/revolabs.html
Forumsdiskussion (englisch): http://www.knowbrainer.com/pubforum/index.cfm?page=viewForumTopic&topicId=2300
http://www.knowbrainer.com/pubforum/index.cfm?page=viewForumTopic&topicId=2123
Forumsdiskussion (deutsch): http://www.forumromanum.de/member/forum/forum.php?action=std_show&entryid=1100438854&USER=user_115572&threadid=2
Und was kostet der Spaß? Im 4voice-Shop z.B. 274 € zzgl. Mwst.
10 August 2007
HIGHLIGHT DER WOCHE! (Zit. Nuance)
Das Dragon NaturallySpeaking-Video “Liebesbrief” wird an diesem Samstag in der MyVideo-Show auf Sat.1 um 18:00 Uhr ausgestrahlt. Viel Spaß beim Fernsehen!
Wer keine Zeit zum Fernsehen hat, findet es unter http://www.endlich-versteht-dich-jemand.de/video-tv-spots/index.htm.
Viel Spaß!
PS Das "Hilfe"-Video finde ich schöner.
01 August 2007
Berichte aus dem FAZ-Archiv
Vergleich von Eingabegeräten
Vorstellung und Test des Philips DPM 9600
Das Telefon als Diktiergerät
Ein neuer Bericht ist am vergangenen Dienstag, 24.7.2007, in der FAZ erschienen, als ich noch im Urlaub war und daher nicht sofort reagieren konnte. Hier geht es um eine Aktion von Nuance, die einige ihrer liebsten Benutzer angeschrieben haben (warum eigentlich nicht mich?) und sie gebeten haben, ihnen einmal einen Blick in ihr Diktierprofil zu gewähren. Online wurden Daten gesammelt, übertragen und ausgewertet, die Benutzer, die an der Aktion teilnahmen, erhielten von Nuance ein verbessertes Vokabular zugeschickt. Der Hersteller selbst verspricht sich durch die Auswertung von weiteren Profilen eine Verbesserung der Erkennungsgenauigkeit in der nächsten Version, Dragon NaturallySpeaking 10. Also eigentlich eine klassische Win-Win-Situation.
Personalisierung von Wortschätzen und Erstellung von ganzen Fachwortschätzen für bestimmte Bereiche - Medizin, Jura, Architektur und vieles andere mehr - war ja seit jeher eine Domäne der Dragon NaturallySpeaking-Fachhändler. Auch hierauf wird nicht versäumt hinzuweisen, mit lobender Erwähnung der 4voice AG, für die ich auch schon den einen oder anderen Fachwortschatz bearbeitet habe.
Den Artikel selbst darf ich aus Copyright-Gründen nicht hier veröffentlichen. Wer mich aber lieb darum bittet, und seinen Namen preisgibt, hat vielleicht eine Chance auf eine Kopie.
10 Juli 2007
Befehl: "Weiter bei" für Dragon NaturallySpeaking
Ausprobieren und noch komfortabler diktieren!
05 Juli 2007
Tastenkombinationen für Sonderzeichen in Dragon NaturallySpeaking
Alt + 0132: Anfürungszeichen
Alt + 0147 Abführungszeichen
Alt + 0130: einfaches Anführungszeichen
Alt + 0146: einfaches Abführungszeichen
Alt + 0150: halber Geviertstrich
Alt + 0151: Geviertstrich
Alt + 0173: Geschützter Trennstrich (verhindert einen Zeilenumbruch zwischen zwei Wortteilen)
Alt + 0160: geschütztes Leerzeichen (verhindert einen Zeilenumbruch zwischen zwei Wörtern)
(Update:) Bei allen Sonderzeichen müssen die Eigenschaften so bearbeitet werden, dass die Zeichen korrekt ohne Leerstelle vor oder hinter dem Wort stehen. Dazu das Wort markieren, auf "Eigenschaften" klicken und dort je nachdem „keine vorhergehende Leerstelle", „keine nachfolgende Leerstelle" oder „keine vorhergehende oder nachfolgende Leerstelle" auswählen.
Das geschützte Leerzeichen kann ins Vokabular nur als Bestandteil eines feststehenden Ausdrucks aufgenommen werden. Das geschützte Leerzeichen selbst muss als Befehl abgelegt werden: in MS Word Strg+Umsch+Leertaste. Dazu wählt man „Extras – Neuen Befehl erstellen“, Befehlstyp: „Schritt für Schritt“, wählt „Einfügen – Systemtasten“ und gibt dort die Kombination Strg+Umsch+Leertaste ein. Mit „Speichern“ wird der neue Befehl gespeichert; um einen geschützten Leerschritt zu diktieren, muss man vor und nach dem Befehl eine kurze Sprechpause einlegen.
Mehr Sonderzeichen findet man z.B. in MS Word unter „Einfügen – Symbol“, dort „Ascii-dezimal“ wählen, um den Zeichencode des gewünschten Sonderzeichens anzuzeigen.
03 Juli 2007
Spracherkennung im ComputerClub 2
Themen sind Diktat, Erkennungsgenauigkeit und Diktierstil, Spracheingabe in Navigationssysteme, Sprachsteuerung des Computers; ein Schwerpunkt liegt auf Vista, auch wenn Dr. Spehr natürlich mit Dragon 9.5 arbeitet.
Hier ist das Sendungs-Archiv zur späteren Referenz.
24 Juni 2007
Supportanfragen übers Blog? - besser nicht
Supportanfragen bitte grundsätzlich erst an den Fachhändler, dann an den Nuance-Support richten! Dabei bitte genau angeben, welche Version von Dragon, Service Pack, Betriebssystem, wann der Fehler auftaucht usw. machen.
Zeigefinger Nr. 2:
Wer unschuldige Blogger oder sonstige Quellen um Hilfe anzapft, der darf das unter seinem eigenen Namen! Ich hab langsam genug von Mr. Anonymus, meinem treuesten Kommentator - ich würde wirklich gern wissen, wer dies hier alles liest. (Okay, von Ihnen weiß ich's, von Ihnen und Ihnen auch - aber alle anderen, gebt euch zu erkennen!)
So, hier die wahrlich rudimentär formulierte Anfrage:
Anonym Hat gesagt…
Ich habe Natuarally Speaking 9 seit ca. 8 Monaten in Betrieb.Jetzt funknioniert es nicht mehr. Fehlermeldung: "kein Vokabular gealden" und " Programm läuft instabil......." bisher konnte mir noch niemand helfen.Ich kann: Wenn Dragon sich noch starten lässt, dann unter "Benutzer verwalten" "Erweitert" wählen und Benutzer wiederherstellen.
Wenn Dragon sich nicht mehr starten lässt, gehen Sie in den Ordner C:\Dokumente und Einstellungen\All Users\Anwendungsdaten\Nuance\NaturallySpeaking9\Users\
und dort in den Ordner mit dem schadhaften Benutzer.
Benennen Sie den Ordner "current" um in "current_old" und kopieren Sie den Oerdner "backup" in einen neuen Ordner "current". Damit werden die hoffentlich noch intakten Daten von vor fünf Sitzungen
wieder eingespielt; der Fehler verschwindet und die Rechtschreibung wird auch wieder besser.
Wenn nicht, s. Zeigefinger 1!
13 Juni 2007
look, mum, no hands!
- heißt ein australisches Blog zum Thema Dragon NaturallySpeaking. Ich hatte auf eine verwandte Seele gehofft, aber leider ist der letzte Beitrag schon ein halbes Jahr alt.
Einige Hinweise sind recht interessant, müssten natürlich für eine deutsche Anwendung angepasst werden. Als Ideen-Pool gut geeignet.
10 Juni 2007
Nicht nur auf das Mikro kommt es an (FAS, 10.6.2007)
Dies deckt sich mit meinen Erfahrungen - um so mehr, als dass der Artikel mich zu diesem Thema freundlicherweise direkt zitiert:
"Das Eingabegerät ist weniger wichtig als ein guter Diktierstil. Selbst mit dem eingebauten Mikrofon des Notebook kann man zur Not diktieren. Allerdings kann ein gutes Mikrofon einen guten Diktanten noch besser machen."Wer sich mit dem Gedanken trägt, ein neues Headset oder anderes Eingabegerät zu kaufen, sollte diesen Artikel (kostenpflichtiger Download) unbedingt zur Kenntnis nehmen - oder gleich den Fachhändler fragen.
07 Juni 2007
Standard-Schriftart in DragonPad
Der default font, also die Schrift, die DragonPad beim Start lädt, lässt sich aber nur ändern mit einem Eintrag in der Datei "options.ini" im Ordner C:\Dokumente und Einstellungen\All Users\Anwendungsdaten\Nuance\ NaturallySpeaking9\Users\[Dragon-Username]\current .
Fügen Sie hier zwei Zeilen hinzu, in denen Schriftart und Größe angegeben werden. Achtung: Die Schriftgröße wird in "Twips" gemessen - 20 twips sind ein Punkt, also muss die gewohnte Schriftgröße mal 20 genommen werden.
Um die Schrift z.B. auf Tahoma, 14, zu ändern, fügen Sie folgende Zeilen hinzu:
deu default font=tahoma
deu default font size=280
Im Gegensatz zu anderen Optionen bleibt diese auch erhalten, wenn man im Optionen-Menü Einstellungen ändert.
Nichtsdestotrotz wäre es schön, wenn man den Standardfont auch im Programm einstellen könnte. Dieses geht z.B. im Editor der verschiedenen 4voice-Varianten voice4medicine, voice4legal und voice4customer.
01 Juni 2007
Dragon-Anwenderforen
Das Forum wurde wohl anscheinend nur wenig gelesen, und die Beiträge ganz bestimmt nicht ernst genommen. Ansonsten während zahlreiche Mängel, die immer mal wieder aufgeführt und angemahnt werden, vielleicht inzwischen mal berufen worden. Auch ist nie irgendjemand vom Hersteller dort aktiv gewesen, um vielleicht noch eine Frage zu antworten, sondern es waren immer nur einige Händler und Anwender. Schließlich war die Bedienung unter aller Kritik. Es wurde ja nicht einmal der Name angezeigt, von dem ein Beitrag stammte.
Dieser exklusive Kreis muss sich jetzt eine neue Heimat suchen. Diese Seite hier ist zur Diskussion ja nicht wirklich geeignet, auch wenn von Zeit zu Zeit mal Kommentare kommen; daher habe ich noch einmal ein wenig recherchiert und für den deutschsprachigen Raum ein Forum gefunden, welches technisch auch nicht besser ist als das von Nuance, aber inhaltlich einiges mehr zu bieten hat:
Anwenderforum OfficeAutomation
Willi Sander, ebenfalls aus dem anderen Forum gut bekannt, gibt hier zahlreiche Hinweise und Hilfestellungen. Als altgedienter Dragon NaturallySpeaking-Händler kennt er sich sehr gut in der Software aus.
Wer es international mag, der sei verwiesen auf das Knowbrainer-Forum, das allerdings einiges von seinem Charme eingebüßt hat, nachdem es auf eine zeitgemäße Software aufgerüstet wurde. Zwei weitere Informationsquellen sind das Speech Recognition Wiki und das Voice Recognition Forum.
Das englischsprachige Forum von Nuance ist übrigens weiterhin aktiv. Ob es gelesen wird, weiß ich nicht - hier scheint das gleiche zu gelten wie beim Deutschen Forum.
31 Mai 2007
Sonntag die FAS kaufen
ein neues Gerät anzuschaffen, sollte ihn vorher lesen.
Ich weiß schon, was drin vorkommt - und wer :-)
29 Mai 2007
Dragon NaturallySpeaking 9.5 - erste Erfahrungen
Zuerst zur Installation:
Erst wird die heruntergeladene Datei in ein temporäres Verzeichnis entpackt, dann wird aus diesem Verzeichnis die Installation gestartet. Die entpacken Dateien sind übrigens exakt genauso groß wie die Datei, die heruntergeladen wurde.
Da es sich um Dragon NaturallySpeaking Professional handelt, sind Vokabulare, die mit der Medical Edition erstellt wurden, nicht kompatibel.
Die erste Auffälligkeit, die ich geprüft habe, ist das Verhalten der Zahlen, das seit Dragon NaturallySpeaking 9.1 Schwierigkeiten bereitet. Normal ist, dass Dragon NaturallySpeaking alle Zahlen zwischen eins und neun als Wort schreibt. Normal sollte aber eigentlich auch sein, dass Zahlen Kombinationen wie Telefonnummern oder Postleitzahlen, die diktiert werden, automatisch als Ziffern geschrieben werden. Seit Dragon NaturallySpeaking 9.1 ist dem nicht mehr so, auch die Version 9.5 übernimmt diesen Fehler. Die einzige Lösung besteht darin, aus einer funktionierenden Dragon NaturallySpeaking 9.0-Installation ff. Dateien zu kopieren und in die entsprechenden Verzeichnisse von Dragon NaturallySpeaking 9.5 zu stellen:
C:\Dokumente und Einstellungen\All Users\Anwendungsdaten\Nuance\NaturallySpeaking9\Data\deu\itn\numrules.dat
C:\Dokumente und Einstellungen\All Users\Anwendungsdaten\Nuance\NaturallySpeaking9\Data\deu\itn\Numwords.dat
C:\Dokumente und Einstellungen\All Users\Anwendungsdaten\Nuance\NaturallySpeaking9\Data\deu\itn\Numlists.dat
C:\Dokumente und Einstellungen\All Users\Anwendungsdaten\Nuance\NaturallySpeaking9\Data\deu\dat\numbers.dat
Danach werden die Zahlen wieder wie gewohnt als Ziffern geschrieben, im Satzkontext allerdings weiterhin als Wörter (z.B. "Drei Männer gingen die Straße entlang).
Achtung: dies geschieht auf eigene Gefahr! Lieber vorher eine Sicherheitskopie der Dateien machen!
Wenn das erfolgt ist, schreibt Dragon NaturallySpeaking Telefonnummern wieder richtig:
089 - 244104445
Weitere Unregelmäßigkeiten habe ich bisher noch nicht festgestellt, nach weiteren Fehlerbehebungen habe ich noch nicht gesucht. Dies kommt dann in den nächsten Tagen an dieser Stelle.
25 Mai 2007
Dragon 9.5 Professional ist da ...
Zur Installation braucht man eine gültige Seriennummer für NaturallySpeaking 9 - von daher nützt einem also die Datei alleine gar nichts, die außerdem mit 1,3 GB ganz schön heftig ausfällt.
Da ich ja im Besitz einer gültigen Seriennummer bin, werde ich mir die neue Version demnächst mal installieren und schauen, ob denn alles läuft, ob der Fehler mit den Zahlen beseitigt wurde, vielleicht sogar das Datum ordentlich erkannt wird, und ob auch Diktiergeräte wieder trainiert werden können - all das ist in 9.1 offen.
Als nächstes erwarten wir dann Dragon NaturallySpeaking Legal und Dragon NaturallySpeaking Medical.
21 Mai 2007
Zahlen, Zahlen, immer nur zahlen
1. Laden Sie bitte Ihren Sprecher/Ihr Vokabular und wählen Sie dann "Wörter - Anzeigen/bearbeiten"
2. Suchen Sie sich in der Liste der Wörter den Eintrag mit geschriebener Form "eins" und markieren Sie diese Eintrag durch Anklicken. Am schnellsten geht es vermutlich, wenn Sie im Eingabefeld "Geschriebene Form" das Wort "eins" tippen.
3. Klicken Sie dann auf "Eigenschaften".
4. Setzen Sie das Häkchen vor "Alternative Schreibweise" und geben Sie im Eingabefeld dahinter die entsprechende Ziffer (1) ein, wenn sie nicht ohnehin schon vorgeblendet wird.
5. Klicken Sie auf OK.
Nach genau dem selben Muster verfahren Sie nun bei den restlichen Ziffern. Führen Sie hierzu die Schritte 2-5 bei den weiteren Wörtern "zwei" bis "neun" und auch bei den groß geschriebenen Varianten "Eins" bis "Neun" durch. Zum Schluß schließen Sie bitte noch den Dialog "Vokabular bearbeiten" und erhalten nun jeweils die Ziffer hingeschrieben, wenn Sie eine Zahl zwischen 1 und 9 diktieren. Bitte denken Sie auch daran, dass Sie Ihr Sprecherprofil speichern müssen, um die soeben durchgeführten Änderungen zu sichern.
[Courtesy of Martin Müller]
So, das muss für die Zahlen reichen. Alles weitere in DNS 10 :-)
14 Mai 2007
Bitte Zahlen!
Damit Dragon NaturallySpeaking die Zahlen von 1 bis 9 korrekt als Ziffern schreibt, ist es nötig, diese Ziffern mit dem Wort "Ziffer" auszusprechen, also "Ziffer 1", "Ziffer 2" und so weiter.
Will man den Ausdruck "Ziffer 1" diktieren (also z.B. ein Rechtsanwalt), sagt man das Wort "Ziffer" zweimal, also zum Beispiel diktieren: "Ziffer Ziffer 1", damit korrekt "Ziffer 1" geschrieben wird.
27 April 2007
Die Unterstützergruppe
25 April 2007
Umsteigen auf Firefox?
Vielleicht sollte man doch mal den Standard wechseln. Nur schade, dass es zwei Tage dauert, bis man alle Einstellungen in Firefox so gemacht hat, wie man es von Opera gewöhnt ist - und man muss auch ständig irgendwelche Erweiterungen herunterladen. Dann ist er auch nicht mehr schneller.
Wumbaba!
Aus "Rechtsanwälte Wehr und Schäfer" macht Dragon NaturallySpeaking "Rechtsanwälte mehr und schärfer".
[2. Fehler wurde auf Anfrage entfernt]
Noch etwas: die neueste Version von Blogger arbeitet offensichtlich nicht mehr anständig mit dem Opera-Browser zusammen. Schon in der letzten Version gab es Probleme, die Opera relativ schnell beheben konnte, aber Google ist halt immer einen Schritt voraus mit der Technik und baut neue Fehler ein. Ich prangere das an und diktiere hiermit in Firefox! (und siehe da - alles funktioniert hervorragend. Ich sollte vielleicht umsteigen.)
09 März 2007
Neues Diktiergerät: Philips Digital Pocket Memo 9600 mit DSS Pro
Das neue Philips Digital Pocket Memo 9600 ist das erste Diktiergerät, das den neuen DSS Pro-Standard unterstützt. Als wichtigstes Merkmal lassen sich mit diesem Standard Diktate verschlüsseln – wenn die Speicherkarte mal wegkommt, kann die Diktate keiner abhören.
Nimmt man das Gerät in die Hand, fälllt zuerst die angenehme Haptik auf, die sehr an das Olympus DS-4000 erinnert. Mit den alten Pocket Memos bin ich nie richtig warm geworden; das 9600 liegt dagegen gut in der Hand, das Metall fühlt sich sehr angenehm an und der Schiebeschalter ist sehr angenehm zu bedienen. Auch die fünf Tasten auf der Vorderseite sind intuitiv zu bedienen. Das Display, angeblich das größte auf dem Markt, zeigt nicht nur die üblichen Informationen an, sondern auch die Belegung des Schiebeschalters – die lässt sich nämlich anpassen an den Olympus-, Grundig- oder Philips-Standard. Das 9600 funktioniert dabei wie ein Olympus-Gerät, dessen Schalter oben zur Aufnahme einrastet. Das 9620 hat dagegen den bekannten Philips-Schiebeschalter, der - wie auch der von Grundig - nach oben und unten gefedert ist, d.h. in der obersten Position nicht einrastet. Meine Wahl ist klar - ich brauche die Aufnahmeposition ganz oben, sonst vertue ich mich ständig.
Ein ganz cooles Feature ist die als Zubehör erhältliche LAN-Docking Station, die die Übertragung von Diktaten ohne PC ermöglicht. Man steckt das Gerät ein, und das Diktat wird verschickt. Wie genau, schaue ich mir heute auf dem Nuance-Event näher an.
Nachtrag: Die LAN-Station war leider noch nicht vorhanden.
27 Februar 2007
Das Ende der Mythen

Das Grundig Digta 415 Diktiergerät gibt es im 4voice-Shop zu kaufen :-)
Aber Obacht - ein Diktat war nach diesem Ergebnis nicht mehr ordentlich möglich.
Warum? Weil die "Tonqualität" in Wirklichkeit das Verhältnis von Geräusch (d.h. Sprache) und Nebengeräusch angibt, und weil die Aufnahmequalität so schlecht war, dass erst gar keine Nebengeräusche empfangen wurden. Dragon regelt die Aufnahmelautstärke so weit runter, dass beim Diktat nichts mehr ankommt.
Bevor Sie aber jetzt Ihre Bestellung widerrufen - der Fehler lag an einer Einstellung des Diktiergerätes. Die Voice Activation war eingeschaltet, und damit kamen diese Resultate. Nach der Deaktivierung war der Wert wieder normal (zwischen 15 und 20).
Was lernt uns das? Ein hoher Wert im Audio-Assistenten ist kein zuverlässiger Indikator für eine hohe Tonqualität vom Eingabegerät (ich hatte mal 36 mit einem Grundig ProMic, und die Erkennungsrate war auch nicht besser als sonst). Er kann im Gegenteil sogar ein Hinweis auf eine Fehlfunktion sein.
Geben wir uns also weiterin mit unseren Durchschnittswerten zufrieden und verwenden wir unsere Energie lieber, wie es im Training heißt, auf eine klare und deutliche Aussprache beim Diktieren!
26 Februar 2007
Sprachbefehle für Fortgeschrittene
23 Februar 2007
Und noch einmal: Hinzufügen von Wörtern zum Vokabular
Kollege Patrick Staisch stellte beim Test fest, dass jede Änderung, die über das Dialogfeld "Optionen" in Dragon NaturallySpeaking gemacht wird, dafür sorgt, dass die von Hand gemachten Änderungen der Datei options.ini verloren gehen. Dies kann ich bestätigen - es reicht sogar aus, einfach nur das Dialogfeld "Optionen" aufzurufen und mit Klick auf "Okay" wieder zu schließen - man muss noch nicht einmal etwas verändern.
David Peters, dem ich den ersten Hinweis auf das Verhalten von Dragon NaturallySpeaking verdanke, auch einfach im Text von Hand vorgenommene Änderungen ins Vokabular zu übernehmen, freut sich verständlicherweise über den Hinweis und ergänzt, dass es vollkommen normal ist, dass Dragon NaturallySpeaking sämtliche Änderungen in der Datei options.ini überschreibt, sobald man im Dialogfeld "Optionen" irgendetwas verändert. Man hat also die Wahl, entweder dieses Dialogfeld zu verwenden (und dann nicht auf einige Funktionen zurückgreifen zu können) oder aber immer nur die Datei zu editieren.
Fazit: die einmal gemachten Einstellungen sollte man sorgfältig wählen und dann nicht mehr verändern. Außerdem gilt hier wie immer: bevor man eine Systemdatei editiert, sollte man ein Back-up von ihr machen.
Und für die nächste Version wünschen wir uns dann, dass man solche doch recht wichtigen Änderungen nicht nur durch editieren einer Systemdateien machen kann, sondern - wie in anderen Programmen üblich - in der Benutzeroberfläche. Und weil es eine Spracherkennung ist, vielleicht sogar per Sprachbefehl.
So, dieser Beitrag markierte ein kleines Jubiläum: Netznotiz Nummer 100! Glückwünsche werden gerne entgegengenommen.
19 Februar 2007
Neues DSS Pro-Format
Ein Player soll demnächst kostenlos bei den Herstellern erhältlich sein; im Moment habe ich aber nur die alte Software gefunden (und selbst die Pressemitteilung ist noch nicht überall online - da wirds wohl mal wieder was dauern).
Wie merkwürdig ist das denn?
Und jetzt der Tipp des Tages: Befehle lassen sich auf einfache Weise trainieren. Man muss dazu gar nicht das Befehlscenter öffnen - es reicht vollkommen, wenn man im Menü "Wörter - trainieren" den Befehl eintippt, der trainiert werden soll, und dann das Training durchführt. (Natürlich kann man den Befehl nicht einfach diktieren - er würde dann ja ausgeführt werden.)
Noch ein Tipp: Trainieren Sie das Wort oder den Befehl in diesem Fenster so häufig, bis der graue Punkt, der normalerweise zu sehen ist, einmal kurz Grün aufleuchtet. Besser zweimal. Auf diese Weise habe ich sogar den ansonsten sehr störrischen Befehl "nimm zwei" in den Griff bekommen.
16 Februar 2007
Jetzt brauche ich auch mal Hilfe
15 Februar 2007
Video: Spracherkennung bei PC Pro
Nuance bewirbt jetzt Spracherkennung als Tool für Blogger -
Ungefragt natürlich, und ohne mich selbst eingetragen zu haben. Wer sich einträgt, bekommt ein Dragon Standard geschenkt - als ob ich das nötig hätte.
Ich gestehe: Ich diktiere nicht alles in diesem Blog. Wenn Nuacne mal den Opera Web Browser unterstützen würde, sähe das womöglich anders aus.
Nachtrag: Automatisches Hinzufügen von Wörtern beeinflussen
DNS Comfort geht einen Schritt weiter und bietet eine Übersicht über die hinzugefügten Wörter an. Die Schönheit daran ist, dass man entscheiden kann, was man wirklich behalten möchte, und damit einen besseren Überblick über das Vokabular hat. Ob man es braucht, ist wohl (wie so oft) eine Frage der persönlichen Vorlieben.
Eine kostenlose Testversion gibt es unter http://www.fachvokabulare.de. Dort ist auch beschrieben, was DNS Comfort sonst noch kann.
12 Februar 2007
Automatisches Hinzufügen von Wörtern beeinflussen
Hier und hier hatte ich schon einmal davon berichtet, dass Dragon NaturallySpeaking auch Wörter, die über die Tastatur korrigiert werden, unaufgefordert zum Vokabular hinzufügt - in Dragon NaturallySpeaking 9 kann man dieses Verhalten jetzt wenigstens abstellen. Dazu nimmt man unter "Optionen - Korrektur" den Haken vor "Wörter automatisch zum Vokabular Hinzufügen" raus.
Nachteil: auch Wörter, die ich über das Buchstabierfenster neu eingegeben habe, werden dann nicht mehr ins Vokabular übernommen. Es besteht nur noch die Möglichkeit, neue Wörter über "Vokabular bearbeiten" hinzuzufügen - nicht sehr schön.
Willy Sander hat ein Werkzeug bereitgestellt, welches zumindest die gröbsten Fehler bei der Übernahme neuer Wörter ins Vokabular beseitigt, aber das eigentliche Problem nicht löst: ich will nicht, dass Dragon NaturallySpeaking irgendetwas, was ich mit der Tastatur eingebe, versehentlich in den Wortschatz aufnimmt. Ich will aber, dass alle meine Korrekturen aufgenommen werden.
Abhilfe schafft da ein Eintrag in der Datei options.ini, zu finden unter: C:\Dokumente und Einstellungen\All Users\Anwendungsdaten\Nuance\NaturallySpeaking9\Users\[Benutzername]\current. Nimmt man wie beschrieben den Haken raus, werden zwei neue Zeilen in diese Datei geschrieben:
Automatically Add Words=0
Add Words on Correction=0
Ändert man diese Zeilen zu:
Automatically Add Words=0
Add Words on Correction=1
So werden Wörter, die über das Buchstabierfenster eingegeben werden, ins Vokabular übernommen; Wörter, die während des Diktats eingetippt werden, aber nicht. Somit haben wir endlich das Verhalten, das - zumindest mir - logisch erscheint.
08 Februar 2007
Berliner Zeitung : Bitte sprich nicht mit mir, Windows Vista!
Der Vista-Spracherkennungs-Bug ist jetzt auch in der Tagespresse angekommen und wurde auch gleich vom Kunden thematisiert. Meine Meinung dazu: wer mit offenem Schiebedach unter einem Tabenschlag herfährt, soll sich nicht wundern, wenn ihm was auf den Kopf fällt...
Abgesehen davon legen all diese Beiträge eine bemerkenswerte Ignoranz an den Tag, was die Arbeit mit Spracherkennung angeht. Wenn ich nicht diktiere, schalte ich mein Mikrofon ab. Dasselbe bringe ich auch all meinen Kunden bei. Und zwar nicht aus Angst von "präparierten Dateien", sondern wegen ganz normalen Nebengeräusche.
Also:
Nach dem Sprechen Mikrofon ausschalten.
Vor dem Schreiben Gehirn einschalten.
Ganz einfach, oder?
07 Februar 2007
Wumbaba!
Bei dem Thema stößt man sehr schnell auf www.kissthisguy.com, eine Site, die Verhörer in Popsongs sammelt. Dort heißen solche Verhörer "Mondegreens" (hier steht warum). Um die deutsche Sprache nicht mit einem ihr phonetisch wie orthoepisch fremden, ohnehin ausgedachten Fremdwort zu überlasten, schlage ich als deutsches Äquivalent, hierin Haake folgend, "Wumbaba" vor - wobei im Kontext dieses Blogs explizit der "Verhörer" einer beliebigen Spracherkennungssoftware gemient sein soll.
Und hier ist auch schon mein Wumbaba des Tages:
Start bei Systemstart Firewall deaktivieren
schreibt Dragon so:
Staatsanwältin statt einer Orgie aktivieren
Tusch! Weitere Einsendungen gern an mich oder anonym als Kommentar.
Warnung aus mal wieder gegebenem Anlass: Keine Spracherkennung der Welt produziert Fehlerkennungen, die "zufällig" einen Link zu einer Porno- oder sonstwie gearteten Spamseite produzieren. Solche Beiträge werden weiterhin gnadenlos gelöscht.
01 Februar 2007
Gemein: Vista's Spracherkennung führt Befehle aus!
Lautsprecher weit genug aufdreht, gleichzeitig sein Mikro eingeschaltet hat und dann eine präparierte
Audiodatei mit Sprachbefehlen öffnet, kann es sein, dass diese Sprachbefehle über das Mikrofon
aufgenommen werden und dann natürlich auch ausgeführt werden. Damit könnte man z.B. - ja was für Gemeinheiten ausführen? Mir fehlt da anscheinend die kriminelle Energie, mir etwas auszudenken, nicht aber dem Kollegen von ZDnet und PCmag, de dies zu einem ernstzunehmenden Sicherheitsrisiko hochschreiben. Wobei die beiden auch nicht so genau wissen, was eine solche Datei dem Rechner sagen sollte - dazu müsste man ja auch wissen, wozu Sprachbefehle standardmäßig überhaupt in der Lage sind.
Jedenfalls fordert man, dies Feature unbedingt abzustellen, ein Kommandowort vorzuschalten (als ob man das
nicht in besagter Audiodatei speichern könnte), und PCmag versteigt sich sogar zu der Frage, "warum Microsoft überhaupt gestattet, dass Sprachbefehle für Vista vom eigenen Computer kommen dürfen." Ja woher soll das Mikrofon denn wissen, wer da redet?
Und jetzt der Schocker: Das geht auch mit Dragon Professional. Seit Jahren. Nur hat Dragon nicht so eine
(über Fefe's Blog mit Dank an R. Murschall und PC Mag mit Dank an R. Jaekel)
24 Januar 2007
c't-Bericht: Spracherkennung
Ohne jetzt ins Detail gehen zu wollen, zeigt sich, dass Dragon NaturallySpeaking nach wie vor das überlegene System ist. Linguatec VoicePro ist dagegen technisch abgeschlagen, was daran liegt, dass IBM das Produkt nicht mehr wirklich weiterentwickelt. Der einzige Vorteil ist das mitgelieferte
Headset (Sennheiser PC 25).
Windows Vista liegt in der Mitte - gelobt wird die Erkennungsrate (wie bekannt) und die Möglichkeit, den PC per Sprache zu steuern. Dieses wird sogar als die eigentlich herausragende Funktion der Spracherkennung in Windows Vista genannt, weil das Diktat in Nicht-Microsoft-Anwendungen nämlich schlicht und ergreifend nicht funktioniert. Auch werden viele Headsets nicht unterstützt - ein Fakt, auf den Michael Spehr bereits in seinem Test hingewiesen hat (siehe unten). Positiv hervorgehoben wird die Bedienung und die schlanke Oberfläche, gegen die die beiden anderen Programme "antiquiert" wirken.
Endlich wissen wir auch, dass einige andere Funktionen in Windows Vista nicht enthalten sind. So können keine Diktate vom Diktiergeräte umgesetzt werden, das Vokabular kann nicht exportiert werden und wird auch nur mit großen Mühen bearbeitet, einige schnelle Formatierungsfunktionen während des Diktierens fehlen ganz, und auch Makros können nicht definiert werden. Schließlich ist es auch nicht möglich, ein Diktat zwischenzuspeichern und später zu korrigieren. Selbstverständlich kann der Text gespeichert werden, die Aufnahme jedoch ist verloren - was bei Dragon NaturallySpeaking Preferred auch der Fall ist und der Professional-Version vorbehalten bleibt. Von den preiswerten Spracherkennung kann das nur Linguatec VoicePro. Da allerdings bei diesem Programm sämtliche Netzwerkfunktionen fehlen, ist es auch nicht wirklich als Alternative für einen professionellen Diktanten geeignet, der nicht viel Geld ausgeben möchte.
Und das ergänzt Michael Spehr:
nach längerem Arbeiten mit der Vista-Spracherkennung komme ich immer mehr zu dem Eindruck, dass sie nur Teil einer Sprachbedienung des Betriebssystems ist und damit a) sich an Behinderte richtet und b) was die Business-Funktionen betrifft, nur den Funktionsumfang einer Light-Version hat. Es ist wirklich kein Ersatz für den Drachen, inbesondere weil man bei der Korrektur nicht eben schnell einen Eigennamen via Tastatur eingeben kann. Tut man das, lernt das System nicht dazu. Begriffe mit Umlauten bekommt man im Buchstabiermodus nur ganz schlecht hin. Insofern kann man also nicht mit Dragon vergleichen. Korrektur durch eine Sekretärin: m.W. nein, Netzwerk: nein, Vokabular-Werkzeug: nur rudimentär.Profis, bleibt dem Drachen treu!
23 Januar 2007
Elektronischer Dolmetscher in Albuquerque
- titelt das Speech Technology Magazine im November/Dezember 2006. Vorgestellt wird ein System, mit dem die Polizei von Albuquerque, New Mexico, mit dort auffällig gewordenen Personen kommuniziert, die nur spanisch und kein Englisch sprechen.
Es handelt sich um eine Kombination aus maschineller Übersetzung und Spracherkennung: der Polizist beziehungsweise die zu vernehmende Person spricht in den Computer, die spracherkannte Äußerung wird über ein Übersetzungsprogramm in die andere Sprache übertragen. Es zeigt sich, dass die Polizisten eine Erfolgsquote von 100% haben, ihre Kunden allerdings nur von ungefähr 70%. Das wird damit begründet, dass die Polizisten sowohl die Spracherkennung auf ihre Art zu sprechen trainieren konnten wie auch solche Äußerungen zu bilden gelernt haben, die von der maschinellen Übersetzung einfach übertragen werden können, während dies natürlich bei den Leuten, die vernommen werden, nicht der Fall ist - abgesehen davon, dass einige von ihnen natürlich wenig kooperationsfreudig sind.
Man mag zu dem Projekt stehen, wie man will, aber technisch zeigt es, dass ein automatischer Dolmetscher offensichtlich inzwischen wirklich praxistauglich ist. Allerdings wird auch ganz genau definiert, wofür er taugen muss: es geht nicht um grammatikalische Korrektheit, sondern einfach darum, den Inhalt einer Aussage verständlich in die Zielsprache zu übertragen. Somit misst sich der Erfolg an der gelungenen Kommunikation beziehungsweise der gelungenen Übertragung der Sprecherintention, nicht an irgendetwas anderem.
Nicht das schlechteste Kriterium - vor allen Dingen eines, was in der Praxis taugt, und von den Diskussionen über irgendwelche Prozentzahlen ablenkt. Es kommt halt immer darauf an, wozu man ein Werkzeug einsetzt.
Lieferant ist übrigens SpeechGear, Inc., das Produkt heißt Interact speech translation system. Wenn man sich anschaut, was die sonst noch haben, ist das entweder eine der heißesten Entwicklungsfirmen auf dem Sprachenmarkt oder der größte Produzent von Vaporware (oder warum kann ich nur die Hälfte der Produkte tatsächlich bestellen?) Zu den Partnern gehören u.a. PROMT und Nuance - das kann nicht ganz schlecht sein :-)
18 Januar 2007
Software-Konzern: Weltspitze im Gespräch mit dem Rechner - Wirtschaft - SPIEGEL ONLINE - Nachrichten
Instrument der Kundenbindung
Kaum war der letzte Beitrag abgeschickt, wurde ich von Blogger abgemeldet - wegen Spamverdacht. Es gebe viele Blogs, die nur den Zweck verfolgten, Links auf kommerzielle Seiten zu setzen, damit die Ergebnisse von Suchmaschinen verfälschten usw. - und ich sei im Verdacht, genau dies zu tun. Ein Blick auf einen Kommentar zu meinem letzten Post zeigt tatsächlich, dass sich hier jemand eingeschlichen hat, der genau dies tat und jede Menge italienischer Porno-Links eingetragen hat - und ich muss drunter leiden :-(
Heute morgen dann die Entwarnung: ich darf weiter posten, dieses Blog wurde als nicht-kommerziell oder zumindest als nicht-spammend eingestuft. Was es ja auch ist. Suchmaschinen-Marketing habe ich lange genug gemacht, um die Tricks zu kennen und zu wissen, welche man besser nicht anwendet, wenn man an langfristigem Erfolg interessiert ist. Und eine (inzwischen von mir entfernte) Linkliste zu dubiosen Seiten ist, wie man sieht, kein Mittel für lang anhaltenden Erfolg.
Jetzt will ich gar nicht leugnen, dass dieses Blog aus kommerziellen Interessen entstanden ist. Wenn jemand, der mit Spracherkennung Geld verdient, ein Blog über Spracherkennung macht,
dann natürlich auch mit dem Hintergedanken, Kunden zu binden und evtl. neu zu werben. In der letzten Zeit ist dies allerdings für mich in den Hintergrund getreten; diese Site entwickelt sich mehr zu einem Kommunikationsweg mit anderen Anwendern, von denen einige auch mal Kunden waren. Ist das so okay?
Ein Kommentator wünscht sich mehr Tipps für Sprachbefehle. Bitte sehr:
"Schreib das als Zahl" wandelt die Zahlwörter von eins bis neun in Ziffern um, und zwar ALLE Zahlwörter in der letzten Äußerung. Beispiel:
- "Um Eierkuchen zu backen, brauche ich ein"
- "Schreib das als Zahl"
-> "Um Eierkuchen zu backen, brauche ich 1"
... "Ei und zwei"
- "Schreib das als Zahl"
-> "Ei und 2"
... "Esslöffel Mehl pro Person."
Das ist umständlich und langsam, also sprechen Sie den Satz mutig in einem Atemzug durch und dann erst den Befehl. Das funktioniert genauso gut:
- "Um Eierkuchen zu backen, brauche ich ein Ei und zwei Esslöffel Mehl pro Person."
- "Schreib das als Zahl"
-> "Um Eierkuchen zu backen, brauche ich 1 Ei und 2 Esslöffel Mehl pro Person."
Zahlenformatierung ist überhaupt ein weites Feld - demnächst mehr davon. Als Instrument der Kundenbindung lebt dieses Blog ja davon, dass Sie regelmäßig was zu lesen haben, da will man nicht all sein Pulver auf einmal verschießen...
02 Januar 2007
Blogger ist inzwischen auf eine neue Version umgestiegen, so dass ich vor kurzem auch das Design des Blogs geändert habe. Leider ist das neue Blogger noch im Beta-Stadium, so dass es manchmal Probleme mit dem Layout, besonders mit den Zeilenumbrüchen, gibt. Das bitte ich zu entschuldigen. (Sehen Sie, was ich meine? :-)
Was mich angeht, so dürfte sich inzwischen herumgesprochen haben, dass ich im November 2006 von abitz.com zur 4voice AG gewechselt bin. Dort mache ich technischen Vertrieb, d.h. kümmere mich darum, dass unsere
Kunden auch wirklich das System erhalten, was sie brauchen. In den ersten zwei Monaten hieß das konkret:
reisen und installieren. War nicht so geplant, hat auch dazu geführt, dass die Beiträge hier seltener geworden sind, soll aber demnächst mal wieder anders werden.
Auf jeden Fall habe ich für alle Anfragen ein offenes Ohr, auich wenn die Antwort manchmal etwas länger dauert. Ich gebe auch gern weiterhin Tipps "off the record", also ohne spezifisches Verkaufsinteresse. Allerdings muss ich auch sagen: Wenn ich nicht überzeugt wäre, dass 4voice tatsächlich eine sinnvolle Lösung für Spracherkennung in einem professionellen Umfeld mit mehreren Arbeitsplätzen, evtl. Korrekturplätzen usw., böte, wäre ich nicht gewechselt. Vielleicht schreibe ich ja demnächst mal was darüber, was wir besser machen als Nuance, bzw. wo wir dem Drachen auf die Sprünge helfen (mein Chef wirds mir danken :-).
Jetzt über den eigenen Tellerrand hinaus:
Im letzten Jahr hat im Bereich Spracherkennung v.a. Microsoft von sich reden gemacht. Die Spracherkennung in Windows Vista wird allgemein gelobt, auch wenn sie offenbar noch nie jemand wirklich im Einsatz hatte - auch ich nicht; meinen neuen Rechner habe ich ein paar Wochen vor der Vista-Einführung erhalten. Es gibt bei Microsoft jetzt eine neue Community, in der Vista Spracherkennung
genauer beschrieben wird.
Auch Nuance hat mit Dragon NaturallySpeaking 9 eine neue Version auf den Markt gebracht, die die ohnehin gute Spracherkennung noch einmal verbessert hat, aber nichts wirklich revolutionär neues brachte.
Dies ist aber auch nicht unbedingt zu erwarten, solange man das Haupteinsatzgebiet im Diktieren sieht. Hier ist die Technik weitgehend ausgereizt; es kann nur noch darum gehen, die Erkennung auch für den letzten Stotterer (no offence meant) noch zu optimieren.
Der Dritte im Bunde, IBM, hat sich aus dem Diktiergeschäft de facto verabschiedet. Nur Linguatec hört nicht auf,
Das Urteil der Jury lautet aber nach wie vor: Dragon ist der Platzhirsch. Uneinig ist man sich jedoch, wie die Vista-Spracherkennung wirken wird - ob MS "den Netscape macht", ob - wie ich befürchte - eine Reihe Heimanwender Spracherkennung ausprobiert und erfolglos wieder sein lässt (und damit allen Herstellern schadet), oder ob Vista der Spracherkennung zum Durchbruch verhelfen könnte. Ich sehe eine Chance v.a. in der Sprachsteuerung, die bei Dragon bisher unterschätzt wurde. Nicht, weil sie nicht möglich ist - im Gegenteil, mit der Dragon-eigenen Skriptsprache ließen sich auf Wunsch ganze Anwendungen schreiben. Aber viele Anwender kennen nicht einmal den Befehl "geh schlafen", oder wenigstens die Taste zum Ein- und Ausschalten des Mikros (die Plus-Taste am Nummernblock - jetzt wssen Sie es auch), sondern klicken tatsächlich brav mit der Maus auf das Symbol oben links in der Ecke.
Ach, wenn man wollte, wie man könnte! Dann würde ich allen meinen Kunden - sei es meinen alten Bekannten von abitz.com, sei es meinen neuen Profidiktierern aus dem 4voice-Kundenstamm - Sprachbefehle beibringen, dass der Cursor nur so tanzt. Fangen wir doch einfach zum neuen Jahr mal an:
"verbinde [Wörter]"
vereinigt zwei (oder mehr) Wörter zu einem - und setzt im Zweifel sogar ein korrektes Fugen-S! Probieren Sie es aus:
"Das Neujahr Konzert der Berliner Philharmoniker"
verbinde Neujahr Konzert
"Das Neujahrskonzert der Berliner Philharmoniker"
Ein, wie der Berliner wünscht, gesundes Neues Jahr Ihnen allen, und Dank an alle Leser, Beiträger, Kommentatoren!
21 Dezember 2006
Gastbeitrag: Spracherkennung in Windows Vista
Vielen Dank für den Beitrag!
18 Dezember 2006
Dragon 9 Service Pack 1
Hier findet sich die Ankündigung und Technote bei Nuance.
Willi Sander hat einen direkten Download-Link und eine teilweise Übersetzung hier bereitgestellt:
http://www.fachvokabulare.de/ und dann Klick auf "Programme".
Hier noch seine Ankündigung und eine kleine Forumsdiskussion über die richtige Installation.
Interessant für Entwickler ist v.a. die Bearbeitung des VocTools, mit dem jetzt hoffentlich wieder möglich ist, ein Vokabular inkrementell, also Schritt für Schritt aufzubauen.
Nach der Installation kann ich für meinen Teil feststellen, dass zumindest das Zahlenformat, welches angeblich jetzt besser laufen soll, immer noch nicht ganz alltagstauglich ist - "22 per Dezember 2006" kommt immer noch genauso häufig wie 22.12.2006.
10 Dezember 2006
FAZ-Test von Linguatec Voice Pro
Hier noch der Nachtrag zu den letztlich gebloggten Kritiken von Linguatec Voice Pro 11:
Michael Spehr, FAZ-Spezialist fürs digitale Diktat, hat Voice Pro in der Ausgabe vom 5.12.2006 getestet. Sein Fazit: zu loben sind die hohe Erkennungsrate, der günstige Preis von 200 € und die verhältnismäßig bescheidenen Systemanforderungen (Kunststück – der verwendete Erkenner ist ViaVoice 10.5, das ist drei der vier Jahre alt). Auch die Arbeit mit Anwendungen, die im Browser laufen, gehe flüssiger als mit Dragon. Outlook Web Access funktioniert laut Testbericht mit VoicePro besser als mit Dragon. Im professionellen Einsatz sei Linguatec VoicePro jedoch keine Alternative zu Dragon NaturallySpeaking: der Lernprozess der Software sei deutlich komplizierter, und das zu erzielende Lernergebnis in der Spracherkennung niedriger.
Dies deckt sich mit meinen Erfahrungen, die ich vor Jahren mit Voice Pro 10 gemacht habe: die Ansätze sind gut, die Erkennung schwankte zwischen fehlerfrei und völlig indiskutabel, und die Korrektur war gewöhnungsbedürftig. Mir fielen außerdem schon damals die vielen kleinen Ärgerlichkeiten auf, die der Tester auch jetzt wieder erwähnt – viele Funktionen sind einfach nicht sauber umgesetzt, das Wechseln zwischen den Fenstern dauert elend lange, die Kompatibilität mit Word war nur im Prinzip gewährleistet, und was dergleichen Bugs mehr sind.
05 Dezember 2006
Linguatec VoicePro 11 im Test
und sei es in seiner Inkarnation als Linguatec Voice Pro, erwarten würde. Insofern stimmt ganz hoffnungsvoll, dass einige Anwender durchaus ein positives Wort darüber verlieren - auch wenn der Drache weiterhin für sie erste Wahl bleibt.
So schreibt Willi Sander:
Wie nicht anders zu erwarten war, verbirgt sich hinter VoicePro 11 die 10.5er Engine von ViaVoice. Trotzdem ist die Erkennungsgenauigkeit erstaunlich gut. [...] Die Bearbeitung der benutzerdefinierten Wörter ist immer noch ein Krampf, das Austauschen von Wortlisten ist nicht möglich.Rolf Richter:
Alles in Allem eine Alternative für Hobbyanwender [...].
Seit fast zwei Wochen bin ich im Besitz der Version 11 von ViaVoice. [...] Die Firma Linguatec hat ziemlich gute Arbeit geleistet, die befürchteten Defizite waren meist nicht mehr vorhanden.Georg Eisenmann:
[...]
Trotzdem, wenn ich ein Resümee ziehen sollte-ich bleibe natürlich bei Dragon, dies ist doch die bessere Alternative. Die Genauigkeit bei der Erkennung ist um einiges besser, auch die Korrektur ist schneller bewerkstelligt, die Übernahme neuer Wörter in das Vokabular ist ungleich effektiver, den größten Vorteil finde ich, dass man direkt in das Vokabular gehen kann, um dort Veränderungen vorzunehmen, zum Beispiel löschen usw. es ist bei ViaVoice eigentlich kaum möglich. [...] Dieser Beitrag wurde mit ViaVoice verfasst, ohne größere Verzweiflung.
Wie mir mein Vater gerade sagt, steht auch in der FAZ heute ein Test, der ähnliche Ergebnisse liefert - das Diktat ist an sich nicht schlecht, das Vokabular lässt sich aber nur umständlich bearbeiten. So muss fast jedes neue Wort trainiert, d.h. vorgesprochen werden - das hatten wir doch überwunden geglaubt? Sobald ich den Test vorliegen habe, trage ich ihn hier nach.
Nach einem recht langen Training, bei dem das erste Wort eines Satzes oft nur schwer vestanden wurde, habe ich dann drauf los diktiert. Leider war das Ergebnis nicht berauschend. In jedem Satz mehrere Fehler. Nicht einmal das Wort VoicePro wurde verstanden. Darüber recht geschockt versuchte ich mich anschließend mit dem neuen Mikrofon (von Sennheiser) an Dragon. Hier wurde dann weitaus mehr verstanden, dann und wann ein Fehler im Satz, aber passabel.
Der kurze Vergleich war fair: Weder VoicePro noch Dragon wurde mit alten Dokumenten gefüttert oder anderweitig optimiert wurde. Es fand auch nur jeweils das Anfangstraining statt (ca. 5 Minuten bei Dragon und bestimmt 15 Minuten bei Voicepro. Ein echter Test war das natürlich nicht.
Einen eigenen Test werde ich aber wohl kaum durchführen können, wo ich doch jetzt bei der Konkurrenz bin, Rike...
04 Dezember 2006
Elektronischer Dolmetscher erhöht die Glaubwürdigkeit - ?!?
Der Anwender, beispielsweise ein US-Soldat, würde dann ganz normal in das Mikrophon sprechen, worauf die IBM-Software simultan mit der Übersetzung beginnt und den Inhalt auf Arabisch per Lautsprecher ausgibt. Umgekehrt wird die Antwort auf Arabisch ins Englische übersetzt. Darüber hinaus werden die Sätze zu Kontrollzwecken sowohl in der Originalsprache als auch in der Übersetzung auf dem Display angezeigt und der übersetzte Satz wird zugleich in die Originalsprache zurück übersetzt, um es dem Originalsprecher zu ermöglichen, Missverständnisse oder falsche Übersetzungen schnell zu erkennen und gegebenenfalls zu korrigieren.Ob das funktioniert? Meine Ergebnisse mit Dragon-Spracherkennung und PROMT-Übersetzung waren nicht wirklich alltagstauglich. Auch die Rückübersetzungsfunktion scheint mir nicht
die beste Kontrollmöglichkeit, ob das Gegenüber wirklich das Gemeinte verstanden hat. Wer die einschlägigen Seiten für maschinelle Übersetzung kennt, weiß, dass hier gerne mal "Stille Post" gespielt wird. Legendär die Hin- und Her-Übersetzung des "Adobe Acrobat Reader" als "Lehmziegel Seiltänzer Leser" oder noch schöner "Ziegelsteinseiltänzerleser". Den Ernstfall möchte man sich nicht wirklich vorstellen.
Einerseits: wenn die US Army mit dem entsprechenden Kapital dahintersteckt, kommt ja vielleicht wirklich was dabei rum...
Andererseits: eine kurze Recherche fördert diesen Artikel der Netzeitung zutage. Wenn es darum geht, dass eine Maschine vertrauenswürdiger [sic!]
übersetzt als ein Mensch, und das auch noch jemand glaubt (!),
dann sind wir wirklich weit gekommen - aber nicht unbedingt technologisch.
03 Dezember 2006
Der Blaupapagei
Das Gerät ist sehr robust gebaut, mit einem metallenen Kopfbügel und einem stabilen Mikrofonarm. Auch das Ohrpolster ist aus robustem Kunstsoff, lediglich der Mikrofonschutz sitzt - wie immer bei VXI - etwas locker und sollte fixiert werden. Am Headset selbst git es drei Tasten - eine Multifunktionstaste für an, aus, pairing; je eine für lauter bzw. leiser, wobei ein viersekündiger Druck auf die "Lauter"-Taste das Mikro stumm schaltet.
Die Reichweite des Headsets habe ich mit Skype ausprobiert. Sie beträgt mit dem Anycom-Dongle ca. 10m, wobei die Wände nicht zu dick sein sollten. Aus dem Nebenzimmer funktioniert es, aber über den Flur wird es langsam kritisch, und die Übertragungsqualität sinkt rapide. Aus der Entfernung wird aber niemand diktieren wollen.
Einen kleinen Abstrich musste ich beim Ladegerät machen, das für den mobilen Einsatz konzipiert ist und daher nicht sehr standfest ist. Die Handelsausgabe wird mit einem stabilen Ladegerät geliefert (s. Bild).

Dafür habe ich einen Anschluss an den Zigarettenanzünder, so dass man das Headset zur Not auch im Auto laden kann - wer's fürs Handy braucht. (Persönliche Meinung: fürs Handy ist es zu schade, zum Telefonieren tuts jedes billige Ding, aber für Spracherkennung - und die geht nicht wirklich im Auto - muss es was Gutes sein.) Es gelten natürlich wie immer die üblichen Abstriche für Bluetooth, also dass man zum Beispiel bei jedem Start des Rechners wie auch nach dem Laden die Verbindung neu herstellen muss.
Obwohl Dragon 9 explizit Bluetooth-Headsets unterstützt, habe ich das Gerät als Standard Mic-Line In angelegt, und es hat nicht geschadet. (Hintergrund: gelegentlich speichere ich Diktate zur späteren Korrektur, und dann fordert Dragon dasselbe Eingabegerät, welches auch zum Diktieren benutzt wurde. Ich habe schon erlebt, dass Korrekturplätze nicht gearbeitet haben, wenn nicht das Original Philips Speechmike dranhing. Mit Mic/Line in ist man da auf der sicheren Seite: kein Qualitätsverlust beim Diktieren, und bei der Korrektur wird nur abgeprüft, ob eine interne Soundkarte vorhanden ist.) Das Diktat läuft sehr flüssig und mit minimaler Fehlerrate. Im Vergleich zum VXI Parrott TalkPro USB, meinem ehemaligen Standardmikro, konnte ich eher eine leichte Qualitätsverbesserung feststellen, v.a. in der Geschwindigkeit der Umsetzung.
Eine Vorschau des Headsets gibt es unter http://www.jolodata.de/vxi/parrottb150gtx_deutsch.htm, dort hoffentlich bald auch Preise.
29 November 2006
Macht Vista-Spracerkennung den Netscape mit Nuance?
Wird Spracherkennung jetzt eine Massenanwendung, einfach weil sie so vielen Nutzern kostenlos zur Verfügung steht? Und wird Microsoft damit dasselbe mit Nuance / Dragon machen, was sie im Browserkrieg mit Netscape gemacht haben? Die Antowrt hängt m.E. davon ab,
- wie gut die Spracherkennung wirklich ist, und das heißt: wie alltagstauglich für den ungeschulten Anwender;
- wenn sie es ist: wie viele Leute den Nutzen von Spracherkennung zu schätzen lernen, und ob damit eine so kritische Masse erreicht wird, dass es wirklich ein Massenphänomen wird wie damals das Internet
- und das wird ein Graswurzelphänomen sein: "Probier das mal aus, das ist klasse".
- womit wir wieder beim ersten Punkt wären: Jeder Depp muss mit Vista diktieren können, damit es ein Erfolg wird.
QED: Hat irgendwer wirklich die Spracherkennung von MS Office XP genutzt?
Übrigens: Laut Chuck Runquist, der es wissen muss, hat Nuance / Scansoft keinen Code geliefert, sondern die Entwicklung hat MS allein gemacht - wenn auch unter Berücksichtigung von L&H-Technologie.
Dass sich Vista in vielem wie Dragon benimmt und z.B. auf dieselben Befehle hört, scheint also eher eine Marketing-Entscheidung zu sein.
21 November 2006
Are you talking to me? No! I'm talking to my computer! Check out this new Voice Recognition program.
Den Stil der Darbietung muss man mögen - Frage und Antwort dienen hier eigentlich mehr zur zweistimmigen Präsentation der Spracherkennung in Windows Vista. Aber so ist Amerika. Viel beeindruckender sind die Möglichkeiten, die gezeigt werden - und die Dragon NaturallySpeaking alle schon seit Urzeiten enthält :-)
Wirklich schön ist die Tatsache, dass man anscheinend zwei Sprachbefehle direkt hintereinander sagen kann, ohne eine Pause machen zu müssen. Das funktioniert in Dragon NaturallySpeaking nun wirklich nicht.
Auch der Rest - nicht ganz neu, aber beeindruckend. Nun gehen wir natürlich davon aus, dass ein amerikanischer Interviewer, wenn er schon in diesem Stil das Gespräch führt, nicht daran interessiert ist, Fehler zu zeigen. Aber wenn es noch halbwegs in Echtzeit aufgenommen wurde, was da präsentiert wird, so ist die Leistung wirklich sehr gut. Und wenn nicht, wenn ist die Umsetzung in den Film immer noch gelungener als die beiden Nuance, wo der Diktant Herr Meyer "Neue Zeile" sagt und die Spracherkennung einen neuen Absatz macht.
Also: nehmen Sie sich 12 Minuten Zeit und sehen Sie sich das Video an. Interessant ist es auf jeden Fall. Und im Hause Nuance, wenn man keinen Geheimvertrag mit Microsoft abgeschlossen hat (worauf allerdings manche Details schließen lassen), sollte man sich jetzt warm anziehen.
14 November 2006
Wozu man Spracherkennung wirklich braucht (Video)
Der Liebesbrief hat auch was, ihm fehlt aber ein wenig der Realitätsbezug - ich nehm das Headset vorher ab :-)
Und die Beschwerde ist vorhersagbar...
Und zum Schluss die Kapitalismuskritik: hier finden sich alle drei Videos in einem schon weniger basisdemokratischen Kontext.
01 November 2006
Aufnahme unerwünschter Wörter in das Vokabular
Noch ein Hinweis auf das Forum, das Willi Sander unterhält - mit guten Tipps, und wenig Diskussion.
Patch A für Dragon 9
Herr Sander meint, dass der Patch noch ein paar Probleme mehr behebt. Ich kam bisher auch ohne ganz gut zurecht, werde es aber nachher mal probieren.
Nachtrag:
Dragon für 4voice läßt sich damit nicht aktualisieren - ist schon drin, sagt der Installer. Die Nuance-Version hab ich gerade nicht greifbar.
Ich bin jetzt bei der 4voice AG
Natürlich spekuliere ich gern weiter über Fragen, warum der Drache das tut, was er tut, und welches Headset jetzt das beste ist (demnächst im Test das neue BlueParrott). Mein Geld verdiene ich aber mit der Beratung zur Anschaffung größerer Systeme.
Bei der Gelegenheit sollte ich vielleicht noch ein paar Sachen nachtragen, die während des Jobwechsels vergessen wurden oder zu kurz kamen:
- Dictanet macht den Vertrieb jetzt wieder komplett über die Software AG, nachdem die Vertriebs-GmbH fast komplett zu Philips gegangen ist. Zur Strafe verkauft Dictanet jetzt keine Philips-Mikros mehr, sondern rät zu Olympus. Ich höre Philips weinen.
- In der Frankfurter Allgemeinen Sonntagszeitung war letztlich ein Test von Dragon 9, wieder von Michael Spehr. Ich habe drauf verzichtet, ihn großartig zu bloggen, es steht nämlich nichts neues drin (schade, Herr Stückmann, aber die FAZ und FAS wird eben nicht von Dragon-Profis gelesen).
(Danke an Arnd Müller)
26 Oktober 2006
Linguatec berücksichtigt jetzt de Oberbayern
Bisher ist Voice Pro 11 noch gar nicht ausgeliefert. Wenn sich die ersten Erfahrungen einstellen, kommt vielleicht auch ein neuer Post dazu -)
Abhilfe gegen die Aufnahme unerwünschter Wörter in das Vokabular
Um Dragon davon abzuhalten, unerwünschte Wörter heimlich ins Vokabular aufzunehmen, kan man nicht nur unter "Optionen" den Haken bei "Dem Vokabular Wörter automatisch hinzufügen" herausnehmen (und dann manche Wörter, z.B. Komposita, manuell hinzufügen müssen). Willi Sander bietet auch ein Tool namens dns.comfort an, welches diese und andere Aufghaben übernimmt. Auf der Website www.oa-sa.de ist das Tool allerdings nicht zu finden. Wem die Forumsdiskussion Appetit gemacht hat, der wendet sich am besten direkt an Herrn Sander.
Übrigens unterhält er auch ein Forum mit vielen interessanten Tricks.
19 Oktober 2006
Linguatec Voice Pro 11 kommt!
VIaVoice ist bei IBM nach wie vor auch nicht als Produkt gelistet, auch Nuance kennt nur VV 10 - die wollen ja auch Dragon verkaufen. Linguatec hat aber immer gute Verbindungen zu IBM gehabt (war ja mal eine Tochtergesellschaft), und da hat man die Entwickler wohl doch noch zur Arbeit an der Diktiersoftware bewegen können.
Linguatec hat nach eigener Aussage die Oberfläche so gelassen, wie sie ist, aber die Erkennung deutlich verbessert. Man ist gespannt, wie es sich in der Praxis schlägt. Die andere Frage ist immer noch, wie es mit der Bedienung aussioeht - da war Dragon immer besser und schneller.
(Mit Dank an Ronny Jaekel)
18 Oktober 2006
C´t über Vista´s Spracherkennung
"Die Diktierfunktion kann noch nicht mit fortgeschrittenen Lösungen wie Dragon NaturallySpeaking mithalten, blamiert sich aber auch nicht.
Immerhin folgt Vista deutschen Befehlen ... und blendet auf das Wort "Mausraster" ein durchnummeriertes Gitter an, das Anwender per Stimme ansteuern können."
(C´t 21/2005)
Rike Bacher hat´s auf Deutsch getestet und war positiv überrascht, auch wenn in ihrer Beta die Befehle nicht funktionierten. V.a. Die Kommandozentrale hatte es ihr angetan.
04 Oktober 2006
KnowBrainer Forum neu designt!
Dafür ist es aber weit strukturierter; und man soll die Hoffnung nicht aufgeben, dass vielleicht irgendwann so etwas wie eine FAQ-Liste aus den immer wiederkehrenden Themen erwächst. T3echnisch sollte es jetzt zu realisieren sein. Unter http://speechwiki.org/SR/NaturallySpeakingFAQ.html stelt Ian (Natajus), ein eifriger Mitleser und -schreiber, aber gerade welche zusammen, und deutschsprachige Leser kennen vielleicht auch die Dragon-FAQs bei abitz.com, die vom Autor dieser Zeilen zusammengestellt wurden.