19 Juni 2008

Vortrag: Spracherkennung und Übersetzungswissenschaft

Der für die Lange Nacht der Wissenschaften in Berlin angekündigte, dann aber verschobene Vortrag

„Spracherkennung und Übersetzungswissenschaft“

von Cornelia Soldat und mir wird jetzt endgültig nachgeholt am

Dienstag, 24.6. 16.00 Uhr, Humboldt-Universität zu Berlin, August-Boeckh-Haus Raum 5.42
Dorotheenstr. 65, 10117 Berlin, S + U Friedrichstraße

Alle Interessenten sind herzlich eingeladen!

16 Juni 2008

Neu bei Olympus: WS-110 DNS Version

Olympus bietet den digitalen Recorder WS-110 jetzt im Bundle mit einer Dragon NaturallySpeaking Recorder Edition an. Diese habe ich mir mal genauer angesehen, denn das Paket klingt wirklich verlockend: ein digitales Diktiergerät (der Einsteigerklasse) und ein Dragon mit nicht weniger als sechs Erkennungssprachen für ca. 100 € - wer kann dazu schon nein sagen?

Die Firma Olympus hat mir dankenswerterweise eine DVD zur Verfügung gestellt, von der aus ich die Recorder Edition auch ohne Probleme installieren konnte (ein Diktiergerät war nicht dabei, so das ich hierzu leider nichts weiter sagen kann). Allerdings wurde ich schon zu Beginn stutzig (ich hatte vorher eine ältere Version von Dragon auf dem Rechner): Der Installer warnt davor, dass die Funktionalität, direkt in den PC zu diktieren, mit diesem Upgrade verloren geht.

So war es dann auch: zwar kann ich Englisch, Spanisch, Französisch, Italienisch, Niederländisch und Deutsch als Erkennungssprachen installieren, doch als Diktierquelle steht mir nur "Pocket PC" und "Audiodateien auf Festplatte" zur Verfügung. Damit bewahrheitet sich der Name: Die Recorder Edition unterstützt nur das sogenannte Offline-Diktat, d.h. die Umsetzung von zuvor aufgenommenen Aufnahmen.

Dies tut sie in gewohnter Dragon-Qualität und in sechs Sprachen, insofern kann man sie wirklich als Schnäppchen bezeichnen. Unter der Haube arbeitet eine Dragon NaturallySpeaking Preferred 9.5.

Startet man das Programm, wird man auf eine britische Website geführt, wo sich die Vollversion Dragon NaturallySpeaking Preferred für nur 99,99 Britische Pfund erwerben lässt. Doch Obacht: Diese Preferred ist dann eine ganz normale Preferred ohne die sechs Sprachern (ich frage mich sofgar, ob Deutsch dabei ist). Auch der Umrechnungskurs hat es in sich: rechne ich die 100 Pfund in Euro um, kostet die Preferred plötzlich 199 EUR - laut amtlichem Wechselkurs wären es ca. 125 EUR. Da bestellt man doch lieber woanders.

Bei der Beschreibung der Software ist ebenfalls Vorsicht geboten: automatische Zeichensetzung und Ausfiltern von Ähs und Öhs stehen z.B. im Deutschen nicht zur Verfügung, wie auch in allen anderen Dragon-Versionen nicht. Im Englischen sieht das anders aus; andere Sprachen beherrsche ich nicht so weit, dass ich damit diktieren könnte.

Fazit: Was kann die Recorder Edition und was nicht?

- Sie kann Diktate in sechs Sprachen von (beliebigen) digitalen Diktiergeräten umsetzen. Das mitgelieferte Olympus WS-110 ist übrigens für sein gutes Mikrofon bekannt und für Spracherkennung sehr gut geeignet.
- Sie kann nicht direktes Diktat in den Rechner ermöglichen. Dazu braucht man die Dragon NaturallySpeaking Preferred Edition oder eine der professionellen Editionen. Damit werden allerdings die sechs Sprachen eingeschränkt auf höchstens zwei; und der Bezug über den eingebauten Link ist nicht wirklich ratsam.

Wer braucht das Angebot also? Die Recorder Edition in Verbindung mit dem WS-110 ist für mich (andere mögen das anders sehen) eine sehr günstige Möglichkeit, Sprachnotizen aufzuzeichnen und hinterher per Spracherkennung umzusetzen. Dies ist für mich ein wichtiges Einsatzgebiet, welches ich in letzter zeit fast täglich nutze. Wer sich ohnehin mit dem Gedanken trägt, ein Diktiergerät der Notetaker-Klasse anzuschaffen, ist mit dem Paket hervorragend bedient. Als Einstieg in die Spracherkennung bietet die Recorder Edtition von Dragon NaturallySpeaking lediglich einen Vorgeschmack auf die Möglichkeiten, die das direkte Diktat in den PC - immer noch die Königsdisziplin der Spracherkennung - bietet. Für die paar Euro mehr kann ich aber jedem nur raten, die Spracherkennung mit zu kaufen und dann bei Gelegenheit umzusteigen.

Lange Nacht der Wissenschaften - fand leider nicht statt

Will sagen: natürlich fand die lange Nacht der Wissenschaften statt, aber leider ohne unsere Beteiligung. Da der Vortrag "Spracherkennung als Hilfsmittel für einen modernen Übersetzer-Arbeitsplatz" von Cornelia Soldat und mir erst sehr spät ins Programm genommen wurde, gab es bei der Veranstaltung ein Missverständnis, aufgrund dessen wir uns schließlich ohne Ort und ohne Beamer wiederfanden und beschlossen haben, den Vortrag demnächst in einem anderen Rahmen an der Humboldt-Universität zu wiederholen.

Die Ankündigung werde ich rechtzeitig veröffentlichen.

Vorteil: der Vortrag wird nicht zu ganz so nachtschlafender Zeit stattfinden, und der Eintritt wird frei sein.

Ich freue mich auf Ihren Besuch, man lernt seine LeserInnen gern mal persönlich kennen!

11 Juni 2008

Spracherkennung in der Langen Nacht der Wissenschaft, Berlin

Am kommenden Samstag, 14.6.2008, führen meine Kollegin Dr. Cornelia Soldat und ich im Rahmen der Langen Nacht der Wissenschaften in Berlin Spracherkennung vor. Die Einladung stammt vom Institut für Slawistik der Humboldt-Universität zu Berlin (wo ich promoviert habe, falls noch mal jemand nach der Herkunft meines Doktortitels fragt), weshalb der Vortrag überschrieben ist mit "Spracherkennung als Hilfsmittel für einen modernen Übersetzer-Arbeitsplatz". Auch Nicht-Übersetzer werden aber auf ihre Kosten kommen, und sei es in der anschließenden Diskussion.

Themen sind u.a. die Erstellung und Bearbeitung von Fachwortschätzen, das technische Rüstzeug für Spracherkennung, aber auch die Funktionsweise solcher Anwendungen und die lingustischen Hintergründe.

Der Vortrag beginnt um 21h im Foyer der "Kommode", August-Bebel-Platz 1, Berlin-Mitte (gegenüber von Staatsoper und Humboldt-Universität).

Anschließend findet auf dem Platz - 1933 Ort der Bücherverbrennung - eine Lesung statt zum Thema: Verb(r)annte Interkulturalität Auch übersetzte Bücher fremdsprachiger Autoren wurden vor 75 Jahren dem Feuer anheim gegeben.

Am Bebelplatz, dem Ort der Bücherverbrennung, lesen Studierende Texte in Originalsprache und auf Deutsch. LESUNG: 22.00-23.30 Uhr

Herzliche Einladung an alle Interessierten! Weitere Informationen, Eintrittspreise usw. entnehmen Sie bitte der Website der Langen Nacht der Wissenschaften.

29 Mai 2008

BlackBerry zum Diktat – Diktiersoftware für BlackBerrys von Thax

BlackBerry zum Diktat – Diktiersoftware für BlackBerrys - kündigt Golem.de an. Thax Software hat eine Ergänzung des Findentity-Diktiersystems für Anwälte vorgestellt, bei dem sich der Blackberry als Diktiergerät verwenden lässt. Die Features - Tastenbedienung, Einfügen, Überschreiben, Indexmarken usw. - klingen völlig professionell; im Unterschied zu dem Versuch von Dictanet sollen die die Aufzeichnungen auch mit Spracherkennung bearbeiten lassen. Ein wenig Gedanken machr mir der verwendete Audio-Codec .amr statt des (lizenzpflichtigen) DSS. Das sieht nach proprietärer Lösung aus... einen PC-Player gibt es aber kostenlos dazu, notfalls lässt sich auch der Real Player verwenden. Spracherkennung braucht allerdings WAV; mal schauen, wir das gelöst wird.

Die Software soll 149 € zzgl. Mwst. kosten; derzeit gibt es sie zum kostenlosen Download zur Evaluation.

Ich warte seit Jahren auf eine vernünftige Lösung für den Pocket PC; Thax verspricht da was für "in ca. 3 Monaten". Ich bin gespannt!

(Dank an Ronny Jaekel)

16 Mai 2008

Test Headsets für Spracherkennung: Logitech vs. Terratec - wer hört besser zu?

Test Headsets für Spracherkennung: Logitech vs. Terratec - wer hört besser zu?

Der Titel sagt alles. Einen Hinweis habe ich noch: Die Zahl im Audioassistenten von Dragon gibt lediglich das Verhältnis von Sprache zu Nebengeräuschen an und ist kein Indikator für die spätere Erkennungsgenauigkeit! Ich hatte mal 37 Punkte mit einem Mikrofon, das so leise war, dass es überhaupt keine Nebengeräusche, aber auch nur sehr wenig Sprache aufgezeichnet hat. Wenn übrigens am Notebook alle Mikrofone brummen, würde ich mal den USB-Anschluss checken.
Das aber nur am Rande - Danke für den aufwändig recherchierten Test an Wolf-Dieter Roth (von dem wir auch nur Gutes gewöhnt sind).

Ich bleibe trotzdem bei meinem GN 9350, alternativ VXI Parrott Talk Pro - aber ich muss ja nicht auf den Pfennig schauen, was diese Geräte angeht. Abgesehen davon lohnt sich die Ausgabe für ein gutes Mikro immer - aber noch mehr der Aufwand, vernünftig zu diktieren (ceterum censeo...)

Nuance - Sprechen Sie Dragon?

Der Welt will ich diesen Wettbewerb nicht vorenthalten: Nuance - Sprechen Sie Dragon?

Ich spreche Dragon, um mein Blog schneller zu betexten :-)

Tipps und Tricks: Eigenschaften bearbeiten

Eine wenig genutzte Funktionen im Menü "Vokabular bearbeiten" ist die Möglichkeit, Worteigenschaften zu definieren. Hier hat man beispielsweise Gelegenheit festzulegen, ob vor oder nach einem Wort eine Leerstelle kommt, groß oder klein weitergeschrieben wird und dergleichen mehr. Außerdem -- und für die tägliche Anwendung meist wichtiger -- lässt sich das Verhalten von Zahlen vor oder nach einem Wort regeln und eine alternative Form in Abhängigkeit vom Kontext eingeben.

Dragon NaturallySpeaking bietet die Möglichkeit, Worteigenschaften zu ändern. Dazu öffnet man den Vokabulareditor (in Dragon NaturallySpeaking: Wörter - Vokabular anzeigen/bearbeiten), sucht das betreffende Wort und klickt dann auf „ Eigenschaften". Im folgenden Dialog lassen sich verschiedene Eigenschaften eines Wortes definieren, zum Beispiel ob das Wort mit oder ohne vorhergehende oder nachfolgende Leerstelle geschrieben wird, oder ob in einem bestimmten Kontext eine alternative Form geschrieben werden soll.

Über diese Funktion lässt sich zum Beispiel definieren, dass vor einer Zahl das Wort "Paragraph" als § geschrieben wird. Dazu wählt man unter "alternativen Schreibweise" die korrekte Schreibweise - in diesem Fall das § - und wählt zusätzlich "Immer alternativen Schreibweise verwenden - vor einer Zahl" und unter "Abstände": mit Leerstelle.

Analog lässt sich zum Beispiel definieren, dass das Wort "zirka" vor einer Zahl immer als "ca." geschrieben wird.

Über die Funktion "Zahlen immer als Ziffern schreiben" lassen sich auch Maßeinheiten definieren: wenn ich angebe, dass eine Zahl immer als Ziffer geschrieben werden soll, wenn sie vor diesem Wort steht, kann ich auch so exotische Maßeinheiten wie „ pmol/kg Körpergewicht" so bearbeiten, dass zahlen immer als Ziffern geschrieben werden, wenn sie vor der Maßeinheit stehen (und ich nicht sowieso grundsätzlich alle Zahlen immer als Ziffern schreiben will).

Damit Dragon NaturallySpeaking in einem Ausdruck wie "drei bis 4 cm" das Wort drei korrekt als Ziffer und "bis" als "-" schreibt, lässt sich über die Funktion "Eigenschaften" das Wort "bis" mit der alternativen Form "-"versehen. Diese alternative Form soll nur dann gebraucht werden, wenn vorher eine Zahl diktiert wurde.

Natürlich sind hier verschiedene Möglichkeiten, je nach Kontext, möglich. Leider können aber verschiedene Formatierungen nicht miteinander kombiniert werden; diese wird vielleicht in späteren Versionen der Software einmal der Fall sein.

15 Mai 2008

Tipps und Tricks: Zahlenformatierung

So erreicht man in Dragon NaturallySpeaking 9.5, dass Zahlen von null bis neun immer als Ziffern geschrieben werden, unabhängig vom Kontext:

Unter "Vokabular bearbeiten" ruft man sich jedes einzelne Zahlwort auf und bearbeitet die Eigenschaften so:

- Alternative Schreibweise: hier die Ziffer eingeben
- Abstände/Groß- und Kleinschreibung: "verbindet 2 Elemente mit dieser Eigenschaft" wählen

Zahlen werden jetzt unabhängig vom Kontext immer als Ziffern geschrieben, eine Reihe von Zahlen - z.B. eine Telefonnummer - wird ebenfalls korrekt geschrieben, das heißt ohne Lehrstellen zwischen den einzelnen Ziffern.

Anm.: Nicht beseitigt wird dadurch der Fehler, dass bei einem Datum mit nachfolgendem Punkt das Datum falsch geschrieben wird, also zum Beispiel "15.05.2000 8." anstatt "15.05.2008." - hier muss man eine Pause zwischen dem Datum und dem Punkt machen, damit das Datum korrekt geschrieben wird.


Wichtig: auch die groß geschriebenen Zahlwörter müssen mit diesen Eigenschaften versehen werden, ansonsten wird am Anfang eines Absatzes eine Zahl weiterhin als Wort geschrieben.

Richtig: 5 Wochen
Falsch: Fünf Wochen

Da mit diesen Einstellungen Zahlen immer als Ziffer geschrieben werden, sollte man sich überlegen, ob man wirklich diesen Weg geht - der Duden sieht als Standard vor, dass die Zahlwörter bis 10 ausgeschrieben werden, wer sich nach diesem Standard richten will oder richten muss, sollte eine Alternative dazu wählen:

Um die Zahlen von 0-9 nur im Kontext von anderen Zahlen als Ziffern zu schreiben (z.B. bei Postleitzahlen), gehen Sie so vor wie oben beschrieben. Setzen Sie aber zusätzlich in den Eigenschaften unter "Alternative Schreibweise" noch einen Haken vor "Immer alternative Schreibweise verwenden nach einer Zahl" und wählen Sie "Abstände - ohne Leerstelle".

Nuance liefert für DNS 9.5 folgende Hinweise zum Standard-Verhalten von Zahlen, die man sich natürlich auch angewöhnen kann:

Zur Eingabe von fünf- oder mehrstelligen Zahlen im Standardmodus möchten wir Sie auf die unterschiedlichen Eingabemöglichkeiten und die daraus resultierenden Zahlendarstellungen hinweisen:

1. "Direktes" Diktat der Zahl liefert als Ausgabe die Zahl formatiert mit Tausendertrennzeichen, z.B. "dreiundsiebzigtausendfünfhundert" - "73.500"
2. Eingabe der Zahl durch Diktieren von Ziffern liefert dies als Fließtext, z.B. "sieben drei fünf null null" - "sieben drei fünf null null"
3. Eingabe der Zahl durch Diktieren von Ziffern gefolgt von "Schreib das als Zahl" liefert diese als Ziffern getrennt durch Leerschritte, z.B. "sieben drei fünf null null" "Schreib das als Zahl" - "7 3 5 0 0"
4. Eingabe der Zahl durch Diktieren des Wortes "Ziffer" gefolgt von den Ziffern liefert die Zahl ohne Formatierung, z.B. "Ziffer sieben drei fünf null null" - "73500" 5. Eingabe der Zahl durch diktieren des Wortes "Nummerierung" gefolgt von den Ziffern liefert die Zahl ohne Formatierung, z.B. "Nummerierung sieben drei fünf null null" - "73500"
Bitte beachten Sie, dass im Zahlenmodus die letzten beiden Möglichkeiten nicht zur Verfügung stehen und die zweite Möglichkeit als Ergebnis "7 3 5 0 0" liefert.
Für weitere Möglichkeiten zur Eingabe von Zahlen und Ziffern bitten wir Sie, sich auf das Kapitel "Zahlen diktieren" in der Online-Hilfe zu beziehen.


Dies als Update zu diesem Beitrag.

FAZ-Bericht über Olympus-Recorder

Im Zusammenhang mit dem FAZ-Test des Olympus-Aufsteckmikrofons hatte ich bereits darauf hingewiesen, dass Olympus auch hochwertige Recorder herstellt, die die technischen Werte eines Diktiergerätes bei weitem überschreiten. Bevor jetzt alle Diktierer anfangen, bessere Tonqualität einzufordern, sei allerdings darauf hingewiesen, dass es sich hierbei um mehr oder weniger professionelle Aufnahmegeräte zum Beispiel für Interviews, Musik und anderes handelt, die auch in den entsprechenden Branchen vermarktet werden. Während die Aufnahmequalität dieser Recorder CD-Qualität hat, fehlen wichtige Sachen, wie z.B. Zurückspulen, Überschreiben und Einfügen einzelner Passagen und dergleichen mehr, die für einen Diktanten relevant sind. Demgegenüber steht die Qualität der Aufnahme bei einem Diktiergerät nicht besonders weit oben auf der Prioritätenliste - digitale Aufnahmen sind grundsätzlich besser als Tonbänder, und mit dem neuen DSS pro-Standard bleiben für eine Sprachaufzeichnung, die geschrieben und danach weggeworfen wird, eigentlich keine Wünsche offen, was die Aufnahmequalität betrifft.

Vorgestern testete die FAZ dann das in diesem Zusammenhang auch schon von mir erwähnte Olympus LS 10, und zwar genau im Hinblick auf die Aufnahmequalität von Musik und Interviews hin. Wer möchte, kann den Artikel bei mir beziehen, E-Mail an stephan.kuepper [at] 4voice.de genügt. Aber wie gesagt - die Zielgruppe ist eine andere, wie mir am selben Tage eindrucksvoll vor Augen geführt wurde: nämlich durch eine ganzseitige Anzeige im neuen Katalog des Sound and Drumland. Dort gibt es das Gerät übrigens für 399 € zu kaufen, empfohlener Preis bei Olympus ist 449 €.

08 Mai 2008

Sprachmakros für Windows Vista

Das Blog speech @ microsoft veröffentlicht die Beta-Version von Sprachmakros für Windows Vista. Eine recht ausführliche Beschreibung findet sich in Rob Chambers' Blog, d.i. der Teamleiter Speech Recognition. Zeit, den Vista-Rechner zu aktivieren und mit der Arbeit zu beginnen - die Vista-Spracherkennung beginnt gerade nützlich zu werden. Wenn es auf Deutsch funktioniert...

07 Mai 2008

Schnurlose Spracherkennung - Übersicht

Da mich in letzter Zeit immer wieder Fragen erreichen, hier meine Tipps zum Thema Schnurlose Headsets und Eingabegeräte.

Für Spracherkennung gibt es derzeit zwei geeignete schnurlose Headsets, das Plantronics CS 60 USB und das Jabra GN9330 bzw. GN9350. Das Jabra GN 9350 hat gegenüber den anderen Geräten den Vorteil, dass es sich außerdem an das Telefon anschließen lässt und es somit erlaubt, mit dem selben Gerät zu diktieren und zu telefonieren. Preis und Qualität der Spracherkennung sind bei Plantronics und Jabra praktisch gleich; wegen der Telefon-Funktion ist das Jabra GN 9350 ca. 120 EUR teurer. Die ungefähren Preise (inkl. Mwst.):

  • Plantronics CS60 - ca. 320 EUR
  • Jabra GN9330 - ca. 320 EUR
  • Jabra GN9350 - ca. 440 EUR

Bestellen kann man sie z.B. hier (auf "Funkheadsets" klicken).

Preislich unschlagbar ist natürlich die Dragon NaturallySpeaking Wireless-Version, ein Dragon Preferred mit beigelegtem CS 60, das für ca. 300 EUR erhältlich ist. Mein Tipp für Einsteiger, aber auch das ebste Preis-Leistungs-Verhältnis für alle, die ein Wireless-Headset suchen!

Die Entscheidung für ein Modell kann ich Ihnen nicht abnehmen - letztlich ist es, wie immer, eher eine Frage des persönlichen Geschmacks als der Technik. Daher kann ich im weiteren auch nur für mich sprechen (aber dazu ist ein Blog ja da):

Ich selbst arbeite derzeit mit dem Jabra GN 9350 und bin sehr zufrieden - das Headset ist leicht und bequem, Probleme sind bisher nicht aufgetreten und auch von Kunden nicht bekannt, der Akku hält einen Arbeitstag lang durch (auch wenn ich empfehle, ihn während der Mittagspause aufzuladen), nur zu Umschalt-Funktion zum Telefon kann ich leider nichts sagen, weil ich kein geeignetes Telefon habe. Wenn man wie ich Voice over IP und privat schnurlose Handgeräte benutzt, ist es eben nicht möglich, das Headset zwischen Telefon und Hörer einzuschleifen.

Schnurlos arbeitet außer den genannten Headsets nur noch das Revolabs Solo Desktop-Ansteckmikrofon, das ebenfalls eine hervorragende Qualität der Erkennung bietet - wenn es möglichst weit oben am Hemd befestigt wird und man den Kopf beim Diktieren nicht bewegt. Abweichungen von der korrekten Haltung bestraft es leider sehr schnell.

Das Grundig Digta Cordex, ein schnurloses Handmikrofon, soll demnächst nun wirklich auf den Markt kommen; Dictanet bietet außerdem ein proprietäres Gerät an, das aber für Spracherkennung nur bedingt geeignet ist und außerdem die Dictanet-Software benötigt. Ein anscheinend baugleiches Gerät ist neulich mal in meinem Blickfeld aufgetaucht; vielleicht werden ja inzwischen bessere Komponenten verbaut. Zur Software weiß ich nichts. Weitere Lösungen aus dem Musikbereich sind bei technisch versierten Diktanten im Einsatz, dies sind aber m.W. nur vereinzelte Anwender.

Die Erkennungsgenauigkeit ist inzwischen bei den schnurlosen Headsets genauso gut wie bei den schnurgebundenen. Ein schnurloses Headset ist für mich aber immer nur im Büro einsetzbar, weil ich immer eine Basisstation an den Rechner anschließen muss. Wenn ich mit einem Notebook viel unterwegs bin, möchte ich dieses Gerät nicht mit schleppen müssen (damit dann im kritischen Moment die Batterie leer ist); hier würde ich also auf jeden Fall zu einem schnurgebundenen Headset raten.

Hier empfehle ich das VXI Parrott TalkPro-Headset, das ich an meinem Testrechner und als Back-up einsetze. Meine Erfahrungen finden Sie, wenn sie in den letzten Notizen nach "Parrott" suchen oder einfach folgenden Link anklicken: http://voiceberlin.blogspot.com/search?q=parrott. Bestellen können Sie das VXI Parrott TalkPro USB-Headset hier.

Bluetooth-Headsets sind dagegen für Spracherkennung nicht wirklich geeignet, da der Bluetooth-Standard keine ausreichende Übertragungsqualität gewährleistet. Einzige Ausnahme: das BlueParrott-Headset, und auch nur dann, wenn das Notebook Bluetooth eingebaut hat. Das Headset ist gut, aber mit dem Geräteanschluss durch Bluetooth hatte ich immer nur Ärger - übrigens unabhängig vom Gerät genauso mit Mäusen, Tastaturen und anderen Geräten.

Soweit zu den von mir getesteten Geräten. Ich freue mich über Erweiterungen meines Horizontes - wer von den Lesern hat eine Empfehlung? Nutzen Sie die Kommentar-Funktion oder mailen Sie an stephan [at] soldatkuepper.de!

30 April 2008

FAZ-Bericht über Olympus-Aufsteckmikrofon

Am 29.4. berichtete Michael Spehr in der FAZ über das Olympus ME-12 Aufsteckmikrofon für Diktiergeräte, das Nebengeräusche sehr effektiv ausfiltert und damit nach seinen Angaben die Spracherkennungsgenauigkeit beim Diktat im Auto von 80-90% auf 98 % steigert. Für viele Diktierer sicher ein großer Nutzen!

Das Gerät selbst ist gar nicht so neu, aber das ist schließlich kein Hindernis für eine Berichterstattung. Wer es moderner liebt: Ein Kollege weist mich darauf hin, dass es inzwischen weitaus bessere Aufnahmesysteme von Olympus gibt, die allerdings dann auch entsprechend viel kosten, oder aber zum Diktat nicht gedacht sind. Beispiele sind die derzeit leider nicht verfügbaren Olympus LS 10 und Olympus DS 50.

Wirklich beeindruckend fand ich aber den Einsatz des Testers, der mit Tempo 140+ im Rhein-Main-Gebiet über die Autobahn braust und dabei noch diktiert! Sehr hübsch auch das Foto zum Artikel, das das Olympus-Mikro auf einem Philips-Diktiergerät zeigt und solcherart beweist, dass es mit allen gängigen Geräten kompatibel ist.

Den Artikel bestellen Sie bei mir per E-Mail an stephan.kuepper [at] 4voice.de. Das Aufsteckmikro gibt es z.B. im 4voice-Shop für ca. 20 EUR.

11 April 2008

Testbericht: Olympus DS 5000

Das neue digitale Diktiergerät von Olympus, dass Olympus DS 5000, ist bisher noch gar nicht auf dem Markt erhältlich. Das hier von mir vorgestellt Gerät wurde mir vorab von der Firma Olympus zur Verfügung gestellt, um es auf der Messe zu benutzen und dort vorzuführen. Dafür herzlichen Dank!

Das Olympus DS 5000 zeichnet ausschließlich im DSS Pro-Modus auf. Dafür gibt es zwei Qualitäten, SP und QP. Ich habe denselben Text in beiden Qualitäten aufgenommen; die höhere Qualität gab tatsächlich eine bessere Wiedergabe. Die Spracherkennung der beiden Dateien gab allerdings ein nahezu identisches Ergebnis; interessanterweise war der in der höheren Qualität aufgenommenen Text etwas schlechter umgesetzt. Der Fairness halber muss ich sagen, dass ich die Spracherkennung nicht auf das Gerät trainiert habe, sondern einfach mein normales lokales Profil gewählt habe.

Das Design des Gerätes ist wie immer Geschmackssache, ich habe etwas gebraucht, um mich mit der Farbe der Metallteile anzufreunden. Die schwarze Gehäusefarbe stört nicht wirklich, die metallfarbenen Teile wirken allerdings, als wäre das Gerät schon einige Zeit in Gebrauch. Inzwischen finde ich es aber angenehm. Der Schiebeschalter liegt hervorragend in der Hand, auch ansonsten sind zahlreiche kleine Verbesserungen vorgenommen worden.

Ob man wirklich die ganzen Bedienelemente auf der Vorderseite braucht, sei dahingestellt. Jedenfalls lassen sich die wesentlichen Funktionen im Kontext aufrufen, und auch das Bedienfeld zum Vor und Zurückspulen ist intuitiv zu bedienen, die Tasten allerdings "für Chirurgenhände zu klein" (Zitat einer Dame, die vor einigen Jahren ein digitales Diktatmanagement in einem Krankenhaus eingeführt hat).

Das Gerät enthält fest eingebaut ein Mikro-SD-Karte, außerdem eine herkömmliche SD-Karte als Wechselspeicher. Dies führt dazu, dass sich beim Anschluss des Gerätes gleich zwei Windows Explorer-Fenster öffnen, weil es als doppelter Wechseldatenträger erkannt wird. Im Gerät ist einstellbar, ob es als Wechseldatenträger oder als USB-Gerät fungieren soll.

Viele Verbesserung liegen im Detail, so z.B. in dem doppelten Speicher, der wirklich bequemen Ladestation, die sich mit einer Hand bedienen lässt und nicht mit der anderen Hand festgehalten werden muss, dem USB-Anschluss, der jetzt auch den Standards genügt, der leicht zu wechselnden Karte, dem neugestalteten Schiebeschalter usw. Olympus schließt mit diesem Gerät zu den neuen Modellen von Philips und Grundig auf, welches Gerät man bevorzugt, ist jetzt wieder mehr denn je Frage der persönlichen Vorlieben.

Nuance-Sonderaktion: Dragon-Testversion beim Kauf eines Plantronics Headset

Tipp aus der Voice Community:
Mit dem Kauf eines .Audio 310 oder .Audio 610 USB-Headsets von Plantronics haben Kunden noch bis Jahresende die Möglichkeit, die Spracherkennungssoftware Dragon NaturallySpeaking 9 kostenlos zu testen. Dies haben die beiden Hersteller Plantronics und Nuance im Rahmen einer strategischen Partnerschaft vereinbart. Die Kunden erhalten beim Kauf des Plantronic Headsets einen Code, mit dem sie die Testversion unter www.nuance.co.uk/plantronics kostenlos herunterladen und 15 Tage lang ausprobieren können. Danach können sie die Spracherkennungssoftware zu einem vergünstigten Preis erwerben.


Meine Neugier war nicht so groß, dass ich alles stehen und liegen gelassen hätte, um den Link auszuprobieren, aber neulich war es so weit: auch ohne Code kann man sich dort immer noch für die Testversion registrieren und sie herunterladen - zunächst nur eine kleine EXE-Datei von 385 KB, die dann einen Download Manager startet. Der ganze Download hat 250 MB.

Mein Augenmerk lag weniger auf dem Test der Spracherkennung - die funktioniert nicht schlechter als in anderen Versionen - als auf den Features der Standard. Hier muss ich sagen, dass ich nur die Eischätzung meines Kollegen Stefan Osterland bestätigen kann, der die Standard als "kostenpflichtige Demoversion" bezeichnet. Alles, was mir aus der Preferred (ca. 200 €) und Professional (ca. 800 € netto) liebgeworden ist, geht in der Standard nicht, angefangen mit dem Diktat außerhalb von DragonPad und MS Word bis hin zur raschen Vokabularbearbeitung und Befehlserstellung. Umsetzung vom Diktiergerät und Diktat auf Englisch kann man zu einem Ladenpreis von 69 € sowieso nicht erwarten.

Wer also schon immer mal probieren wollte, wie sich Spracherkennung anfühlt, kann sich 14 Tage lang mit der Standard beschäftigen und dann auf eine anständige Version umsteigen - Dragon NaturallySpeaking Preferred für Heimanwender, Dragon NaturallySpeaking Professional für Profis. Ich hoffe nur, dass jetzt nicht wieder eine Flut von "Spracherkennung funktioniert doch gar nicht"-Artikeln in den Medien folgt. Spracherkennung schlecht zu machen ist noch einfacher als sie gut zu machen, und liest sich allemal flotter, ob berechtigt oder nicht - siehe diesen Eintrag.

Foren: Nachtrag

Nachtrag 11.4. zu meinem Beitrag über das alte Nuance Forum und seine Alternativen, nach Rücksprache mit den beiden deutschen Dragon-Verantwortlichen:

Gleichzeitig zu dem inkriminierten Download-Link wurden im Forum irgendwelche Sex-Links gepostet. Weil das Forum zwar von deutschen Nuance-Mitarbeitern gelesen, aber von Amerika aus verwaltet wurde, war das Monitoring des Forums sehr weit unten auf der Prioritätenliste, und so wusste man sich nicht anders zu behelfen als es abzuschalten. Das belegt zwar (entgegen anderslautenden Gerüchten), dass das Forum durchaus von Nuance gelesen wurde, auch wenn der Hersteller viele angesprochene Probleme nie einer Lösung zugeführt hat, aber auch, dass Deutschland offenbar weit unten auf der Prioritätenliste steht (s. auch diese deutsche Forumsdiskussion und diesen Thread in einem amerikanischen Forum).

Im deutschsprachigen Raum gibt es neben diesem Blog diese ernstzunehmenden Anlaufstellen:

  • das OASA-Forum von Willy Sander

  • eine Yahoo-Newsgroup "Dragonanwender"


  • - wobei viele Beiträger identisch sind.

    Wer Hilfe vom Doktor persönlich möchte, der schreibt mir am besten direkt an stephan [at] soldatkuepper.de!

    10 April 2008

    FAZ-Bericht über Philips Diktiersystem

    Wegen der Conhit-Messe in Berlin komme ich erst am Tag nach Erscheinen des Artikels in der FAZ dazu, auf den jüngsten Test eines digitalen Diktiersystems hinzuweisen: Michael Spehr berichtet über das Philips Digital Pocket Memo 955. Dabei handelt es sich um ein System zur Aufzeichnung von Konferenzen mit (wahlweise) einem Aufsteckmikrofon oder bis zu 6 Kontaktflächenmikrofonen auf das digitale Diktiergerät DPM 955, das dem DPM 9370 täuschend ähnlich sieht, aber über keine Funktionen zum Einfügen etc. verfügt. In einer Konferenz werden diese Funktionen auch nicht benötigt, so dass sie niemandem fehlen werden. Damit bietet nun auch Philips eine einfache, handhabbare Lösung zur Aufzeichnung von Interviews und Sitzungen an.

    PDF-Versionen des Artikels sende ich gern auf Anfrage.

    Ich selbst habe (endlich) ein Grundig DigtaSonic 420 und (schon) ein Olympus DS-5000 im Test, die ich in den nächsten Tagen hier genauer unter die Lupe nehmen werde - beides allerdings keine Konferenzgeräte, sondern digitale Diktafone für den professionellen Einsatz. Stay tuned!

    Mailboxbotschaft per Software von Ton in Text verwandeln

    Ist dies Nuance's Antwort auf Spinvox? - fragt mich einer meiner treuesten Leser.

    Möglicherweise ist sie das, aber - Spinvox hat einen fertigen Dienst, Nuance nur ein Produkt.

    Weitere solcher Dienste werden kommen. Zumindest der Voicemail-Dienst von Spinvox ist genial, der SMS-Dienst ausbaufähig (ich würde gern SMS an jeden meiner Kontakte per Sprache senden können, nicht nur an eine vordefinierte Liste). Ich empfehle weiterhin jedem den Test.

    (Mit Dank an Ronny Jaekel)

    31 März 2008

    BBC NEWS über Spinvox

    Über Spinvox habe ich hier schon einige Male berichtet - im wesentlichen handelt es sich um einen Dienst, den man vom Handy anrufen kann, um eine gesprochene Botschaft in Text umsetzen zu lassen. Das funktioniert sehr gut mit SMS und Mailbox, nicht ganz so gut mit Blog-Einträgen und Notizen.

    Einen Hintergrundbericht zu dieser Technik gibt es jetzt auf der BBC-Website - immerhin handelt es sich um eine britische Technologie. Dort ist zum Beispiel auch zu erfahren, dass das System in Fällen, in denen die Spracherkennung meint, ein Wort nicht zu verstehen, um menschliche Hilfe bittet.

    In Deutschland scheint man noch nicht so weit zu sein, denn zumindest die Nachrichten auf meiner Mailbox weisen gerade bei Eigennamen meistens Lücken auf. Da aber der Absender angezeigt wird, ist das im praktischen Einsatz nicht weiter tragisch. Ich würde mir jedenfalls wünschen, dass viel mehr Leute auf meine Mailbox sprechen und nicht so ungeduldig sind, nach dem fünften Klingeln abzubrechen und mich zurückrufen zu lassen.

    Wer sich anmelden will, um den Dienst selbst zu nutzen:

    www.spinvox.com

    (mit Dank an Michael Spehr)

    20 März 2008

    Anlaufstellen für Fragen zur Spracherkennung

    Weil mich in letzter Zeit immer mal wieder Fragen zum alten Scansoft-Dragon-Forum erreichen:

    das Forum wurde abgeschaltet, als dort der Link zur Dragon 9.5 Update gepostet wurde - wohl der letzte Tropfen, der das Fass zum Überlaufen brachte, denn die Diskussion der Merkwürdigkeiten unseres geliebten Drachen hielt man wohl nicht unbedingt für die beste Werbung.

    Die Reaktion kam insofern überraschend, weil der Hinweis, Nuance könne sich die Beiträge mal lesen und ggf. Abhilfe bei immer wieder diskutierten Bugs schaffen, sich durch alle Beiträge des Forums zog - ohne dass darauf jemals eine Reaktion gekommen wäre. Auch eine Art der Kundenkommunikation.

    Folgt man dem alten Link, wird man aufgefordert, ein Passwort anzugeben. Das Passwort ist ein Ablenkungsmanöver. Ich hatte eines, das hier aber nicht gilt.

    Im deutschsprachigen Raum gibt es neben diesem Blog als ernstzunehmende Anlaufstellen:

  • das OASA-Forum von Willy Sander

  • eine Yahoo-Newsgroup "Dragonanwender"


  • - wobei viele Beiträger identisch sind.

    Wer Hilfe vom Doktor persönlich möchte, der schreibt mir am besten direkt an stephan [at] soldatkuepper.de!