29 Januar 2008

FAZ-Bericht über Spinvox Voicemail

"Die Frankfurter Allgemeine Zeitung berichtet heute über den Voicemail-Dienst von SpinVox, bei dem eine aufgenommene Voicemail, also eine Ansage auf der Mailbox, automatisch in geschriebenen Text umgesetzt wird und per SMS an Handy gesendet wird. Anstatt die Mailbox abzuhören, kann man einfach die SMS lesen. Das tolle ist, es funktioniert."

spoken through SpinVox



Jetzt spreche ich mit Dragon NaturallySpeaking weiter, weil der Blog-Dienst von Spinvox nämlich eine Aufzeichnung nach einer halben Minute abbricht:

Bis jetzt habe ich wirklich gute Erfahrungen mit Spinvox gemacht, vor allen Dingen mit der Voicemail und dem SMS-Dienst. Auch ein Memo kann über das Telefon aufgenommen werden und als E-Mail an eine vordefinierte Adresse verschickt werden; hier gilt aber ebenfalls die Beschränkung auf 30 Sekunden, was für mich zu wenig ist. Egal, man spricht einfach mehrere Memos auf.

Das übliche, nämlich die Eigennamen, machen Schwierigkeiten; ansonsten ist aber die Erkennung praktisch hundertprozentig. Und das bei wirklich schlechten Voraussetzungen: Eingabe über das Telefon, keine spezifische Diktier-Intonation und dergleichen mehr.

Respekt, das hat Spinvox wirklich gut hingekommen!

Abgesehen von der reinen Empfehlung liefert der Artikel interessante Hintergrund-Informationen. Empfohlene Lektüre, und wer heute die FAZ nicht kauft, schickt wie gewohnt einfach eine E-Mail an stephan.kuepper [at] 4voice.de und ich sende eine Kopie als PDF-Datei.

24 Januar 2008

MacDragon

MacSpeech ist Eingeweihten bekannt als Anbieter einer Spracherkennung (iListen) für Apple MacIntosh-Computer, die qualitativ gar nicht mal so schlecht war (als ich sie vor nunmehr 3 Jahren mal getestet habe, war sie ungefähr auf dem Niveau von Dragon NaturallySpeaking 7).

Jetzt lizensiert Nuance seine Dragon NaturallySpeaking-Technologie an Macspeech. Will sagen: demnächst wird es Dragon NaturallySpeaking auch auf dem Mac geben! Das ist doch mal eine gute Nachricht für uns, die wir das Design der Geräte schon immer cool fanden, aber trotzdem nicht von Windows weg wollten, weil wir dann unseren geliebten Drachen nicht mehr zur Verfügung hätten.

Davon abgesehen bin ich gespannt, wie die Resonanz in der traditionell technikaffinen Mac-Gemeinde aussieht - wenn sich erst mal herumspricht, wie viel Spaß es macht, mit dem Computer zu sprechen, wird die Welle vielleicht wieder zurück schwappen, und mehr Leute werden sich für Spracherkennung begeistern - so wie Sie und ich jetzt schon :-)

Der Name für das Produkt steht auch schon fest: MacSpeech Dictate (nicht unbedingt der Gipfel an Kreativität). Für verschiedene Dialekte des Englischen (ganz zufällig natürlich die, die auch in Dragon NaturallySpeaking enthalten sind) wird es das Produkt "bald" - angeblich ab dem 15.2. in den USA für 199 $ - zu kaufen geben. Ich bin gespannt auf die deutsche Version - vielleicht stellt mir die Firma ja mal einen von den coolen neuen Mac Airs zur Verfügung.

20 Januar 2008

Speaking Freely - bloggen vom Handy per Spracherkennung

"SpinVox Block. So nennen sich alle neue Lösungen die in der letzten Zeit durch ___ Pressemitteilungen gingen und im Internet auftauchte. Man spricht v. einer Blockbeitrag(?) einfach in sein Handy zwar sind die auf eine Mailbox und auf einem Server der Spracherkennung das gesprochene in geschriebenen Text verwandelt und im Block veröffentlicht."

spoken through SpinVox



Das sollte heißen:
Spinvox Blog - so nennt sich eine neuen Lösung, die in der Letzen Zeit durch mehrere Pressemitteilungen ging und im Internet auftauchte. Man spricht seinen Blogbeitrag einfach in sein Handy praktisch wie auf eine Mailbox und auf einem Server wird per Spracherkennung das Gesprochene in geschriebenen text verwandelt und im Blog veröffentlicht.

Schon nicht schlecht, oder? V.a. wenn man die Anzahl meiner Tippfehler beachtet. Dragon erkennt zwar besser, aber nicht durch das Telefon. Großer Nachteil ist jedoch die Beschränkung auf eine Minute - das reicht mir nicht für einen Beitrag.

Trotzdem: Der Service rockt. Sehr cool die Möglichkeit, eine Mailbox einzurichten, die alle Anrufe aufzeichnet, transkribiert und als SMS auf das Handy schickt. SMS zu diktieren geht auch schon mit einem kleinen Trick (Spinvox Blast), und schließlich kann man sich selbst ein Memo schicken, das allerdings auch nur eine Minute lang sein darf. Ich bin recht begeistert und werde den Service nutzen; wer ihn ausprobieren will, kann sich unter www.spinvox.com kostenlos registrieren. Im Moment fallen höchstens Telefongebühren an; da der Server über eine deutsche Festnetznummer errreichbar ist, sind die in meiner Flatrate schon enthalten :-)

10 Januar 2008

Beim Diktieren sollst du...

- ins Mikrophon sprechen und nicht in das Display oder den Lautsprecher an deinem Diktiergerät
- das Diktiergerät nicht direkt unter die Nase halten und sich dann über die lauten Atemgeräusche wundern
- den Abstand zwischen Mund und Mikrophon einigermaßen konstant halten
- das Diktiergerät so halten, dass die Finger auch tatsächlich die Tasten erreichen können
- keine Äpfel essen.

Fünf Erkenntnisse aus ein und derselben Klinik. Wie mag es erst woanders aussehen?

11 Dezember 2007

Orégano!

Ein Autor von Kochbüchern wird das Wort "Oregano" mit größerer Wahrscheinlichkeit benutzen als ein Rechtsanwalt.

Wie oft habe ich diesen Satz schon während des Dragon-Trainings gehört und mich gefragt, wer Recht hat: die Mehrheit, die "Oregano" auf dem A betont, oder die Minderheit, die das E betont?

Als ich meine Nudelsosse würzte, beschloss ich, es nachzuprüfen, und siehe da, der Duden sagt eindeutig: Orégano, mit Betonung auf dem E.

Was nur zeigt, dass die Mehrheit (und ich) nicht immer Recht hat.

06 Dezember 2007

Artikel: Diesen Artikel hat ein Computer geschrieben - WELT ONLINE

Diesen Artikel hat ein Computer geschrieben - Nachrichten Webwelt - WELT ONLINE

- meinen Kommentar dazu hat auch ein Computer geschrieben, und ich habe ihn mit Spracherkennung diktiert. Im Unterschied zum Journalisten kann ich aber damit umgehen.

Wieder ein Artikel aus der Serie " Technik-Journalisten müssen sich ihren Lebensunterhalt irgendwie verdienen, auch wenn ihnen das Thema tendenziell fremd ist".

Wie langweilig.

27 November 2007

FAZ, 27.11.2007: Spracherkennung als Erfolgsgeschichte

Die FAZ berichtet heute über das derzeit wohl größte Spracherkennungsprojekt Deutschlands: die Ausstattung von ca. 900 Richtern im Lande Hessen mit Spracherkennung durch die 4voice AG.

Entstanden ist der Artikel bei einer Schulung, die ich vor ein paar Wochen gehalten habe. Bei diesen Schulungen werden Richter als Multiplikatoren ausgebildet, die dann in ihren Dienststellen das Training und die Schulung weiterer Richter durchführen sollen.

Dort nahm man kein Blatt vor den Mund: Spracherkennung soll die durch massiven Personalabbau extrem gestiegene Belastung der sog. Serviceeinheiten (d.h. Schreibbüros) reduzieren, die Richter möglichst viel der anfallenden Arbeiten selbst erledigen. Dass dies nicht überall auf Gegenliebe stößt, ist zu erwarten; bei dem Schulungstermin wurde denn auch massiv Kritik geübt.

Allerdings zeigte sich eben auch, dass eine gute Schulung notwendig ist, um Spracherkennung gewinnbringend einzusetzen. "Vokabular und Schulung sind entscheidend für die Akzeptanz" - heißt die Unterzeile, und man muss kein Dragon-Dienstleister sein, um das unterschreiben zu können. Denn dann...

stellt sich [...] ein Aha-Erlebnis ein: Schulungsleiter Stephan Küpper diktiert ganze Absätze fehlerfrei, ohne jede Schummelei. Wir haben viel gelernt an diesem Tage, obwohl Dragon bei uns seit Jahren im Einsatz ist. Und man sollte auf eine solche Schulung durch Profis nicht verzichten. Nun trauen sich etliche Teilnehmer, ihre positiven Erfahrungen zu schidern. Ein Richer ist mit Dragon sehr zufrieden und beschreibt den immensen Gewinn an Freiheit, und damit meint er die Unabhängigkeit von den Launen des Schreibbüros. Jetzt könne er bis zum Fristende an der Akte arbeiten.

Dies, so sei hinzugefügt, ist kein Einzelfall. Andere Richter loben, dass mit Spracherkennung die Akte nach dem Diktat tatsächlich abgeschlossen sei und nicht Wochen später noch einmal durchgesehen werden müsste - auch dies ein nicht zu unterschätzender Vorteil.

Schließlich zum Vokabular:

4voice hat für die einzelnen juristischen Spezialgebiete wie Arbeits- oder Familienrecht eigene Vokabulare von Linguisten mit bis zu 50.000 weiteren Einträgen herstellen lassen. Dazu wurden repräsentative Texte der Justizbehörden ausgewertet und beispielsweise alle Entscheidungen des Oberlandesgerichts Frankfurt in der Landesrechtsprechungsdatenbank komplett eingewiesen. Wer Dragon im Kaufhaus erwirbt und damit nur auf das Standardvokabular zurückgreifen kann, ist jedenfalls als Jurist falsch beraten. Auf die Feinheiten kommt es an: für einen Strafrichter oder Staatsanwalt sind Begriffe wie "Angeklagter" wichtiger als einen Zivilrichter, der mehr mit "Klägern" und "Beklagten" konfrontiert ist.

Wie immer: wer die FAZ nicht liest und heute nicht kaufen will, schreibe mir an stephan.kuepper [at] 4voice.de. Sie erhalten eine Kopie umgehend per E-Mail.

16 November 2007

Heiser!

Wirklich erstaunlich: während der ganzen Messe bin ich schwer erkältet und heiser. Trotzdem versteht Dragon mein Diktat so wie immer. Die Spracherkennung wird wirklich immer stabiler - ich bin mal wieder begeistert!

Was mich daran erinnert, dass ich vor kurzem einen chinesischen Arzt am Stand hatte, der sich einfach mein Mikrofon griff und losdiktierte - mit einer Genauigkeit, die so gut war wie meine, und trotz seines Akzents. Respekt!

Mondegreen (Wumbaba auf Englisch)

Heute morgen auf der Medica wollte ich meine Kollegen beeindrucken und ein wenig auf Englisch diktieren. Dies tue ich im wahren Leben nicht wirklich, habe aber für alle Fälle einen Benutzer angelegt.

Welcher Satz würde sich für diese Situation besser eignen als der Klassiker aus der Rocky Horror Picture Show: "I see you shiver with anticipation"? Spreche ich den Satz mit normaler Intonation aus, wird er wunderbar verstanden. Mit der herrlich zerdehnten Pause, die Tim Curry im Wort "antici - pation" macht, schreibt Dragon folgende köstliche Variante:
I see you shiver with aunties who patiently ...

Ist das nicht schön?

13 November 2007

Testbericht: Headsets in der c't

In der aktuellen c't, Heft 24/2007, befindet sich ein ausführlicher Test von Stereo-Headsets, eigentlich unter dem Gesichtspunkt Musik und Games, aber auch mit einer Sektion zum Thema Diktat. In den Test geht unter anderem der Audio-Assistent von Dragon NaturallySpeaking ein.

Überraschend gut bewertet wurden zwei Modelle, die mir bisher noch nicht aufgefallen waren: das Sony DR-260 USB zum Preis von 50 €, als einziges der getesteten Geräte mit einer Mikrophon-Lautstärkeregelung und einem Wert von 23 im Audio-Assistenten; sowie das Microsoft Lifechat LX-3000 zum Preis von nur 30 € und einem Wert im Audioassistenten von 22. Dies ist allerdings laut Test vom Sound "für Musik, Filme und Spiele ungeeignet".

Ich habe mich bis jetzt immer nur mit Mono-Headsets auseinander gesetzt, weil ich gerne ein Ohr während der Arbeit frei habe, um nötigenfalls auch mal telefonieren zu können, während ich hätte tragen. Wer aber beides sucht, Diktat und Musik, sollte sich den Test mal genauer ansehen.

Dass der Wert im Audio-Assistenten nicht alles ist, wissen meine geneigten Leser allerdings seit diesem Beitrag.

Tipps und Tricks: Wörter verteilen über das Custom-Verzeichnis

Wer mit mehreren Benutzern auf dem selben PC arbeitet, hat das Problem, dass er Wörter und Befehle von einem zum anderen Benutzer transferieren möchte. Zumindest geht es mir so: einige Sprachbefehle und zahlreiche Wörter (z.B. meinen Namen) benötige ich eigentlich in jedem Wortschatz, unabhängig davon, ob es mein Arbeits-Vokabular ist, ein medizinisches Vorführvokabular oder ein Testwortschatz.

Dragon NaturallySpeaking Professional 9 stellt ein Werkzeug bereit, welches sich Data Distribution Tool nennt. Man findet es im Programm-Menü unter "Start - alle Programme - Dragon NaturallySpeaking - Dragon NaturallySpeaking-Werkzeuge - Data Distribution Tool". Wer sich darein einarbeiten will, ist mit der Hilfe-Funktion ganz gut bedient. Wer technischer veranlagt ist, kann auch das NSAdmin-Werkzeug nutzen, was schon in älteren Versionen enthalten ist, allerdings nicht unbedingt den besten Ruf genießt.

Hier der Hinweis, wie man Befehle und Wortlisten auch ohne Data Distribution Tool ganz einfach verteilen kann:

Legen Sie folgendes Verzeichnis an:

C:\Dokumente und Einstellungen\All Users\Anwendungsdaten\Nuance\NaturallySpeaking9\Custom\deu

(Für Dragon NaturallySpeaking 9 unter Windows XP)

Exportieren Sie alle benutzerdefinierte Wörter in einer Wortliste im Format TXT in dieses Verzeichnis. Am einfachsten geht das in Dragon NaturallySpeaking über das Menü "Wörter - exportieren" oder über den Sprachbefehl "Wörter exportieren". Fortgeschrittene Benutzer können dort aber natürlich auch eine eigene Wortliste erstellen, die exportierte Wortliste bearbeiten und dergleichen mehr.

Wird jetzt ein neuer Benutzer geöffnet, werden die Wörter aus dieser Wortliste in das Vokabular des neuen Benutzers importiert und erscheinen dort mit einem roten Stern als vom Benutzer neu hinzugefügte Wörter. Natürlich funktioniert das auch, wenn sich mehrere Benutzer denselben PC teilen. So können zum Beispiel zwei Ärzte in einer Praxis die Wörter, die sie hinzufügen, an den jeweils anderen weitergeben.

Achtung: wer Fachvokabulare einsetzt, exportiert unter Umständen sämtliche Wörter eines Fachvokabulars, nämlich dann, wenn diese Wörter als benutzerdefiniert mit einem roten Stern gekennzeichnet wurden. Das ist natürlich wenig zielführend, zumal das Sprachmodell nicht mit exportiert wird und daher ein neuer Benutzer mit den Wörtern alleine nicht viel anfangen kann.

[Edit:] Das gleiche funktioniert auch mit Befehlen, allerdings nur bei neu angelegten Benutzern. Um Befehle von einem vorhandenen Nutzer zu einem anderen vorhandenen zu transferieren, muss das Data Distribution Tool benutzt werden.

Um Befehle eines Users für alle anderen, in der Zukunft noch zu erstellenden User bereitzustellen, gehen Sie so vor:

Gehen Sie in das Befehlcenter von Dragon NaturallySpeaking über "Extras - Befehlcenter" oder sagen Sie einfach "Befehlcenter öffnen". Unter "Verwalten" haben Sie eine Liste aller verfügbaren Befehle. Markieren Sie die, welche sie exportieren wollen, und exportieren Sie sie ebenfalls in dieses Verzeichnis im Format DAT.

Wenn man routinemäßig neu hinzugefügte Wörter in dieses Verzeichnis exportiert, hat man seine benutzerdefinierten Einträge immer auf dem neuesten Stand. Dabei kann man die vorhandene Wortliste einfach überschreiben - Dragon NaturallySpeaking exportiert immer alle benutzerdefinierte Wörter, auch wenn sie vorher über eine Liste hinzugefügt wurden.

30 Oktober 2007

Fernsehbeitrag: Ratgeber Technik - Computer zum Diktat! - Möglichkeiten und Grenzen aktueller Spracherkennungssoftware

Am 27.3. lief im Ersten der ARD Ratgeber Technik mit einem Beitrag über "Computer zum Diktat! - Möglichkeiten und Grenzen aktueller Spracherkennungssoftware".

Erste Reaktion: Können die sich eigentlich mal einen anderen Titel für solche Beiträge einfallen lassen? "Computer zum Diktat" ist ungefähr so originell wie "Lufthansa-Aktie im Sinkflug". Nächste Reaktion: Lach- und Sachgeschichten für Erwachsene. Wie Computer und Sekretärin im Boxring gegeneinander antreten, ist für einen öffentlich-rechtlichen Sender grenzwertig. Aber egal, schauen wir auf den Inhalt -

- und da zeigt sich, dass der Tester das Expertenwissen eines, nun ja, Journalisten an den Tag legt. No offence meant, aber offenbar hat er sich mal ein paar Tage oberflächlich mit Spracherkennung auseinandergesetzt und dabei mehr Energie in die Präsentation gesteckt als in die Recherche. Dem geübten Auge entgeht z.B. nicht, dass er für die ersten beiden Tests betont langsam diktiert, um den Rechner dann mit einem - seiner Meinung nach extrem schnellen - Diktat aus dem Konzept zu bringen.

Ich kann dazu nur sagen: Abgesehen davon, dass ich keine Schlagertexte diktiere, spreche ich normalerweise so schnell wie er im "Härtetest" und habe eine sehr gute Erkennung. Wenn man aber beim Ablesen des Trainingstextes langsam liest und auch sonst langsam diktiert, wird eine Spracherkennung beim schnellen Sprechen Schwierigkeiten haben müssen - wie übrigens auch umgekehrt. Wenn ich schnell vorlese und danach langsam diktiere, erkent mein Drache mich auch nur halb so gut. Aber wie heißt es in dem Teil des Trainingstextes, der nur von uns Schnellesern erreicht wird: "Das wichtigste ist eine deutliche und konstante Aussprache. Versuchen Sie, Ihre Gedanken zu ordnen, bevor Sie mit dem Diktieren beginnen" - ein Rat, der übrigens für alle Textproduzenten gilt :-)

Ein Test der Rechtschreibung ist völlig am Thema vorbei. Wenn ich Kunden beeindrucken will, lasse ich den Computer "schwierige Wörter" erkennen. Wenn ich zeigen wollte, was die Spracherkennung nicht kann, nehme ich "einfache", alltägliche Wörter, die ähnlich wie andere häufige Wörter klingen - "einen" vs."einem" zum Beispiel.

Spracherkennung macht systembedingt keine Tippfehler! Ich habe schon Schreibkräfte gesehen, die das Dragon-Wörterbuch zum Nachschlagen benutzen. Natürlich muss das Programm die Wörter kennen - aber das ist bei einer Sekretärin auch nicht anders.

Und jetzt grundsätzlich: "Mensch gegen Maschine"-Kämpfe, erst recht gegen Spitzenleister, sind so alt wie die mAschinen. Ich erinnere nur mal an John Henry. Und dass die Sekretärin mit "jahrelanger Erfahrung" von der Software eingeholt wird, weist doch eher darauf hin, dass sie so gut ist wie eine Sekretärin - Training vorausgesetzt, von Spracherkennung, Diktant und Sekretärin. Insofern ist das Fazit der Sendung nur zum Schein beruhigend - der Mensch hat gewonnen, weil die Versuchsanordnung auf ihn abgestimmt war.

Und der zitierte Praxistest (im Begleittext) ist auch wenig aussagekräftig: wer aus genau einem Beispiel eine Regel herleiten will, hat wenig von Statistik verstanden. Da muss man schon mehr analysieren - aber wer tut das schon? Zugegebenermaßen hat außer den Herstellern keiner ein Interesse daran, und die werden nur eindeutig für sie positive Daten veröffentlichen.

Mein Fazit zum Beitrag lautet: wer nur konsequent die falschen Kriterien anlegt, erhält das schlechte Ergebnis, das er erwartet. Aber was erwartet man von jemand, der die Spracherkennung unter Vista erst gar nicht ans Laufen bekommt?

(Dank an Ronny Jaekel u.a. für Input)

25 Oktober 2007

Spezialmikrofon: Ohrwurm II

Der Ohrwurm II von Ohrwurm Audio ist ein Kunstkopf-artiges Mikrophon(schwer zu erklären - lieber selbst mal anschauen!), welches speziell für Aufnahmen mit Videokameras entworfen wurde, es liefert aber einen so lupenreinen Klang, dass ich ihn am liebsten mit Spracherkennung ausprobieren würde. Zwei hörgerätegroße Teile setzt man sich auf die Ohren, eine 3,5 mm-Klinke in die Kamera, Soundkarte o.ä. - und ab gehts. Sehr schön die Klangbeispiele, von Musik im Wohnzimmer über die Antarktis bis zum Bremer Weihnachtsmarkt.

Aufmerksam gemacht auf das Gerät wurde ich von einem Kunden, der es sich bestellt hat und jetzt mit Spracherkennung ausprobieren will. Ich bin gespannt, wie die Rückmeldung ist. Für 71 € kann man ja eigentlich nicht viel verkehrt machen.

21 Oktober 2007

Bill Gates liebt Spracherkennung

Aus dem Blog Rob's Rhapsody : Bill Gates talks about Speech Recognition -- again!:

Bill Gates scheint Spracherkennung zu lieben - er hat in einem Interview mal wieder darauf hingewiesen, und was ich interessant finde, ist, dass er uns Anwender zwar für nur einen kleinen Prozentsatz, aber trotzdem eine signifikante Zahl hält:

When you sell a product to hundreds of millions of users, there are features that millions of users love that you can call an obscure feature because, percentage wise, it's not very many.


Im Interview geht es mal wieder um die Spracherkennung in Vista sowie das letztlich veröffentlichte Sprachinterface für Windwos Live - leider nur in Amerika, aber kann ja noch kommen.

Ich sags doch - Spracherkennung macht Spaß und bringt Nutzen.

17 Oktober 2007

FAZ, 16.10.2007: "Ein Muss für jeden Dragon-Nutzer"

Dieser Artikel aus der FAZ von gestern (Dienstag, 16.10.2007) berichtet derart positiv über die Spracherkennungslösungen von 4voice, dass ich seit gestern damit beschäftigt war, Anfragen und Bestellungen zu bearbeiten - nicht dass ich mich beschweren würde, aber so komme ich erst heute Abend dazu, meine treue Leserschaft auf den Artikel hinzuweisen.

Weil es die FAZ von gestern heute nicht mehr zu kaufen gibt, sende ich eine Kopie des Artikels gerne an alle, die bei mir anfragen. E-Mail-Adresse: stephan.kuepper [at] 4voice.de.

Einige Auszüge gefällig? "Die perfekte Diktier-Software für den Profi... wir waren von Anfang an begeistert... die 4voice-Software ist genau das, was wir immer gesucht haben".

Glücklicherweise beruhigt sich der Artikel zwischendurch ein wenig und nennt auch Gründe: zum Beispiel die Möglichkeit, die Spracherkennung mit einem Handmikrophon mit einem Schiebeschalter zu steuern (z.B. ein Olympus DR-2000 oder ein Philips SpeechMike Classic); die Verwendung der 4voice Local als Ersatz für DragonDictate und das Diktierfenster, jeweils mit wesentlich mehr Möglichkeiten; Hintergrunddiktat, Umsetzung von Diktaten von einem digitalen Diktiergerät per Drag & Drop und dergleichen.

Natürlich bin ich stolz auf einen derart positiven Artikel - einerseits weil er das Produkt lobt, das ich seit einem Jahr verkaufe, andererseits auch, weil der Kontakt zum Autor über diese Netznotizen zustandegekommen ist.

Link zum Produkt nicht vergessen: im Shop unter  Http://s100202421.einsundeinsshop.de/

25 September 2007

Diktieren im Auto

In der FAZ von heute werden verschiedene Möglichkeiten besprochen, im Auto mit dem Handy oder dem Diktiergerät zu diktieren und Diktate von unterwegs, zum Beispiel per E-Mail von einem Smartphone, ins Büro zu senden. Dazu gehört auch die Philips-Software, die ich vor ein paar Tagen hier besprochen habe.

Der Redakteur, der mehrfach zitierte Dr. Michael Spehr, macht eine ganz richtige Bemerkung: im Moment sind die Kosten für die Übertragung prohibitiv. Und bezüglich der Philips-Software stellt sich ebenfalls die Frage, inwieweit man 100 € zuzüglich Mehrwertsteuer für eine Software ausgeben soll, wenn man die Diktate genauso gut als Anhang an eine E-Mail senden kann - und dann auch die Möglichkeit hat, Diktate zu versenden, die nicht mit einem Philips-Diktiergerät aufgenommen worden. Zumal Philips empfiehlt, die Software auf die Speicherkarte zu installieren und nicht auf das Gerät. Das heißt, man muss auf jeden Fall Speicherkarten wechseln, was je nach Handy auch nicht unbedingt die reine Freude ist. (Selbst wenn man die Software auf das Handy installiert - wie ich es ohne Probleme getan habe - muss man ja immer noch die Diktate per Speicherkarte übertragen.)

Ausgereift ist noch keine dieser Methoden. Was fehlt, ist entweder eine vernünftige Diktiersoftware für das Handy, die sich auch so bedienen lässt, dass es Freude macht, oder eine preiswerte Übertragungsmöglichkeit. Also eigentlich ein Diktiergerät mit eingebautem UMTS :-) aber ob der Markt das hergibt?

21 September 2007

Hinweis: neues Anwenderforum bei OfficeAutomation Sander

Das OfficeAutomation Sander - Anwenderforum ersetzt in Bälde das alte, wenig praktisch zu bedienende, aber dafür sehr hilfreiche Forum bei Forum Romanum. Das alte Forum lohnt sich noch als Referenz, aber posten werde ich nur noch im neuen :-)

Erste Mitteilungen gibt es auch schon.

Problemlösung: NaturallySpeaking kann keine weiteren Sprachdateien speichern

Diese Meldung erscheint, wenn man längere Zeit intensiv diktiert hat, insbesondere beim Diktat nach Microsoft Word.

Hintergrund: Dragon NaturallySpeaking speichert, wie bekannt, auch das Diktat als Audio-Datei. Diese Datei wird nun im Laufe der Zeit sehr groß (Faustregel: eine Minute Diktat entspricht einem Megabyte). Der Standardwert, wie viel Diktat gespeichert wird, liegt bei 40 MB. Gemeiner Weise lügt Dragon NaturallySpeaking, weil der Rest der Meldung nämlich lautet, dass das Diktat fortgesetzt werden kann - dann die Meldung aber alle 2 Sekunden wieder erscheint.

Es gibt mehrere Möglichkeiten, dieses Problems Herr zu werden:

Im Menü "Optionen - Daten" setzt man den Standard-Wert bei "für die Wiedergabe reservierter Speicherplatz" von 40 MB auf (z.B.) 200 MB, wenn man nämlich Wert darauf legt, dass das Diktat gespeichert wird. Wenn man diese Funktion überhaupt nicht benötigt, setzt man den Wert auf Null. Dann werden lediglich die jeweils letzten 100 Äußerungen temporär gespeichert.

Praktischer Wert dieser Funktion: hat man ein längeres Word-Dokument diktiert und will erst dann korrigieren, wenn der erste Entwurf fertig ist, lernt Dragon NaturallySpeaking dann und nur dann hinzu, wenn die Audio-Informationen noch verfügbar sind. Wenn sie nicht mehr verfügbar sind, weil der verfügbare Speicherplatz auf null gesetzt wurde, hat Dragon auch keine Chance mehr zu lernen. Wenn man also während des Diktates direkt die Fehler korrigiert, benötigt man diese Option nicht.

18 September 2007

DNS-Tipp: Nummerierung und Aufzählungen

  • "Nummerieren" nummeriert eine Reihe von Absätzen.

  • "Aufzählungszeichen" setzt Aufzählungszeichen vor einer Reihe von Absätzen

Um die Formatierung vorzunehmen, einfach die entsprechenden Absätze markieren und den Befehl sagen. Funktioniert, sobald der erste Absatz diktiert wird, man sagt "nummerieren" oder "Aufzählungszeichen", und dieser sowie alle folgenden Absätze wird fortlaufend nummeriert beziehungsweise mit den Zeichen versehen.
  • Der Befehl "Nummerierung" vor einer Folge von Zahlen sorgt dafür, dass diese Zahlen als Ziffern geschrieben werden. Dieser Befehl ist praktisch zum Beispiel beim Diktat von Postleitzahlen oder Telefonnummern in DNS 9.5, wo diese nicht automatisch richtig formatiert werden.

Spracherkennung im Bezirksamt Neukölln

Mein heimisches Bezirksamt Berlin-Neukölln, konkret: das Jugendamt (mit dem ich bisher nur wegen Kindergärten und Hortplätzen zu tun hatte) arbeitet seit neuestem mit Spracherkennung. Die Ausstattung mit dem System stammt von meinen ehemaligen Kollegen abitz.com Multilingual Software - Glückwunsch, Kollegen!

Leider ist der Artikel der Berliner Zeitung schlecht recherchiert. Weder ist das Neuköllner Jugendamt die "bundesweit erste Behörde, die mit einem Computerprogramm für digitale Spracherkennung arbeitet" - das Justizministerium Baden-Württemberg arbeitet seit Jahren damit, und das Justizministerium Hessen wurde vor zwei Jahren von der 4voice AG damit ausgestattet; ganz zu schweigen von anderen Gerichten wie dem Landesarbeitsgericht Berlin, in dem ich auch mal die Finger im Spiel hatte.

Sehr hübsch auch der Satz "die Neuköllner Firma Abitz hat das digitale Spracherkennung entwickelt und während der vergangenen sieben Monate in die Computer installiert" - ein Satz, der nicht nur die völlige Unkenntnis des Autors über Computer, sondern auch seine Schwierigkeiten mit der deutschen Sprache demonstriert. Auch ist nicht ganz erklärlich, warum "alle Mitarbeiter zu Beginn ihrer Schulung 25 Minuten lang ein Märchen vorlesen" mussten. Wenn ich direkt in den Computer diktiere, lese ich zum Training 7 Minuten, und zwar kein Märchen. Wenn ich ein Diktiergerät benutzt, bin ich mit 15 Minuten auch fertig. Wollen wir es der Unkenntnis des Autors zu Grunde halten.