SPRACHEINGABE AUF IHREM GERÄT / DEUTSCH / KEINE CLOUD
Sie sprechen. Es schreibt.
Es drückt sogar Enter.
Zählen Sie die Antworten, die Sie heute tippen. Und jetzt zählen Sie das Drücken von Enter. Sagen Sie Ihre Nachricht – sie erscheint in jeder Anwendung. Sagen Sie „senden senden“ und sie ist abgeschickt. Etwas Falsches gesagt? „verwerfen verwerfen“ nimmt es zurück. Ihre Hände kehren nie zur Tastatur zurück — und weder Ihre Stimme noch Ihr Text verlassen jemals Ihren PC.
Einmalkauf zum Einführungspreis von 110 € (inkl. MwSt.) — kein Abo, kein Konto. Probieren Sie zuerst die Demo oben aus.
Tippen Sie einen Satz und führen Sie „senden senden“ aus — oder tippen Sie 🎤 an und sagen es. Im echten Einsatz läuft alles über die Stimme; den Befehl sagt man zweimal, damit er nie versehentlich auslöst. (Das 🎤 auf dieser Seite nutzt die Spracherkennung Ihres Browsers , die Audio in die Cloud schickt — nur damit Sie das Gefühl bekommen. Das echte Kotocast erkennt alles auf Ihrem PC: nichts verlässt ihn.)
voice-input --status
Kommt Ihnen das bekannt vor?
Tippen, Enter. Tippen, Enter. Vierzig Mal am Tag.
Jede Antwort zieht Ihre Hände zurück zur Tastatur. Selbst beim Diktieren greifen Sie am Ende doch wieder hin, um Enter zu drücken — und ausgerechnet dieser eine Tastendruck nervt am meisten.
Nachrichten kommen genau dann, wenn Ihre Hände beschäftigt sind
Beim Kochen. Beim Blättern in Unterlagen. Mit dem Kaffee in der Hand. „antworte ich später“ häuft sich — und Sie sind in jedem Chat der Langsame.
Diktieren in der Cloud schickt jedes Wort auf fremde Server
Bequem — aber die Nachricht an Ihre Familie und das Arbeitsgespräch landen auf dem Server eines Fremden. Ihre Stimme ist weit persönlicher als das, was Sie tippen.
kotocast --features
Mit Kotocast
Schreibt in die Anwendung, die Sie gerade nutzen
Chat, E-Mail, Dokumente, Terminals. Ihre Worte gehen direkt in das aktive Fenster. Kein Plug-in, keine Einrichtung je Anwendung.
Die ganze Antwort per Stimme erledigen
Starten, senden, verwerfen, rückgängig, kopieren, einfügen, Bildschirmfoto, Texterkennung, Aufnahme — über 25 Befehle, alle gesprochen. Vom ersten Wort bis zur abgeschickten Nachricht berühren Ihre Hände keine Taste.
100 % auf Ihrem Rechner
Die Spracherkennung läuft vollständig auf Ihrem PC. Ihre Stimme und Ihr Text verlassen ihn nie. Ein einziger Modell-Download beim ersten Start — danach für immer offline.
Hält mit Ihrem Sprechen Schritt
Mit einer unterstützten GPU erscheint jede Äußerung in 0,2–0,35 Sekunden. Sie schreiben so schnell, wie Sie sprechen.
Sprachsprüche ── zweimal gesagt wird daraus ein Befehl. Einmal gesagt, in einem normalen Satz, löst er nie aus.
Dazu alles markieren, Tabulator, wiederherstellen, Texterkennung, Bildschirmfoto, Aufnahme ── über 25 Befehle. Alles per Stimme, keine Taste.
kotocast --why-it-never-misfires
Senden per Stimme, ohne Fehlauslösungen
Dieses Werkzeug ist in einem Satz erklärt: Sie sprechen, es schreibt, Ihre Stimme kann senden. Alles Schwierige kam nach diesem Satz — die langsame, unspektakuläre Arbeit dafür, dass nie etwas auslöst, was nicht auslösen soll.
Warum der Befehl „senden senden“ heißt — und nicht ein einzelnes Wort
Wir wollten ein sehr kurzes Wort. Die Spracherkennung verstand immer wieder etwas anderes. Manche Formulierungen verschwanden ganz. Also wurde jede Kandidatin von mehreren synthetischen Stimmen immer wieder vorgelesen, und nur die Wörter, die nie zerbrachen, kamen durch. Das sind nicht die Formulierungen, die uns gefielen. Es sind die, die überlebt haben.
Sagen Sie „schick ihr das bitte“ — es passiert nichts
Ein Befehl existiert nur als doppelt gesagte Formulierung wie „senden senden“ — eine Form, die in normaler Sprache nie vorkommt. Diktieren Sie den ganzen Tag Nachrichten über das Senden, Verwerfen oder Kopieren. Ihre Worte und Ihre Befehle können nicht kollidieren.
Beim Senden gibt es eine halbe Sekunde Karenzzeit
Die eine Aktion, die man nicht zurücknehmen kann, wird nicht sofort ausgeführt. Sagen Sie in diesem Moment „verwerfen verwerfen“, und das Senden wird abgebrochen. Ein Versprecher wird nie zu einer Nachricht, die Sie bereuen.
Wenn Sie nichts sagen, wird nichts geschrieben
Spracherkennungsmodelle erfinden bekanntlich aus reiner Stille fertige Sätze. Kotocast prüft die Sicherheit des Modells gegen und wirft diese Geister weg — Raumgeräusche und lange Pausen landen nie in Ihrem Chat.
kotocast --before-you-buy
Vier Fragen, die man jedem Diktierwerkzeug stellen sollte
Stellen Sie sie allem, was Sie in Betracht ziehen — auch diesem hier. Die Antworten entscheiden mehr als jede Funktionsliste.
| Die Frage | DIE ANTWORT VON KOTOCAST |
|---|---|
| Wo wird meine Stimme tatsächlich verarbeitet? | Auf diesem PC. Nichts wird übertragen — es gibt keinen Server, an den etwas ginge. |
| Was passiert in dem Monat, in dem ich aufhöre zu zahlen? | Nichts. Sie haben einmal bezahlt; es läuft weiter. |
| Funktioniert es auch ohne Netzwerk? | Ja. Nach dem einmaligen Modell-Download braucht es nie wieder Internet. |
| Brauche ich ein Konto, um das Gekaufte zu nutzen? | Nein. Ein Lizenzschlüssel, mehr nicht. |
# Wir nennen hier bewusst die Preise anderer Produkte nicht. Preise ändern sich, und eine veraltete Vergleichstabelle ist schlicht falsch. Stellen Sie diese vier Fragen selbst — sie entscheiden, wie sich ein Werkzeug in einem Jahr anfühlt.
git log --author=maker
Wer das baut, und warum
Keine prominenten Fürsprecher. Keine erfundenen Installationszahlen. Nur ein Entwickler, dem die Geduld mit der eigenen Tastatur ausging.
Der Entwickler, den andere Entwickler rufen, wenn etwas kaputtgeht
Im Job landen die verzwickten Probleme auf seinem Tisch. Dann ging ihm ein alltäglicher Ärger — tippen, Enter, tippen, Enter — endgültig auf die Nerven. Das ist kein Wochenendprojekt. Es ist alles, was er kann, gerichtet auf einen einzigen dummen Tastendruck.
Die langweiligen Teile haben die meisten Stunden bekommen
Überlebenstests für Formulierungen, doppelt gesagte Befehle, Karenzzeiten, Filter gegen erfundene Sätze. Die Stunden gingen in eine Zuverlässigkeit, die niemand sieht — das sagt mehr über den Entwickler als jede Biografie.
Er schreibt jede E-Mail damit
Chat, E-Mail, Arbeitswerkzeuge — per Stimme, den ganzen Tag, jeden Tag. Was für sein eigenes Postfach nicht gut genug ist, wird nicht ausgeliefert.
Offen entwickelt
Der gesamte Prozess ist öffentlich. Frühe Nutzerinnen und Nutzer steuern die Roadmap — Ihr „ich wünschte, es könnte X“ wird zur nächsten Version.
kotocast --who-its-for
Lehnen Sie sich zurück. Oder greifen Sie gar nicht mehr hin.
Gönnen Sie Ihrer Haltung eine Pause. Über die Tastatur gebeugt zu sitzen zehrt still am Körper. Lehnen Sie sich zurück, legen Sie die Hände ab, arbeiten Sie weiter — greifen tut Ihre Stimme. Manche, die es ausprobiert haben, sagen, dass lautes Formulieren sogar geordnet hat, wie sie denken.
Wenn Hände keine Option sind. Sehnenscheidenentzündung, Verletzung, Krankheit oder schlicht Erschöpfung — die Tastatur ist aus vielerlei Gründen außer Reichweite. Mit Kotocast schreiben und steuern Sie alles allein mit der Stimme; die Erfahrung bleibt dieselbe, in welchem Zustand Ihre Hände auch sind. Für alle, die möchten, und für alle, die müssen.
kotocast usage --meter
Es wird nicht teurer, je mehr Sie es nutzen.
Keine Tokens. Keine monatliche Rechnung. Keine Anmeldung. Sie zahlen einmal — und Ihr zehntausendster Satz funktioniert genau wie der erste. Ihre Stimme verlässt diesen PC nie. Es läuft auch ohne Netzwerk weiter.
kotocast license --pricing
Einmal kaufen. Es gehört Ihnen.
Für alle, die genug davon haben, Software zu mieten. Das ist der Einführungspreis — er steigt auf den regulären Preis, sobald eine bestimmte Anzahl verkauft ist.
Einmalkauf
regulärer Preis normal
110 € Einführungspreis
- Schreiben per Stimme + über 25 gesprochene Befehle + eigene Sprüche + Deutsch, Englisch, Japanisch und Französisch
- ★ Texterkennung für Bildbereiche — holt Text aus Bildern, PDFs und Fehlerdialogen an Ihren Cursor
- ★ Bildschirmfoto eines Bereichs — Rahmen ziehen, schon ist es in der Zwischenablage (der Rahmen bleibt sichtbar)
- ★ Bildschirmaufnahme eines beliebigen Bereichs — Start und Ende per Stimme
- Für immer Ihres + 1 Jahr Updates inklusive · größere Upgrades bleiben immer freiwillig
- Einmalige Aktivierung, vollständig offline — auch dabei werden weder Stimme noch Text gesendet
Keine Funktion zurückgehalten — alles in einem Preis. Ein Abo ist eine Rechnung, die jedes Jahr kommt, solange Sie es nutzen. Diese kommt einmal. Preis inkl. MwSt.
kotocast --check
Was zum Betrieb nötig ist
Bescheidene Anforderungen, und ein eingebautes --check sagt Ihnen vor dem Kauf, ob Ihr Rechner bereit ist.
- OS
- Windows 10 / 11 (64 Bit, x64) — Intel / AMD. Windows auf ARM (Snapdragon usw.) wird nicht unterstützt.
- Prozessor
- Jede moderne CPU — keine GPU erforderlich für den Betrieb
- GPU (optional)
- Eine NVIDIA-GPU macht es schnell — 0,2–0,35 s pro Äußerung (gemessen auf einer RTX 4070). Ohne GPU läuft es auf der CPU, nur langsamer.
- Speicher
- ~1,5 GB einmaliger Download des Sprachmodells — danach nichts mehr
- Internet
- Für den Betrieb nicht nötig. Nur der Modell-Download beim ersten Start nutzt das Netzwerk; danach ist alles offline.
- Sprachen
- Deutsch (Standard) + Englisch, Japanisch und Französisch auf gleichem Niveau, umschaltbar in den Einstellungen
- Einrichtung
- Herunterladen und starten — das eingebaute
--checkprüft Ihren Rechner in einem Schritt selbst - Lizenz
- Einmalkauf — kein Abo, kein Konto, es bleibt Ihres
- macOS
- DEMNÄCHSTEine Mac-Version steht auf der Roadmap — nachdem die Windows-Version Fuß gefasst hat.
man kotocast | grep -A2 "Q\."
Fragen, beantwortet
Geht meine Stimme wirklich nie in die Cloud?
Wirklich nie. Die Erkennung läuft mit KI-Modellen, die auf Ihrem PC liegen. Der einzige Netzwerkverkehr ist der einmalige Modell-Download beim ersten Start — danach bleibt alles offline. Ihre Stimme, Ihr Text und Ihre Nutzungsdaten werden nie übertragen. (Alle Einzelheiten im PRIVACY-Dokument.)
Brauche ich eine GPU?
Eine GPU (NVIDIA und Ähnliches) macht es schnell — 0,2–0,35 s pro Äußerung. Ohne GPU läuft es auf der CPU, nur langsamer.
Mit welchen Anwendungen funktioniert es?
Mit jeder Windows-Anwendung, die den Fokus hat. Chat, E-Mail, Browser, Dokumente, Editoren, Terminals — auf Seiten der Anwendung ist nichts zu installieren.
Funktioniert es ohne Internet?
Ja. Nach dem Modell-Download beim ersten Start ist alles offline. Im Flugzeug, fernab von allem oder in einem abgeschotteten Firmennetz — das Diktieren läuft weiter.
Welche Sprachen werden unterstützt?
Deutsch, Englisch, Japanisch und Französisch werden unterstützt und lassen sich in den Einstellungen umschalten. Weitere Sprachen sind in Arbeit und müssen dieselben Überlebenstests für Formulierungen bestehen.
Welches Betriebssystem?
Heute Windows 10 / 11 — Ihre Lizenz gilt für Windows. Eine Mac-Version steht auf der Roadmap; deren Lizenzbedingungen werden bei Erscheinen festgelegt.
Windows meldet beim Installieren „Der Computer wurde geschützt“ — ist das sicher?
Ja. Als Einzelentwickler habe ich noch kein Code-Signing-Zertifikat gekauft (300–500 $ pro Jahr), deshalb zeigt Windows SmartScreen seine übliche Warnung für unsignierte Programme — das bedeutet nicht , dass die Anwendung gefährlich ist. Klicken Sie auf Weitere Informationen → Trotzdem ausführen , um sie zu starten. Alles läuft lokal; Ihre Stimme und Ihr Text werden nie übertragen. Das eingebaute --check prüft Ihren Rechner, bevor Sie sich festlegen. Ein Signaturzertifikat ist geplant, sobald die Verbreitung wächst.
Wie schlage ich eine Funktion vor oder melde einen Fehler?
Nur zu — es erreicht den Entwickler direkt, über die Xinogi-Seite. Das hier baut eine einzelne Person, und ich möchte es besser machen gemeinsam mit denen, die es benutzen. „ich wünschte, es könnte X“ und „das sollte wie Y funktionieren“ ist genau das, was ich hören will.
kotocast --buy
Einmal kaufen. Und uns dann vergessen.
Kein Abo, kein Konto, keine Cloud. Einmal 110 € inkl. MwSt. zahlen (der Preis steigt auf den regulären Tarif, sobald eine bestimmte Anzahl verkauft ist), herunterladen, und es gehört Ihnen — es läuft vollständig auf Ihrem Rechner.