EdgeSpeak sur votre appareil
EdgeSpeak transforme l’audio et la vidéo en texte sur l’ordinateur devant vous.
Moteur vocal sur appareil
EdgeSpeak compresse des modèles vocaux professionnels pour le bureau et transcrit localement réunions, entretiens, vidéos et enregistrements. Audio, vidéo et transcriptions restent sur votre appareil.

Développeurs · CLI & Skills
L'installation en une ligne que vous connaissez déjà avec vos outils de développement. La CLI est autonome, ne requiert aucune app de bureau et transcrit directement depuis le terminal.
Installez-la depuis Terminal sur macOS ou Linux, et depuis PowerShell sur Windows x64. Le CPU fonctionne immédiatement ; Linux détecte NVIDIA CUDA automatiquement, tandis que CUDA reste optionnel sous Windows.
macOS / Linux · Terminal
curl -fsSL https://edgespeak.com/install.sh | sh
Windows · PowerShell
irm https://edgespeak.com/install.ps1 | iex
Les EdgeSpeak Skills apprennent à Claude Code, Cursor et aux autres agents compatibles Skills à transcrire sur l'appareil via la CLI. Open source sur GitHub.
npx skills add lattifai/EdgeSpeak
Transcription rapide sur l’appareil
Déposez une réunion, une interview ou une vidéo. EdgeSpeak réalise la compréhension vocale, la génération de transcription et l’alignement du texte sur cet ordinateur ; les outils en aval récupèrent ensuite le texte via la passerelle locale.
EdgeSpeak transforme l’audio et la vidéo en texte sur l’ordinateur devant vous.
La transcription suit la lecture, pour corriger dans le même espace de travail.
Exportez le texte ou les sous-titres, ou laissez un autre outil repartir de la transcription terminée.
Modèle dédié sur l’appareil
Lattice-2 est compressé et optimisé pour l’inférence sur l’appareil, afin qu’un ordinateur courant traite efficacement réunions, entretiens, vidéos et enregistrements.
Le modèle d’IA vocale est adapté à l’exécution desktop, réduit l’attente, et la transcription locale ne dépend pas de services externes.
Flash répond vite pour les réunions et vidéos du quotidien. Pro vise les audios plus difficiles, les accents plus complexes et un plafond de précision plus élevé, avec davantage de ressources locales.
Lattice-2 prend en charge plus de 40 langues, plusieurs accents anglais et des dialectes chinois ; le même moteur local peut servir CLI, agents et automatisations via la passerelle.
LOCAL LM + VLM · 0.6B — 27B
EdgeSpeak propose désormais des modèles Qwen et Gemma de 0.6B à 27B. Un seul modèle est chargé et se met en veille au repos.
Générer avec un modèle localQwen/Qwen3-0.6B0.6B0.4 GBQwen/Qwen3.5-0.8B0.8B0.5 GBQwen/Qwen3.5-2B2B1.3 GBgoogle/gemma-4-E2B-it2B3.1 GBQwen/Qwen3.5-4BPar défaut4B2.7 GBgoogle/gemma-4-E4B-it4B5.0 GBQwen/Qwen3.5-9B9B5.7 GBgoogle/gemma-4-12B-it12B7.1 GBQwen/Qwen3.6-27B27B16.8 GBTexte + images · compatible OpenAI · local d’abord
Vraie app desktop
Importez un audio ou une vidéo, choisissez un modèle local et exportez le résultat. Pour automatiser, transmettez le travail au CLI ou aux agents via la passerelle locale.



Workflows
Explorez les fichiers privés, la transcription audio et vidéo locale, l’automatisation par agents et les options locales face au cloud.
Keep source media on-device and generate the transcript locally.
Review with playback, then export text or subtitles.
Install the EdgeSpeak Skill and let agents call the local CLI.
Choose by media location, processing scale, and integration path.
Confidentialité
EdgeSpeak is designed so imported media and generated transcripts stay on your device unless you export, upload, or share them.
Le modèle d’IA vocale est adapté à l’exécution desktop, réduit l’attente, et la transcription locale ne dépend pas de services externes.
Exportez le texte ou les sous-titres, ou laissez un autre outil repartir de la transcription terminée.
Passerelle vocale locale
EdgeSpeak fournit une API vocale locale compatible OpenAI, afin que CLI, agents et automatisations transcrivent sur le même ordinateur. Ce n’est pas un cloud de plus, mais la passerelle vocale de votre ordinateur.
POST /v1/audio/transcriptionslocalhost:1117curl http://127.0.0.1:1117/v1/audio/transcriptions \ -H "Authorization: Bearer sk-edgespeak-..." \ -F file=@meeting.m4a \ -F model="lattice-2-flash"
Choose by workflow
The right option depends on where media can go, how much workflow you want ready-made, and who should maintain the speech stack.
| Choose by workflow | EdgeSpeak | Cloud transcription | Self-managed local model |
|---|---|---|---|
| Source media | Stays on this device | Uploaded to a remote service | Stays on the machine you configure |
| Review workflow | Desktop playback, transcript, and export | Depends on the provider | You build the review surface |
| Tools and agents | Local CLI and OpenAI-compatible gateway | Hosted API | You build and maintain the integration |
| Operations | Install the app and local models | Manage an account, API keys, and network access | Maintain the runtime, models, and dependencies |
Tarifs
La version actuelle inclut la transcription audio et vidéo locale, la passerelle locale et le CLI. Achetez une fois et recevez les futures mises à jour des modèles et fonctions vocales.
Prix actuel $49, prix régulier $99. Accès à vie, achat unique pendant l’early bird.
Plus d'appareils ou achat équipe : sales@edgespeak.com
Télécharger
Téléchargez le build Apple Silicon actuel, vérifiez les métadonnées de version et activez votre licence en quelques secondes.
Use the available desktop build today. Your account keeps purchase, license, and device management in one place.
Download the Windows x64 Beta, verify its SHA-256, and follow the installation guide. This Beta uses manual updates.
Sign in with the email used for purchase, then manage your license key and activated devices from your account.
FAQ
On-device processing, supported platforms, models, and the lifetime license — answered before you buy.
See all questionsImported media and generated transcripts stay on your device unless you export, upload, or share them yourself.
EdgeSpeak is available for Apple Silicon Macs with macOS 14.0 or later. A Windows 10/11 x64 Beta is also available for manual installation; Windows in-app updates are not enabled yet.
The early-bird lifetime license is a one-time purchase for permanent use, future model and speech-capability updates, and up to four activated devices.
Flash is tuned for faster everyday transcription. Pro raises the accuracy ceiling for harder audio and uses more local resources.
Yes. The bundled CLI and local OpenAI-compatible gateway let trusted tools on the same computer call the local speech engine.
Avis de la communauté
Partagez vos workflows, vos besoins d’intégration d’agents et vos idées produit sur Discord.
Vos retours alimentent directement le produit.
Moteur vocal sur appareil
Transcribe locally, review against an accurate timeline, then export or continue through the local gateway.