EdgeSpeak no seu dispositivo
EdgeSpeak transforma áudio e vídeo em texto no computador à sua frente.
Motor de voz no dispositivo
O EdgeSpeak comprime modelos de voz profissionais para o desktop e transcreve localmente reuniões, entrevistas, vídeos e gravações. Áudio, vídeo e transcrições permanecem no seu dispositivo.

Desenvolvedores · CLI & Skills
A instalação de uma linha que você já conhece das suas ferramentas de desenvolvimento. A CLI é autossuficiente, dispensa o app de desktop e transcreve direto do terminal.
Instale pelo Terminal no macOS ou Linux e pelo PowerShell no Windows x64. A CPU funciona de imediato; o Linux detecta NVIDIA CUDA automaticamente e, no Windows, CUDA é uma opção explícita.
macOS / Linux · Terminal
curl -fsSL https://edgespeak.com/install.sh | sh
Windows · PowerShell
irm https://edgespeak.com/install.ps1 | iex
As EdgeSpeak Skills ensinam o Claude Code, o Cursor e outros agentes compatíveis com Skills a transcrever no dispositivo pela CLI. Código aberto no GitHub.
npx skills add lattifai/EdgeSpeak
Transcrição rápida no dispositivo
Arraste uma reunião, entrevista ou vídeo. O EdgeSpeak faz compreensão de fala, geração de transcrição e alinhamento de texto neste computador; quando ferramentas seguintes precisarem continuar, pegam o texto pelo gateway local.
EdgeSpeak transforma áudio e vídeo em texto no computador à sua frente.
A transcrição acompanha a reprodução, para rever e corrigir no mesmo lugar.
Exporte texto ou legendas, ou deixe outra ferramenta continuar a partir da transcrição pronta.
Modelo dedicado no dispositivo
O Lattice-2 é comprimido e otimizado para inferência no dispositivo, para que um computador comum processe reuniões, entrevistas, vídeos e gravações com eficiência.
O modelo de IA de voz é ajustado para execução no desktop, reduzindo espera; a transcrição local não depende de serviços externos.
Flash responde mais rápido para reuniões e vídeos do dia a dia. Pro mira áudio mais difícil, sotaques mais complexos e maior teto de precisão, usando mais recursos locais.
Lattice-2 suporta mais de 40 idiomas, vários sotaques de inglês e dialetos chineses; o mesmo motor local pode servir CLI, agentes e automação pelo gateway.
LOCAL LM + VLM · 0.6B — 27B
O EdgeSpeak agora inclui modelos Qwen e Gemma de 0.6B a 27B. Um modelo é carregado por vez e entra em repouso quando ocioso.
Gerar com um modelo localQwen/Qwen3-0.6B0.6B0.4 GBQwen/Qwen3.5-0.8B0.8B0.5 GBQwen/Qwen3.5-2B2B1.3 GBgoogle/gemma-4-E2B-it2B3.1 GBQwen/Qwen3.5-4BPadrão4B2.7 GBgoogle/gemma-4-E4B-it4B5.0 GBQwen/Qwen3.5-9B9B5.7 GBgoogle/gemma-4-12B-it12B7.1 GBQwen/Qwen3.6-27B27B16.8 GBTexto + imagens · compatível com OpenAI · local primeiro
App desktop real
Importe áudio ou vídeo, escolha um modelo local e exporte o resultado. Para automatizar, passe o trabalho para CLI ou agentes pelo gateway local.



Workflows
Explore arquivos privados, transcrição local de áudio e vídeo, automação com agentes e opções locais versus nuvem.
Keep source media on-device and generate the transcript locally.
Review with playback, then export text or subtitles.
Install the EdgeSpeak Skill and let agents call the local CLI.
Choose by media location, processing scale, and integration path.
Privacidade
EdgeSpeak is designed so imported media and generated transcripts stay on your device unless you export, upload, or share them.
O modelo de IA de voz é ajustado para execução no desktop, reduzindo espera; a transcrição local não depende de serviços externos.
Exporte texto ou legendas, ou deixe outra ferramenta continuar a partir da transcrição pronta.
Gateway de voz local
O EdgeSpeak oferece uma API de voz local compatível com OpenAI para CLI, agentes e automações transcreverem no mesmo computador. Não é outra nuvem: é o gateway de voz do seu computador.
POST /v1/audio/transcriptionslocalhost:1117curl http://127.0.0.1:1117/v1/audio/transcriptions \ -H "Authorization: Bearer sk-edgespeak-..." \ -F file=@meeting.m4a \ -F model="lattice-2-flash"
Choose by workflow
The right option depends on where media can go, how much workflow you want ready-made, and who should maintain the speech stack.
| Choose by workflow | EdgeSpeak | Cloud transcription | Self-managed local model |
|---|---|---|---|
| Source media | Stays on this device | Uploaded to a remote service | Stays on the machine you configure |
| Review workflow | Desktop playback, transcript, and export | Depends on the provider | You build the review surface |
| Tools and agents | Local CLI and OpenAI-compatible gateway | Hosted API | You build and maintain the integration |
| Operations | Install the app and local models | Manage an account, API keys, and network access | Maintain the runtime, models, and dependencies |
Preços
A versão atual inclui transcrição local de áudio e vídeo, gateway local e CLI. Compre uma vez e receba futuras atualizações de modelos e recursos de voz.
Preço atual $49, preço regular $99. Acesso vitalício, compra única durante o early bird.
Mais dispositivos ou compras de equipa: sales@edgespeak.com
Download
Obtenha o build Apple Silicon atual, verifique os metadados da versão e ative a licença em segundos.
Use the available desktop build today. Your account keeps purchase, license, and device management in one place.
Download the Windows x64 Beta, verify its SHA-256, and follow the installation guide. This Beta uses manual updates.
Sign in with the email used for purchase, then manage your license key and activated devices from your account.
FAQ
On-device processing, supported platforms, models, and the lifetime license — answered before you buy.
See all questionsImported media and generated transcripts stay on your device unless you export, upload, or share them yourself.
EdgeSpeak is available for Apple Silicon Macs with macOS 14.0 or later. A Windows 10/11 x64 Beta is also available for manual installation; Windows in-app updates are not enabled yet.
The early-bird lifetime license is a one-time purchase for permanent use, future model and speech-capability updates, and up to four activated devices.
Flash is tuned for faster everyday transcription. Pro raises the accuracy ceiling for harder audio and uses more local resources.
Yes. The bundled CLI and local OpenAI-compatible gateway let trusted tools on the same computer call the local speech engine.
Feedback da comunidade
Compartilhe workflows reais, necessidades de integração com agentes e ideias de produto no Discord.
Seu feedback entra diretamente no produto.
Motor de voz no dispositivo
Transcribe locally, review against an accurate timeline, then export or continue through the local gateway.