EdgeSpeak sul tuo dispositivo
EdgeSpeak trasforma audio e video in testo sul computer davanti a te.
Motore vocale on-device
EdgeSpeak comprime modelli vocali professionali per il desktop e trascrive localmente riunioni, interviste, video e registrazioni. Audio, video e trascrizioni restano sul tuo dispositivo.

Sviluppatori · CLI & Skills
L'installazione in una riga che già conosci dai tuoi strumenti di sviluppo. La CLI è autonoma, non richiede l'app desktop e trascrive direttamente dal terminale.
Installala da Terminal su macOS o Linux e da PowerShell su Windows x64. La CPU funziona subito; Linux rileva NVIDIA CUDA automaticamente, mentre su Windows CUDA si abilita esplicitamente.
macOS / Linux · Terminal
curl -fsSL https://edgespeak.com/install.sh | sh
Windows · PowerShell
irm https://edgespeak.com/install.ps1 | iex
Le EdgeSpeak Skills insegnano a Claude Code, Cursor e altri agenti compatibili con le Skills a trascrivere sul dispositivo tramite la CLI. Open source su GitHub.
npx skills add lattifai/EdgeSpeak
Trascrizione rapida on-device
Trascina una riunione, un’intervista o un video. EdgeSpeak esegue comprensione vocale, generazione della trascrizione e allineamento del testo su questo computer; gli strumenti a valle prendono il testo dal gateway locale.
EdgeSpeak trasforma audio e video in testo sul computer davanti a te.
La trascrizione segue la riproduzione, così revisione e correzione restano nello stesso spazio.
Esporta testo o sottotitoli, oppure lascia che un altro strumento continui dalla trascrizione pronta.
Modello on-device dedicato
Lattice-2 è compresso e ottimizzato per l’inferenza sul dispositivo, così un normale computer gestisce in modo efficiente riunioni, interviste, video e registrazioni.
Il modello AI vocale viene adattato all’esecuzione desktop, riducendo l’attesa; la trascrizione locale non dipende da servizi esterni.
Flash risponde più velocemente per riunioni e video quotidiani. Pro punta ad audio più difficili, accenti complessi e un tetto di accuratezza più alto, usando più risorse locali.
Lattice-2 supporta oltre 40 lingue, diversi accenti inglesi e dialetti cinesi; lo stesso motore locale può servire CLI, agent e automazioni tramite gateway.
LOCAL LM + VLM · 0.6B — 27B
EdgeSpeak ora include modelli Qwen e Gemma da 0.6B a 27B. Viene caricato un modello alla volta e sospeso quando inattivo.
Genera con un modello localeQwen/Qwen3-0.6B0.6B0.4 GBQwen/Qwen3.5-0.8B0.8B0.5 GBQwen/Qwen3.5-2B2B1.3 GBgoogle/gemma-4-E2B-it2B3.1 GBQwen/Qwen3.5-4BPredefinito4B2.7 GBgoogle/gemma-4-E4B-it4B5.0 GBQwen/Qwen3.5-9B9B5.7 GBgoogle/gemma-4-12B-it12B7.1 GBQwen/Qwen3.6-27B27B16.8 GBTesto + immagini · compatibile OpenAI · locale prima
App desktop reale
Importa audio o video, scegli un modello locale ed esporta il risultato. Per l’automazione, passa il lavoro a CLI o agent tramite il gateway locale.



Workflows
Esplora file privati, trascrizione locale di audio e video, automazione con agent e opzioni locali rispetto al cloud.
Keep source media on-device and generate the transcript locally.
Review with playback, then export text or subtitles.
Install the EdgeSpeak Skill and let agents call the local CLI.
Choose by media location, processing scale, and integration path.
Privacy
EdgeSpeak is designed so imported media and generated transcripts stay on your device unless you export, upload, or share them.
Il modello AI vocale viene adattato all’esecuzione desktop, riducendo l’attesa; la trascrizione locale non dipende da servizi esterni.
Esporta testo o sottotitoli, oppure lascia che un altro strumento continui dalla trascrizione pronta.
Gateway vocale locale
EdgeSpeak offre un’API vocale locale compatibile con OpenAI, così CLI, agent e automazioni trascrivono sullo stesso computer. Non è un altro cloud: è il gateway vocale del tuo computer.
POST /v1/audio/transcriptionslocalhost:1117curl http://127.0.0.1:1117/v1/audio/transcriptions \ -H "Authorization: Bearer sk-edgespeak-..." \ -F file=@meeting.m4a \ -F model="lattice-2-flash"
Choose by workflow
The right option depends on where media can go, how much workflow you want ready-made, and who should maintain the speech stack.
| Choose by workflow | EdgeSpeak | Cloud transcription | Self-managed local model |
|---|---|---|---|
| Source media | Stays on this device | Uploaded to a remote service | Stays on the machine you configure |
| Review workflow | Desktop playback, transcript, and export | Depends on the provider | You build the review surface |
| Tools and agents | Local CLI and OpenAI-compatible gateway | Hosted API | You build and maintain the integration |
| Operations | Install the app and local models | Manage an account, API keys, and network access | Maintain the runtime, models, and dependencies |
Prezzi
La versione attuale include trascrizione locale di audio e video, gateway locale e CLI. Acquista una volta e ricevi i futuri aggiornamenti di modelli e funzioni vocali.
Prezzo attuale $49, prezzo regolare $99. Accesso lifetime, acquisto unico durante l’early bird.
Più dispositivi o acquisti team: sales@edgespeak.com
Download
Scarica il build Apple Silicon attuale, verifica i metadati di rilascio e attiva la licenza in pochi secondi.
Use the available desktop build today. Your account keeps purchase, license, and device management in one place.
Download the Windows x64 Beta, verify its SHA-256, and follow the installation guide. This Beta uses manual updates.
Sign in with the email used for purchase, then manage your license key and activated devices from your account.
FAQ
On-device processing, supported platforms, models, and the lifetime license — answered before you buy.
See all questionsImported media and generated transcripts stay on your device unless you export, upload, or share them yourself.
EdgeSpeak is available for Apple Silicon Macs with macOS 14.0 or later. A Windows 10/11 x64 Beta is also available for manual installation; Windows in-app updates are not enabled yet.
The early-bird lifetime license is a one-time purchase for permanent use, future model and speech-capability updates, and up to four activated devices.
Flash is tuned for faster everyday transcription. Pro raises the accuracy ceiling for harder audio and uses more local resources.
Yes. The bundled CLI and local OpenAI-compatible gateway let trusted tools on the same computer call the local speech engine.
Feedback della community
Condividi workflow reali, esigenze di integrazione degli agent e idee di prodotto su Discord.
Il tuo feedback entra direttamente nel prodotto.
Motore vocale on-device
Transcribe locally, review against an accurate timeline, then export or continue through the local gateway.