EdgeSpeak pada peranti anda
EdgeSpeak menukar audio dan video kepada teks pada komputer di depan anda.
Enjin suara pada peranti
EdgeSpeak memampatkan model suara profesional untuk desktop dan mentranskripsi mesyuarat, temu bual, video serta rakaman secara setempat. Audio, video dan transkrip kekal pada peranti anda.

Pembangun · CLI & Skills
Pemasangan satu baris yang biasa, seperti alat pembangun yang anda gunakan. CLI ini serba lengkap, tidak memerlukan aplikasi desktop, dan mentranskripsi terus dari terminal.
Pasang melalui Terminal pada macOS atau Linux, dan PowerShell pada Windows x64. CPU terus berfungsi; Linux mengesan NVIDIA CUDA secara automatik, manakala CUDA pada Windows dipilih secara khusus.
macOS / Linux · Terminal
curl -fsSL https://edgespeak.com/install.sh | sh
Windows · PowerShell
irm https://edgespeak.com/install.ps1 | iex
EdgeSpeak Skills mengajar Claude Code, Cursor dan agen lain yang menyokong Skills untuk mentranskripsi pada peranti melalui CLI. Sumber terbuka di GitHub.
npx skills add lattifai/EdgeSpeak
Transkripsi pantas pada peranti
Masukkan mesyuarat, temu bual atau video. EdgeSpeak menjalankan pemahaman suara, penjanaan transkrip dan penjajaran teks pada komputer ini; apabila alat seterusnya perlu menyambung, ia mengambil transkrip daripada gateway setempat.
EdgeSpeak menukar audio dan video kepada teks pada komputer di depan anda.
Transkrip mengikut main balik, jadi semakan dan pembetulan kekal dalam satu ruang kerja.
Eksport teks atau sari kata, atau biarkan alat lain menyambung daripada transkrip siap.
Model khusus pada peranti
Lattice-2 dimampatkan dan dioptimumkan untuk inferens pada peranti supaya komputer biasa dapat memproses mesyuarat, temu bual, video dan rakaman dengan cekap.
Model AI suara dibentuk agar sesuai berjalan pada desktop, mengurangkan masa menunggu, dan transkripsi setempat tidak bergantung pada perkhidmatan luar.
Flash bertindak balas lebih pantas untuk mesyuarat dan video harian. Pro menyasarkan audio yang lebih sukar, aksen lebih kompleks dan siling ketepatan lebih tinggi, dengan lebih banyak sumber setempat.
Lattice-2 menyokong 40+ bahasa, pelbagai aksen Inggeris dan dialek Cina; enjin setempat yang sama boleh digunakan oleh CLI, agent dan automasi melalui gateway.
LOCAL LM + VLM · 0.6B — 27B
EdgeSpeak kini menyediakan model Qwen dan Gemma dari 0.6B hingga 27B. Satu model dimuatkan pada satu masa dan tidur apabila melahu.
Jana dengan model setempatQwen/Qwen3-0.6B0.6B0.4 GBQwen/Qwen3.5-0.8B0.8B0.5 GBQwen/Qwen3.5-2B2B1.3 GBgoogle/gemma-4-E2B-it2B3.1 GBQwen/Qwen3.5-4BLalai4B2.7 GBgoogle/gemma-4-E4B-it4B5.0 GBQwen/Qwen3.5-9B9B5.7 GBgoogle/gemma-4-12B-it12B7.1 GBQwen/Qwen3.6-27B27B16.8 GBTeks + imej · serasi OpenAI · setempat dahulu
Aplikasi desktop sebenar
Import audio atau video, pilih model setempat dan eksport hasilnya. Untuk automasi, serahkan kerja kepada CLI atau agent melalui gateway setempat.



Workflows
Terokai fail peribadi, transkripsi audio dan video setempat, automasi agent serta pilihan setempat berbanding cloud.
Keep source media on-device and generate the transcript locally.
Review with playback, then export text or subtitles.
Install the EdgeSpeak Skill and let agents call the local CLI.
Choose by media location, processing scale, and integration path.
Privasi
EdgeSpeak is designed so imported media and generated transcripts stay on your device unless you export, upload, or share them.
Model AI suara dibentuk agar sesuai berjalan pada desktop, mengurangkan masa menunggu, dan transkripsi setempat tidak bergantung pada perkhidmatan luar.
Eksport teks atau sari kata, atau biarkan alat lain menyambung daripada transkrip siap.
Gateway suara setempat
EdgeSpeak menyediakan API suara setempat yang serasi dengan OpenAI supaya CLI, agent dan automasi boleh mentranskripsi pada komputer yang sama. Bukan cloud lain, tetapi gateway suara komputer anda.
POST /v1/audio/transcriptionslocalhost:1117curl http://127.0.0.1:1117/v1/audio/transcriptions \ -H "Authorization: Bearer sk-edgespeak-..." \ -F file=@meeting.m4a \ -F model="lattice-2-flash"
Choose by workflow
The right option depends on where media can go, how much workflow you want ready-made, and who should maintain the speech stack.
| Choose by workflow | EdgeSpeak | Cloud transcription | Self-managed local model |
|---|---|---|---|
| Source media | Stays on this device | Uploaded to a remote service | Stays on the machine you configure |
| Review workflow | Desktop playback, transcript, and export | Depends on the provider | You build the review surface |
| Tools and agents | Local CLI and OpenAI-compatible gateway | Hosted API | You build and maintain the integration |
| Operations | Install the app and local models | Manage an account, API keys, and network access | Maintain the runtime, models, and dependencies |
Early bird
Versi semasa merangkumi transkripsi audio dan video setempat, gateway setempat dan CLI. Beli sekali dan terus terima kemas kini model serta keupayaan suara.
Harga semasa $49, harga biasa $99. Akses seumur hidup, pembelian sekali semasa early bird.
For more devices or team purchases: sales@edgespeak.com
Muat turun
Choose the current macOS build or open the Windows Beta page for the x64 installer and verified setup instructions.
Use the available desktop build today. Your account keeps purchase, license, and device management in one place.
Download the Windows x64 Beta, verify its SHA-256, and follow the installation guide. This Beta uses manual updates.
Sign in with the email used for purchase, then manage your license key and activated devices from your account.
FAQ
On-device processing, supported platforms, models, and the lifetime license — answered before you buy.
See all questionsImported media and generated transcripts stay on your device unless you export, upload, or share them yourself.
EdgeSpeak is available for Apple Silicon Macs with macOS 14.0 or later. A Windows 10/11 x64 Beta is also available for manual installation; Windows in-app updates are not enabled yet.
The early-bird lifetime license is a one-time purchase for permanent use, future model and speech-capability updates, and up to four activated devices.
Flash is tuned for faster everyday transcription. Pro raises the accuracy ceiling for harder audio and uses more local resources.
Yes. The bundled CLI and local OpenAI-compatible gateway let trusted tools on the same computer call the local speech engine.
Maklum balas komuniti
Kongsi workflow sebenar, keperluan integrasi agent dan idea produk di Discord.
Maklum balas anda terus masuk ke pembangunan produk.
Enjin suara pada peranti
Transcribe locally, review against an accurate timeline, then export or continue through the local gateway.