EdgeSpeak på din enhed
EdgeSpeak gør audio og video til tekst på computeren foran dig.
Taleengine på enheden
EdgeSpeak komprimerer professionelle talemodeller til desktop og transskriberer møder, interviews, videoer og optagelser lokalt. Audio, video og transskripter bliver på din enhed.

Udviklere · CLI & Skills
En velkendt one-liner, ligesom de udviklerværktøjer du allerede bruger. CLI'en er selvstændig, kræver ingen desktop-app og transskriberer direkte fra terminalen.
Installer via Terminal på macOS eller Linux og via PowerShell på Windows x64. CPU virker med det samme; Linux registrerer NVIDIA CUDA automatisk, mens CUDA vælges eksplicit på Windows.
macOS / Linux · Terminal
curl -fsSL https://edgespeak.com/install.sh | sh
Windows · PowerShell
irm https://edgespeak.com/install.ps1 | iex
EdgeSpeak Skills lærer Claude Code, Cursor og andre Skills-kompatible agenter at transskribere på enheden via CLI'en. Open source på GitHub.
npx skills add lattifai/EdgeSpeak
Hurtig on-device transskription
Træk et møde, interview eller video ind. EdgeSpeak håndterer taleforståelse, transskriptgenerering og tekstjustering på denne computer; når downstream-værktøjer skal videre, henter de transskriptet fra den lokale gateway.
EdgeSpeak gør audio og video til tekst på computeren foran dig.
Transskriptet følger afspilningen, så gennemgang og rettelser bliver i ét workspace.
Eksportér tekst eller undertekster, eller lad et andet værktøj arbejde videre med det færdige transskript.
Dedikeret on-device-model
Lattice-2 er komprimeret og optimeret til inferens på enheden, så en almindelig computer effektivt behandler møder, interviews, videoer og optagelser.
Tale-AI-modellen formes til desktopkørsel, reducerer ventetid, og lokal transskription afhænger ikke af eksterne tjenester.
Flash reagerer hurtigere til hverdagsmøder og videotransskription. Pro retter sig mod sværere lyd, komplekse accenter og højere præcision, med flere lokale ressourcer.
Lattice-2 understøtter 40+ sprog, flere engelske accenter og kinesiske dialekter; den samme lokale engine kan bruges af CLI, agents og automatisering via gatewayen.
LOCAL LM + VLM · 0.6B — 27B
EdgeSpeak tilbyder nu Qwen- og Gemma-modeller fra 0.6B til 27B. Ét model indlæses ad gangen og går i dvale ved tomgang.
Generér med en lokal modelQwen/Qwen3-0.6B0.6B0.4 GBQwen/Qwen3.5-0.8B0.8B0.5 GBQwen/Qwen3.5-2B2B1.3 GBgoogle/gemma-4-E2B-it2B3.1 GBQwen/Qwen3.5-4BStandard4B2.7 GBgoogle/gemma-4-E4B-it4B5.0 GBQwen/Qwen3.5-9B9B5.7 GBgoogle/gemma-4-12B-it12B7.1 GBQwen/Qwen3.6-27B27B16.8 GBTekst + billeder · OpenAI-kompatibel · lokalt først
Ægte desktop-app
Importér audio eller video, vælg en lokal model, og eksportér resultatet. Til automatisering sender du arbejdet til CLI eller agents gennem den lokale gateway.



Workflows
Udforsk private filer, lokal audio- og videotransskription, agent-automatisering samt lokale muligheder over for cloud.
Keep source media on-device and generate the transcript locally.
Review with playback, then export text or subtitles.
Install the EdgeSpeak Skill and let agents call the local CLI.
Choose by media location, processing scale, and integration path.
Privatliv
EdgeSpeak is designed so imported media and generated transcripts stay on your device unless you export, upload, or share them.
Tale-AI-modellen formes til desktopkørsel, reducerer ventetid, og lokal transskription afhænger ikke af eksterne tjenester.
Eksportér tekst eller undertekster, eller lad et andet værktøj arbejde videre med det færdige transskript.
Lokal tale-gateway
EdgeSpeak leverer en lokal, OpenAI-kompatibel tale-API, så CLI, agents og automatiseringer transskriberer på samme computer. Ikke endnu en cloud, men din computers tale-gateway.
POST /v1/audio/transcriptionslocalhost:1117curl http://127.0.0.1:1117/v1/audio/transcriptions \ -H "Authorization: Bearer sk-edgespeak-..." \ -F file=@meeting.m4a \ -F model="lattice-2-flash"
Choose by workflow
The right option depends on where media can go, how much workflow you want ready-made, and who should maintain the speech stack.
| Choose by workflow | EdgeSpeak | Cloud transcription | Self-managed local model |
|---|---|---|---|
| Source media | Stays on this device | Uploaded to a remote service | Stays on the machine you configure |
| Review workflow | Desktop playback, transcript, and export | Depends on the provider | You build the review surface |
| Tools and agents | Local CLI and OpenAI-compatible gateway | Hosted API | You build and maintain the integration |
| Operations | Install the app and local models | Manage an account, API keys, and network access | Maintain the runtime, models, and dependencies |
Early bird
Den aktuelle version omfatter lokal audio- og videotransskription, lokal gateway og CLI. Køb én gang, og modtag fremtidige opdateringer til modeller og talefunktioner.
Nu $49, normalpris $99. Lifetime access, engangskøb under early bird.
For more devices or team purchases: sales@edgespeak.com
Download
Choose the current macOS build or open the Windows Beta page for the x64 installer and verified setup instructions.
Use the available desktop build today. Your account keeps purchase, license, and device management in one place.
Download the Windows x64 Beta, verify its SHA-256, and follow the installation guide. This Beta uses manual updates.
Sign in with the email used for purchase, then manage your license key and activated devices from your account.
FAQ
On-device processing, supported platforms, models, and the lifetime license — answered before you buy.
See all questionsImported media and generated transcripts stay on your device unless you export, upload, or share them yourself.
EdgeSpeak is available for Apple Silicon Macs with macOS 14.0 or later. A Windows 10/11 x64 Beta is also available for manual installation; Windows in-app updates are not enabled yet.
The early-bird lifetime license is a one-time purchase for permanent use, future model and speech-capability updates, and up to four activated devices.
Flash is tuned for faster everyday transcription. Pro raises the accuracy ceiling for harder audio and uses more local resources.
Yes. The bundled CLI and local OpenAI-compatible gateway let trusted tools on the same computer call the local speech engine.
Feedback fra fællesskabet
Del rigtige workflows, behov for agent-integrationer og produktidéer på Discord.
Din feedback går direkte ind i produktet.
Taleengine på enheden
Transcribe locally, review against an accurate timeline, then export or continue through the local gateway.