On-device spraakengine

Zet een groot spraak-AI-model op je computer

EdgeSpeak comprimeert professionele spraakmodellen voor de desktop en transcribeert vergaderingen, interviews, video’s en opnames lokaal. Audio, video en transcripties blijven op je apparaat.

  • Lokale audio-/videotranscriptie beschikbaar
  • Lokale gateway en CLI beschikbaar
  • Toekomstige model- en spraakupdates
Transcript-preview
Transcript-previewlocal-transcribe.mov

Ontwikkelaars · CLI & Skills

Installeer de CLI met één opdracht

De vertrouwde one-liner die je kent van je ontwikkeltools. De CLI is zelfstandig, heeft geen desktop-app nodig en transcribeert rechtstreeks vanuit de terminal.

Installeer via Terminal op macOS of Linux en via PowerShell op Windows x64. CPU werkt direct; Linux detecteert NVIDIA CUDA automatisch, terwijl CUDA op Windows expliciet kan worden gekozen.

macOS · Apple SiliconWindows x64 · CPU / CUDALinux x86_64 · CPU / CUDA
Lees de CLI-documentatie

macOS / Linux · Terminal

curl -fsSL https://edgespeak.com/install.sh | sh

Windows · PowerShell

irm https://edgespeak.com/install.ps1 | iex
edgespeak-cli login
edgespeak-cli transcribe media.mp4 -o media.srt
edgespeak-cli generate "Summarize this transcript" --model Qwen/Qwen3.5-4B

Agent Skills, dezelfde engine

EdgeSpeak Skills leren Claude Code, Cursor en andere Skills-compatibele agents om via de CLI op het apparaat te transcriberen. Open source op GitHub.

npx skills add lattifai/EdgeSpeak

Snelle on-device transcriptie

Importeer audio of video en transcribeer lokaal met hoge nauwkeurigheid

Sleep een meeting, interview of video naar binnen. EdgeSpeak doet spraakbegrip, transcriptgeneratie en tekstuitlijning op deze computer; downstream tools halen het transcript op via de lokale gateway.

  1. EdgeSpeak op je apparaat

    EdgeSpeak zet audio en video om naar tekst op de computer voor je.

  2. Corrigeren terwijl je luistert

    Het transcript volgt de playback, zodat review en correctie in één werkruimte blijven.

  3. Resultaten gaan verder

    Exporteer tekst of ondertitels, of laat een andere tool verdergaan met het afgeronde transcript.

Speciaal on-device model

Lattice-2, gemaakt voor de desktop

Lattice-2 is gecomprimeerd en geoptimaliseerd voor on-device inferentie, zodat een gewone computer vergaderingen, interviews, video’s en opnames efficiënt verwerkt.

On-device compressie en inferentie-aanpassing

Het spraak-AI-model is gevormd voor desktopuitvoering, verlaagt wachttijd en lokale transcriptie is niet afhankelijk van externe diensten.

Flash / Pro-modelcombinatie

Flash reageert sneller voor dagelijkse meetings en video’s. Pro richt zich op moeilijkere audio, complexere accenten en een hogere nauwkeurigheidsgrens, met meer lokale resources.

In developer workflows ingebouwd

Lattice-2 ondersteunt 40+ talen, meerdere Engelse accenten en Chinese dialecten; dezelfde lokale engine kan via de gateway naar CLI, agents en automatisering.

LOCAL LM + VLM · 0.6B — 27B

Lokale taal en beeld in dezelfde EdgeSpeak-runtime.

EdgeSpeak biedt nu Qwen- en Gemma-modellen van 0.6B tot 27B. Er wordt één model tegelijk geladen en bij inactiviteit gepauzeerd.

Genereren met een lokaal model
Qwen/Qwen3-0.6B0.6B0.4 GB
Qwen/Qwen3.5-0.8B0.8B0.5 GB
Qwen/Qwen3.5-2B2B1.3 GB
google/gemma-4-E2B-it2B3.1 GB
Qwen/Qwen3.5-4BStandaard4B2.7 GB
google/gemma-4-E4B-it4B5.0 GB
Qwen/Qwen3.5-9B9B5.7 GB
google/gemma-4-12B-it12B7.1 GB
Qwen/Qwen3.6-27B27B16.8 GB

Tekst + afbeeldingen · OpenAI-compatibel · lokaal eerst

Echte desktop-app

EdgeSpeak draait direct op je computer

Importeer audio of video, kies een lokaal model en exporteer het resultaat. Geef automatisering via de lokale gateway door aan CLI of agents.

Audio, video en transcript in één workspaceAfspelen, tijdlijn, transcript, export, recente bestanden en het actieve EdgeSpeak-model blijven samen, zodat je minder wisselt en context behoudt.
EdgeSpeak desktop Transcribe-scherm met workspace, lokale EdgeSpeak-modelstatus, transcript, afspeelbediening en recente bestanden.
Kies het juiste EdgeSpeak-modelEdgeSpeak ondersteunt 40+ talen, meerdere Engelse accenten en Chinese dialecten. Flash is snel en sterk; Pro is nauwkeuriger en gebruikt meer lokale resources.
EdgeSpeak desktop Models-scherm met lokale EdgeSpeak Flash- en EdgeSpeak Pro-opties.
Laat andere tools EdgeSpeak gebruikenCLI-tools, agents en automatisering kunnen audio naar EdgeSpeak sturen en het transcript terugkrijgen van EdgeSpeak.
EdgeSpeak desktop Gateway-scherm dat laat zien hoe tools op dezelfde computer de lokale spraakengine gebruiken.

Privacy

Local-first spraakverwerking.

EdgeSpeak is designed so imported media and generated transcripts stay on your device unless you export, upload, or share them.

On-device compressie en inferentie-aanpassing

Het spraak-AI-model is gevormd voor desktopuitvoering, verlaagt wachttijd en lokale transcriptie is niet afhankelijk van externe diensten.

Resultaten gaan verder

Exporteer tekst of ondertitels, of laat een andere tool verdergaan met het afgeronde transcript.

Lokale spraakgateway

Laat agents EdgeSpeak direct aanroepen

EdgeSpeak biedt een lokale, OpenAI-compatibele spraak-API, zodat CLI, agents en automatiseringen op dezelfde computer transcriberen. Geen extra cloud, maar de spraakgateway van je computer.

Lokaal OpenAI-compatibel endpointCLI / agents / automatiseringEdgeSpeak Flash en Pro
POST /v1/audio/transcriptionslocalhost:1117
curl http://127.0.0.1:1117/v1/audio/transcriptions \
  -H "Authorization: Bearer sk-edgespeak-..." \
  -F file=@meeting.m4a \
  -F model="lattice-2-flash"

Choose by workflow

Local software, cloud APIs, or a model you maintain

The right option depends on where media can go, how much workflow you want ready-made, and who should maintain the speech stack.

Choose by workflowEdgeSpeakCloud transcriptionSelf-managed local model
Source mediaStays on this deviceUploaded to a remote serviceStays on the machine you configure
Review workflowDesktop playback, transcript, and exportDepends on the providerYou build the review surface
Tools and agentsLocal CLI and OpenAI-compatible gatewayHosted APIYou build and maintain the integration
OperationsInstall the app and local modelsManage an account, API keys, and network accessMaintain the runtime, models, and dependencies
Read the full comparison

Prijzen

EdgeSpeak voor altijd voor $49

De huidige versie bevat lokale audio- en videotranscriptie, de lokale gateway en CLI. Koop één keer en ontvang toekomstige updates voor modellen en spraakfuncties.

Download

Installeer EdgeSpeak op macOS.

Download de huidige Apple Silicon-build, controleer de release-metadata en activeer je licentie in seconden.

Current macOS build

Use the available desktop build today. Your account keeps purchase, license, and device management in one place.

Windows build

Download the Windows x64 Beta, verify its SHA-256, and follow the installation guide. This Beta uses manual updates.

License and devices

Sign in with the email used for purchase, then manage your license key and activated devices from your account.

FAQ

Frequently asked questions

On-device processing, supported platforms, models, and the lifetime license — answered before you buy.

See all questions
01Does EdgeSpeak upload source media?

Imported media and generated transcripts stay on your device unless you export, upload, or share them yourself.

02Which desktop platforms are available?

EdgeSpeak is available for Apple Silicon Macs with macOS 14.0 or later. A Windows 10/11 x64 Beta is also available for manual installation; Windows in-app updates are not enabled yet.

03What does the lifetime license include?

The early-bird lifetime license is a one-time purchase for permanent use, future model and speech-capability updates, and up to four activated devices.

04What is the difference between Flash and Pro?

Flash is tuned for faster everyday transcription. Pro raises the accuracy ceiling for harder audio and uses more local resources.

05Can CLI tools and AI agents use EdgeSpeak?

Yes. The bundled CLI and local OpenAI-compatible gateway let trusted tools on the same computer call the local speech engine.

Feedback van de community

Verbeter EdgeSpeak met echte workflows

Deel echte workflows, wensen voor agentintegraties en productideeën op Discord.

  • Echte workflows
  • Agent / API
  • Productideeën

On-device spraakengine

Zet een groot spraak-AI-model op je computer

Transcribe locally, review against an accurate timeline, then export or continue through the local gateway.

Download voor macOS