Taleengine på enheden

Læg en stor tale-AI-model på din computer

EdgeSpeak komprimerer professionelle talemodeller til desktop og transskriberer møder, interviews, videoer og optagelser lokalt. Audio, video og transskripter bliver på din enhed.

  • Lokal audio-/videotransskription tilgængelig
  • Lokal gateway og CLI tilgængelig
  • Fremtidige model- og taleopdateringer
Transcript preview
Transcript previewlocal-transcribe.mov

Udviklere · CLI & Skills

Installer CLI'en med én kommando

En velkendt one-liner, ligesom de udviklerværktøjer du allerede bruger. CLI'en er selvstændig, kræver ingen desktop-app og transskriberer direkte fra terminalen.

Installer via Terminal på macOS eller Linux og via PowerShell på Windows x64. CPU virker med det samme; Linux registrerer NVIDIA CUDA automatisk, mens CUDA vælges eksplicit på Windows.

macOS · Apple SiliconWindows x64 · CPU / CUDALinux x86_64 · CPU / CUDA
Læs CLI-dokumentationen

macOS / Linux · Terminal

curl -fsSL https://edgespeak.com/install.sh | sh

Windows · PowerShell

irm https://edgespeak.com/install.ps1 | iex
edgespeak-cli login
edgespeak-cli transcribe media.mp4 -o media.srt
edgespeak-cli generate "Summarize this transcript" --model Qwen/Qwen3.5-4B

Agent Skills, samme motor

EdgeSpeak Skills lærer Claude Code, Cursor og andre Skills-kompatible agenter at transskribere på enheden via CLI'en. Open source på GitHub.

npx skills add lattifai/EdgeSpeak

Hurtig on-device transskription

Importer audio eller video og transskriber lokalt med høj præcision

Træk et møde, interview eller video ind. EdgeSpeak håndterer taleforståelse, transskriptgenerering og tekstjustering på denne computer; når downstream-værktøjer skal videre, henter de transskriptet fra den lokale gateway.

  1. EdgeSpeak på din enhed

    EdgeSpeak gør audio og video til tekst på computeren foran dig.

  2. Ret mens du lytter

    Transskriptet følger afspilningen, så gennemgang og rettelser bliver i ét workspace.

  3. Resultatet kan fortsætte

    Eksportér tekst eller undertekster, eller lad et andet værktøj arbejde videre med det færdige transskript.

Dedikeret on-device-model

Lattice-2, skabt til desktop

Lattice-2 er komprimeret og optimeret til inferens på enheden, så en almindelig computer effektivt behandler møder, interviews, videoer og optagelser.

On-device-kompression og inferenstilpasning

Tale-AI-modellen formes til desktopkørsel, reducerer ventetid, og lokal transskription afhænger ikke af eksterne tjenester.

Flash / Pro-modelpar

Flash reagerer hurtigere til hverdagsmøder og videotransskription. Pro retter sig mod sværere lyd, komplekse accenter og højere præcision, med flere lokale ressourcer.

Ind i developer-workflows

Lattice-2 understøtter 40+ sprog, flere engelske accenter og kinesiske dialekter; den samme lokale engine kan bruges af CLI, agents og automatisering via gatewayen.

LOCAL LM + VLM · 0.6B — 27B

Lokalt sprog og syn i den samme EdgeSpeak-runtime.

EdgeSpeak tilbyder nu Qwen- og Gemma-modeller fra 0.6B til 27B. Ét model indlæses ad gangen og går i dvale ved tomgang.

Generér med en lokal model
Qwen/Qwen3-0.6B0.6B0.4 GB
Qwen/Qwen3.5-0.8B0.8B0.5 GB
Qwen/Qwen3.5-2B2B1.3 GB
google/gemma-4-E2B-it2B3.1 GB
Qwen/Qwen3.5-4BStandard4B2.7 GB
google/gemma-4-E4B-it4B5.0 GB
Qwen/Qwen3.5-9B9B5.7 GB
google/gemma-4-12B-it12B7.1 GB
Qwen/Qwen3.6-27B27B16.8 GB

Tekst + billeder · OpenAI-kompatibel · lokalt først

Ægte desktop-app

EdgeSpeak kører direkte på din computer

Importér audio eller video, vælg en lokal model, og eksportér resultatet. Til automatisering sender du arbejdet til CLI eller agents gennem den lokale gateway.

Audio, video og transskript i ét workspaceAfspilning, timeline, transskript, eksport, seneste filer og aktiv EdgeSpeak-model bliver samlet, så du skifter færre værktøjer og bevarer konteksten.
EdgeSpeak desktop Transcribe-skærm med workspace, lokal EdgeSpeak-modelstatus, transskript, afspilningskontroller og seneste filer.
Vælg den rigtige EdgeSpeak-model til opgavenEdgeSpeak understøtter 40+ sprog, flere engelske accenter og kinesiske dialekter. Flash er hurtig og stærk; Pro er mere præcis og bruger flere lokale ressourcer.
EdgeSpeak desktop Models-skærm med lokale EdgeSpeak Flash- og EdgeSpeak Pro-valg.
Lad andre værktøjer bruge EdgeSpeakCLI-værktøjer, agents og automatisering kan sende audio til EdgeSpeak og få transskriptet tilbage fra EdgeSpeak.
EdgeSpeak desktop Gateway-skærm, der viser hvordan værktøjer på samme computer bruger den lokale taleengine.

Privatliv

Local-first talebehandling.

EdgeSpeak is designed so imported media and generated transcripts stay on your device unless you export, upload, or share them.

On-device-kompression og inferenstilpasning

Tale-AI-modellen formes til desktopkørsel, reducerer ventetid, og lokal transskription afhænger ikke af eksterne tjenester.

Resultatet kan fortsætte

Eksportér tekst eller undertekster, eller lad et andet værktøj arbejde videre med det færdige transskript.

Lokal tale-gateway

Lad agents kalde EdgeSpeak direkte

EdgeSpeak leverer en lokal, OpenAI-kompatibel tale-API, så CLI, agents og automatiseringer transskriberer på samme computer. Ikke endnu en cloud, men din computers tale-gateway.

Lokalt OpenAI-kompatibelt endpointCLI / agents / automatiseringEdgeSpeak Flash og Pro
POST /v1/audio/transcriptionslocalhost:1117
curl http://127.0.0.1:1117/v1/audio/transcriptions \
  -H "Authorization: Bearer sk-edgespeak-..." \
  -F file=@meeting.m4a \
  -F model="lattice-2-flash"

Choose by workflow

Local software, cloud APIs, or a model you maintain

The right option depends on where media can go, how much workflow you want ready-made, and who should maintain the speech stack.

Choose by workflowEdgeSpeakCloud transcriptionSelf-managed local model
Source mediaStays on this deviceUploaded to a remote serviceStays on the machine you configure
Review workflowDesktop playback, transcript, and exportDepends on the providerYou build the review surface
Tools and agentsLocal CLI and OpenAI-compatible gatewayHosted APIYou build and maintain the integration
OperationsInstall the app and local modelsManage an account, API keys, and network accessMaintain the runtime, models, and dependencies
Read the full comparison

Early bird

EdgeSpeak for altid til $49

Den aktuelle version omfatter lokal audio- og videotransskription, lokal gateway og CLI. Køb én gang, og modtag fremtidige opdateringer til modeller og talefunktioner.

Download

Installer EdgeSpeak på macOS.

Choose the current macOS build or open the Windows Beta page for the x64 installer and verified setup instructions.

Current macOS build

Use the available desktop build today. Your account keeps purchase, license, and device management in one place.

Windows build

Download the Windows x64 Beta, verify its SHA-256, and follow the installation guide. This Beta uses manual updates.

License and devices

Sign in with the email used for purchase, then manage your license key and activated devices from your account.

FAQ

Frequently asked questions

On-device processing, supported platforms, models, and the lifetime license — answered before you buy.

See all questions
01Does EdgeSpeak upload source media?

Imported media and generated transcripts stay on your device unless you export, upload, or share them yourself.

02Which desktop platforms are available?

EdgeSpeak is available for Apple Silicon Macs with macOS 14.0 or later. A Windows 10/11 x64 Beta is also available for manual installation; Windows in-app updates are not enabled yet.

03What does the lifetime license include?

The early-bird lifetime license is a one-time purchase for permanent use, future model and speech-capability updates, and up to four activated devices.

04What is the difference between Flash and Pro?

Flash is tuned for faster everyday transcription. Pro raises the accuracy ceiling for harder audio and uses more local resources.

05Can CLI tools and AI agents use EdgeSpeak?

Yes. The bundled CLI and local OpenAI-compatible gateway let trusted tools on the same computer call the local speech engine.

Feedback fra fællesskabet

Forbedr EdgeSpeak med rigtige workflows

Del rigtige workflows, behov for agent-integrationer og produktidéer på Discord.

  • Rigtige workflows
  • Agent / API
  • Produktidéer

Taleengine på enheden

Læg en stor tale-AI-model på din computer

Transcribe locally, review against an accurate timeline, then export or continue through the local gateway.

Download til macOS