EdgeSpeak на вашем устройстве
EdgeSpeak превращает аудио и видео в текст на компьютере перед вами.
Речевой движок на устройстве
EdgeSpeak сжимает профессиональные речевые модели для компьютера и локально расшифровывает встречи, интервью, видео и записи. Аудио, видео и расшифровки остаются на вашем устройстве.

Разработчикам · CLI & Skills
Привычная установка в одну строку, как у инструментов разработчика, которыми вы уже пользуетесь. CLI самодостаточен: настольное приложение не требуется, транскрипция запускается прямо из терминала.
На macOS и Linux установка выполняется в Terminal, на Windows x64 — в PowerShell. CPU работает по умолчанию; Linux автоматически определяет NVIDIA CUDA, а в Windows CUDA включается явно.
macOS / Linux · Terminal
curl -fsSL https://edgespeak.com/install.sh | sh
Windows · PowerShell
irm https://edgespeak.com/install.ps1 | iex
EdgeSpeak Skills учат Claude Code, Cursor и другие агенты с поддержкой Skills транскрибировать на устройстве через CLI. Открытый код на GitHub.
npx skills add lattifai/EdgeSpeak
Быстрая транскрипция на устройстве
Добавьте встречу, интервью или видео. EdgeSpeak выполняет понимание речи, генерацию текста и выравнивание на этом компьютере; следующие инструменты забирают текст через локальный gateway.
EdgeSpeak превращает аудио и видео в текст на компьютере перед вами.
Текст следует за воспроизведением, поэтому проверка остается в одном рабочем месте.
Экспортируйте текст или субтитры, либо передайте готовую транскрипцию другому инструменту.
Выделенная on-device модель
Lattice-2 сжат и оптимизирован для локального инференса, поэтому обычный компьютер эффективно обрабатывает встречи, интервью, видео и записи.
Речевая AI-модель адаптирована к запуску на десктопе, сокращает ожидание, а локальная транскрипция не зависит от внешних сервисов.
Flash быстрее отвечает для обычных встреч и видео. Pro рассчитан на более сложное аудио, акценты и более высокий потолок точности, используя больше локальных ресурсов.
Lattice-2 поддерживает более 40 языков, разные английские акценты и китайские диалекты; тот же локальный движок доступен CLI, агентам и автоматизации через gateway.
LOCAL LM + VLM · 0.6B — 27B
EdgeSpeak теперь включает модели Qwen и Gemma от 0.6B до 27B. Одновременно загружается одна модель, при простое она засыпает.
Генерация локальной модельюQwen/Qwen3-0.6B0.6B0.4 GBQwen/Qwen3.5-0.8B0.8B0.5 GBQwen/Qwen3.5-2B2B1.3 GBgoogle/gemma-4-E2B-it2B3.1 GBQwen/Qwen3.5-4BПо умолчанию4B2.7 GBgoogle/gemma-4-E4B-it4B5.0 GBQwen/Qwen3.5-9B9B5.7 GBgoogle/gemma-4-12B-it12B7.1 GBQwen/Qwen3.6-27B27B16.8 GBТекст + изображения · совместимо с OpenAI · локально
Настоящее desktop-приложение
Импортируйте аудио или видео, выберите локальную модель и экспортируйте результат. Для автоматизации передайте задачу CLI или агентам через локальный gateway.



Workflows
Работайте с приватными файлами, локальной расшифровкой аудио и видео, автоматизацией через агентов и выбором между локальным режимом и облаком.
Keep source media on-device and generate the transcript locally.
Review with playback, then export text or subtitles.
Install the EdgeSpeak Skill and let agents call the local CLI.
Choose by media location, processing scale, and integration path.
Конфиденциальность
EdgeSpeak is designed so imported media and generated transcripts stay on your device unless you export, upload, or share them.
Речевая AI-модель адаптирована к запуску на десктопе, сокращает ожидание, а локальная транскрипция не зависит от внешних сервисов.
Экспортируйте текст или субтитры, либо передайте готовую транскрипцию другому инструменту.
Локальный речевой gateway
EdgeSpeak предоставляет локальный речевой API, совместимый с OpenAI, чтобы CLI, агенты и автоматизация расшифровывали на том же компьютере. Это не ещё одно облако, а речевой gateway вашего компьютера.
POST /v1/audio/transcriptionslocalhost:1117curl http://127.0.0.1:1117/v1/audio/transcriptions \ -H "Authorization: Bearer sk-edgespeak-..." \ -F file=@meeting.m4a \ -F model="lattice-2-flash"
Choose by workflow
The right option depends on where media can go, how much workflow you want ready-made, and who should maintain the speech stack.
| Choose by workflow | EdgeSpeak | Cloud transcription | Self-managed local model |
|---|---|---|---|
| Source media | Stays on this device | Uploaded to a remote service | Stays on the machine you configure |
| Review workflow | Desktop playback, transcript, and export | Depends on the provider | You build the review surface |
| Tools and agents | Local CLI and OpenAI-compatible gateway | Hosted API | You build and maintain the integration |
| Operations | Install the app and local models | Manage an account, API keys, and network access | Maintain the runtime, models, and dependencies |
Early bird
Текущая версия включает локальную расшифровку аудио и видео, локальный gateway и CLI. Купите один раз и получайте будущие обновления моделей и речевых функций.
Сейчас $49, обычная цена $99. Lifetime access, разовая покупка в период early bird.
For more devices or team purchases: sales@edgespeak.com
Скачать
Choose the current macOS build or open the Windows Beta page for the x64 installer and verified setup instructions.
Use the available desktop build today. Your account keeps purchase, license, and device management in one place.
Download the Windows x64 Beta, verify its SHA-256, and follow the installation guide. This Beta uses manual updates.
Sign in with the email used for purchase, then manage your license key and activated devices from your account.
FAQ
On-device processing, supported platforms, models, and the lifetime license — answered before you buy.
See all questionsImported media and generated transcripts stay on your device unless you export, upload, or share them yourself.
EdgeSpeak is available for Apple Silicon Macs with macOS 14.0 or later. A Windows 10/11 x64 Beta is also available for manual installation; Windows in-app updates are not enabled yet.
The early-bird lifetime license is a one-time purchase for permanent use, future model and speech-capability updates, and up to four activated devices.
Flash is tuned for faster everyday transcription. Pro raises the accuracy ceiling for harder audio and uses more local resources.
Yes. The bundled CLI and local OpenAI-compatible gateway let trusted tools on the same computer call the local speech engine.
Отзывы сообщества
Делитесь реальными workflows, запросами на интеграцию агентов и идеями продукта в Discord.
Ваши отзывы напрямую влияют на продукт.
Речевой движок на устройстве
Transcribe locally, review against an accurate timeline, then export or continue through the local gateway.