Речевой движок на устройстве

Поместите большую речевую AI-модель на свой компьютер

EdgeSpeak сжимает профессиональные речевые модели для компьютера и локально расшифровывает встречи, интервью, видео и записи. Аудио, видео и расшифровки остаются на вашем устройстве.

  • Локальная транскрипция аудио/видео доступна
  • Локальный gateway и CLI доступны
  • Будущие обновления моделей и речевых возможностей
Предпросмотр транскрипта
Предпросмотр транскриптаlocal-transcribe.mov

Разработчикам · CLI & Skills

Установите CLI одной командой

Привычная установка в одну строку, как у инструментов разработчика, которыми вы уже пользуетесь. CLI самодостаточен: настольное приложение не требуется, транскрипция запускается прямо из терминала.

На macOS и Linux установка выполняется в Terminal, на Windows x64 — в PowerShell. CPU работает по умолчанию; Linux автоматически определяет NVIDIA CUDA, а в Windows CUDA включается явно.

macOS · Apple SiliconWindows x64 · CPU / CUDALinux x86_64 · CPU / CUDA
Документация CLI

macOS / Linux · Terminal

curl -fsSL https://edgespeak.com/install.sh | sh

Windows · PowerShell

irm https://edgespeak.com/install.ps1 | iex
edgespeak-cli login
edgespeak-cli transcribe media.mp4 -o media.srt
edgespeak-cli generate "Summarize this transcript" --model Qwen/Qwen3.5-4B

Agent Skills на том же движке

EdgeSpeak Skills учат Claude Code, Cursor и другие агенты с поддержкой Skills транскрибировать на устройстве через CLI. Открытый код на GitHub.

npx skills add lattifai/EdgeSpeak

Быстрая транскрипция на устройстве

Импортируйте аудио или видео и транскрибируйте локально с высокой точностью

Добавьте встречу, интервью или видео. EdgeSpeak выполняет понимание речи, генерацию текста и выравнивание на этом компьютере; следующие инструменты забирают текст через локальный gateway.

  1. EdgeSpeak на вашем устройстве

    EdgeSpeak превращает аудио и видео в текст на компьютере перед вами.

  2. Правьте во время прослушивания

    Текст следует за воспроизведением, поэтому проверка остается в одном рабочем месте.

  3. Результат идет дальше

    Экспортируйте текст или субтитры, либо передайте готовую транскрипцию другому инструменту.

Выделенная on-device модель

Lattice-2, созданный для компьютера

Lattice-2 сжат и оптимизирован для локального инференса, поэтому обычный компьютер эффективно обрабатывает встречи, интервью, видео и записи.

Сжатие и инференция на устройстве

Речевая AI-модель адаптирована к запуску на десктопе, сокращает ожидание, а локальная транскрипция не зависит от внешних сервисов.

Связка Flash / Pro

Flash быстрее отвечает для обычных встреч и видео. Pro рассчитан на более сложное аудио, акценты и более высокий потолок точности, используя больше локальных ресурсов.

Встраивается в developer workflow

Lattice-2 поддерживает более 40 языков, разные английские акценты и китайские диалекты; тот же локальный движок доступен CLI, агентам и автоматизации через gateway.

LOCAL LM + VLM · 0.6B — 27B

Локальные язык и зрение в единой среде EdgeSpeak.

EdgeSpeak теперь включает модели Qwen и Gemma от 0.6B до 27B. Одновременно загружается одна модель, при простое она засыпает.

Генерация локальной моделью
Qwen/Qwen3-0.6B0.6B0.4 GB
Qwen/Qwen3.5-0.8B0.8B0.5 GB
Qwen/Qwen3.5-2B2B1.3 GB
google/gemma-4-E2B-it2B3.1 GB
Qwen/Qwen3.5-4BПо умолчанию4B2.7 GB
google/gemma-4-E4B-it4B5.0 GB
Qwen/Qwen3.5-9B9B5.7 GB
google/gemma-4-12B-it12B7.1 GB
Qwen/Qwen3.6-27B27B16.8 GB

Текст + изображения · совместимо с OpenAI · локально

Настоящее desktop-приложение

EdgeSpeak работает прямо на вашем компьютере

Импортируйте аудио или видео, выберите локальную модель и экспортируйте результат. Для автоматизации передайте задачу CLI или агентам через локальный gateway.

Аудио, видео и транскрипт в одном рабочем пространствеВоспроизведение, таймлайн, транскрипт, экспорт, последние файлы и активная модель EdgeSpeak остаются вместе, чтобы меньше переключаться и не терять контекст.
Экран транскрипции EdgeSpeak Desktop с рабочим пространством, состоянием локальной модели EdgeSpeak, текстом, управлением воспроизведением и последними файлами.
Выберите модель EdgeSpeak под задачуEdgeSpeak поддерживает более 40 языков, разные английские акценты и китайские диалекты. Flash быстрый и сильный; Pro точнее и использует больше локальных ресурсов.
Экран моделей EdgeSpeak с локальными вариантами EdgeSpeak Flash и EdgeSpeak Pro.
Дайте другим инструментам доступ к EdgeSpeakCLI, агенты и автоматизация могут отправлять аудио в EdgeSpeak и получать транскрипт от EdgeSpeak.
Экран gateway в EdgeSpeak показывает, как инструменты на том же компьютере используют локальный речевой движок.

Workflows

Начните со своего речевого workflow

Работайте с приватными файлами, локальной расшифровкой аудио и видео, автоматизацией через агентов и выбором между локальным режимом и облаком.

Конфиденциальность

Локальная обработка речи прежде всего.

EdgeSpeak is designed so imported media and generated transcripts stay on your device unless you export, upload, or share them.

Сжатие и инференция на устройстве

Речевая AI-модель адаптирована к запуску на десктопе, сокращает ожидание, а локальная транскрипция не зависит от внешних сервисов.

Результат идет дальше

Экспортируйте текст или субтитры, либо передайте готовую транскрипцию другому инструменту.

Локальный речевой gateway

Позвольте агентам напрямую вызывать EdgeSpeak

EdgeSpeak предоставляет локальный речевой API, совместимый с OpenAI, чтобы CLI, агенты и автоматизация расшифровывали на том же компьютере. Это не ещё одно облако, а речевой gateway вашего компьютера.

Локальный OpenAI-compatible endpointCLI / агенты / автоматизацияEdgeSpeak Flash и Pro
POST /v1/audio/transcriptionslocalhost:1117
curl http://127.0.0.1:1117/v1/audio/transcriptions \
  -H "Authorization: Bearer sk-edgespeak-..." \
  -F file=@meeting.m4a \
  -F model="lattice-2-flash"

Choose by workflow

Local software, cloud APIs, or a model you maintain

The right option depends on where media can go, how much workflow you want ready-made, and who should maintain the speech stack.

Choose by workflowEdgeSpeakCloud transcriptionSelf-managed local model
Source mediaStays on this deviceUploaded to a remote serviceStays on the machine you configure
Review workflowDesktop playback, transcript, and exportDepends on the providerYou build the review surface
Tools and agentsLocal CLI and OpenAI-compatible gatewayHosted APIYou build and maintain the integration
OperationsInstall the app and local modelsManage an account, API keys, and network accessMaintain the runtime, models, and dependencies
Read the full comparison

Early bird

EdgeSpeak навсегда за $49

Текущая версия включает локальную расшифровку аудио и видео, локальный gateway и CLI. Купите один раз и получайте будущие обновления моделей и речевых функций.

Скачать

Установите EdgeSpeak на macOS.

Choose the current macOS build or open the Windows Beta page for the x64 installer and verified setup instructions.

Current macOS build

Use the available desktop build today. Your account keeps purchase, license, and device management in one place.

Windows build

Download the Windows x64 Beta, verify its SHA-256, and follow the installation guide. This Beta uses manual updates.

License and devices

Sign in with the email used for purchase, then manage your license key and activated devices from your account.

FAQ

Frequently asked questions

On-device processing, supported platforms, models, and the lifetime license — answered before you buy.

See all questions
01Does EdgeSpeak upload source media?

Imported media and generated transcripts stay on your device unless you export, upload, or share them yourself.

02Which desktop platforms are available?

EdgeSpeak is available for Apple Silicon Macs with macOS 14.0 or later. A Windows 10/11 x64 Beta is also available for manual installation; Windows in-app updates are not enabled yet.

03What does the lifetime license include?

The early-bird lifetime license is a one-time purchase for permanent use, future model and speech-capability updates, and up to four activated devices.

04What is the difference between Flash and Pro?

Flash is tuned for faster everyday transcription. Pro raises the accuracy ceiling for harder audio and uses more local resources.

05Can CLI tools and AI agents use EdgeSpeak?

Yes. The bundled CLI and local OpenAI-compatible gateway let trusted tools on the same computer call the local speech engine.

Отзывы сообщества

Улучшайте EdgeSpeak реальными workflows

Делитесь реальными workflows, запросами на интеграцию агентов и идеями продукта в Discord.

  • Реальные workflows
  • Agent / API
  • Идеи продукта

Ваши отзывы напрямую влияют на продукт.

Речевой движок на устройстве

Поместите большую речевую AI-модель на свой компьютер

Transcribe locally, review against an accurate timeline, then export or continue through the local gateway.

Скачать для macOS