CLI
从终端运行 EdgeSpeak 工作流。
安装
CLI 自带本机语音运行时,无需安装或启动桌面 App。请按操作系统选择命令。
macOS / Linux
在 Terminal 中运行。支持 macOS(Apple Silicon)和 Linux x86_64;Linux 安装器会在支持的 NVIDIA 设备上自动选择 CUDA 运行时,否则使用 CPU。
curl -fsSL https://edgespeak.com/install.sh | sh
sh ~/Downloads/install.shWindows
在 Windows x64 的 PowerShell 中运行。安装器默认安装 CPU 版,并把 edgespeak-cli 加入当前用户的 PATH,无需管理员权限。
irm https://edgespeak.com/install.ps1 | iex
如果需要在支持的 NVIDIA 显卡上启用 CUDA,请在同一个 PowerShell 窗口中显式选择 CUDA 版后再安装:
$env:EDGESPEAK_WINDOWS_ACCELERATOR = "cuda"
irm https://edgespeak.com/install.ps1 | iex安装后可直接运行 edgespeak-cli login。如果其他已打开的终端仍找不到命令,请重新打开终端,让 PATH 更新生效。
激活
使用 edgespeak-cli login 通过浏览器登录:新账号开始 7 天试用,已购账号激活当前设备。无需账号和浏览器的设备匿名试用使用 edgespeak-cli trial。已有授权 Key 可用 edgespeak-cli activate <KEY>,--stdin 可避免 Key 进入 shell 历史。
edgespeak-cli login
edgespeak-cli trial # instant device trial, no account or browser
edgespeak-cli activate <KEY>
edgespeak-cli activate --stdin # paste the key, then Ctrl-D工作流
可以完成转录与说话人标注、文稿对齐、语义分句、语音合成、声音管理、模型管理,也可以打开 Realtime Demo。大多数一次性命令会在 App 未运行时启动随附的本机引擎;serve 则会持续运行 Headless HTTP 服务,供 API 客户端反复调用。
edgespeak-cli transcribe meeting.m4a -o meeting.json # word-level timing in JSON
edgespeak-cli transcribe meeting.m4a --diarize -o speakers.json
edgespeak-cli transcribe meeting.m4a -o transcript.srt
edgespeak-cli align meeting.m4a --text-file transcript.txt -o aligned.json
edgespeak-cli segment --file transcript.txt -o sentences.json
edgespeak-cli speech "Read this aloud" -o speech.wav
edgespeak-cli voices list
edgespeak-cli models list
edgespeak-cli status
edgespeak-cli demo
edgespeak-cli updateHeadless API 服务
无需桌面 App,也可以启动兼容 OpenAI API 的 HTTP 服务。默认情况下,服务只监听 http://127.0.0.1:1118/v1。要供另一台可信机器调用,请在服务端(运行服务的机器)设置 EDGESPEAK_API_KEY,并显式开启非回环监听:
export EDGESPEAK_API_KEY="your-long-random-secret"
edgespeak-cli serve --host 0.0.0.0 --port 1118 --allow-remote通过 --context-tokens 在服务启动时设置语言模型上下文窗口。默认值为 8192 token,并应用于该进程启动的本机语言模型 worker。Headless Server 不读取桌面 App 保存的上下文选项。
edgespeak-cli serve --context-tokens 32768原生视频请求的采样率由模型目录自动选择:Qwen 3.5/3.6 为 2 FPS,Gemma 4 为 1 FPS,因此无需设置视频 FPS 参数。上下文长度和视频采样帧共享同一份内存与 token 预算。请求格式、运行依赖和资源影响见原生视频输入与上下文窗口。
调用端(发起调用的机器)应访问服务端实际使用的局域网或 VPN 地址,例如 http://192.168.1.50:1118/v1,不能使用 0.0.0.0。模型加载和推理都在服务端完成。客户端调用示例、防火墙配置、浏览器 Origin、SSH 隧道和 HTTPS 安全边界见从另一台机器调用 API。
Agent
通过 EdgeSpeak Skill 让 agent 调用,或把本地网关与 MCP 接入自动化和 CI。
隐私
语音工作流和已安装的本机模型都在当前设备运行。只有在你明确选择 execution_location=remote 的模型时,对应请求才会发送给已配置的供应商。
使用本机模型生成
启动桌面 App,下载并加载模型后,可通过 Responses、Chat Completions、CLI 或 MCP 调用;已安装的本机模型让提示词和图片留在当前设备。
edgespeak-cli models load Qwen/Qwen3.5-4B
edgespeak-cli generate "Summarize the meeting" --model Qwen/Qwen3.5-4B
edgespeak-cli generate "Describe this image" --image screenshot.png --json