StackFlow 是运行在边缘计算设备上的本地 AI 服务平台。它通过软件包提供大语言模型、多模态、计算机视觉、语音识别和语音合成等能力,并提供统一的服务调用方式。
不同设备的系统环境和计算平台有所区别,对应的软件源、安装命令和预装状态也可能不同。请从下方选择所使用的设备,进入相应的安装或更新教程。
StackFlow API 使用 JSON 数据包配置和调用 LLM、VLM、语音及视觉等功能服务。JSON 数据可以通过 UART 或 TCP 传输,具体通信接口取决于所使用的设备。
| 设备 | 通信方式 | 使用场景 |
|---|---|---|
| Module LLM | UART,默认 115200bps 8N1 | 由 Core、Arduino 或其他主控直接发送 JSON 指令 |
| LLM630 Compute Kit | TCP,默认端口 10001 | PC 或同一网络中的设备通过 Socket 发送 JSON 指令 |
| AI Pyramid | TCP,默认端口 10001 | 设备本机应用或网络客户端通过 Socket 发送 JSON 指令 |
无论使用 UART 还是 TCP,调用过程都由 JSON 消息完成。例如,客户端通过 action 和 object 指定操作,通过 data 传入模型及运行参数:
{
"request_id": "llm_001",
"work_id": "llm",
"action": "setup",
"object": "llm.setup",
"data": {
"model": "qwen2.5-0.5B-prefill-20e"
}
} 完成初始化后,客户端可以继续发送推理数据,并通过返回的 work_id 识别对应的任务。相关文档:
安装 llm-openai-api 后,设备会在本地提供与 OpenAI API 格式兼容的 HTTP 接口。OpenAI SDK、Chatbox 等现有客户端通常只需将服务地址修改为设备的 IP 地址,即可调用设备上运行的模型。
这里的“OpenAI 兼容”指接口格式兼容,并不表示模型运行在 OpenAI 云端;推理请求由本地设备处理。
按模型能力查看安装要求、调用方式和支持的硬件平台。
示例页面可能使用某款设备进行验证;能否在其他设备上运行,取决于该设备是否提供对应的功能服务与模型包。