离线翻译
下载翻译模型到本地部署,在无网络环境中使用 iTranslator 的全部翻译能力,满足数据安全与合规需求。提供 NMT 翻译、OCR 识别、ASR 语音识别等多种离线模型,支持 Docker 容器化部署和 GPU 加速,适用于金融、医疗、政府等数据不出网场景,以及嵌入式设备和网络不稳定环境。
快速概览
Quick Overview
| 属性 | 说明 |
|---|---|
| 模型列表端点 | GET /v1/offline/models |
| 模型下载端点 | GET /v1/offline/models/{model_id}/download |
| 本地翻译端点 | POST /v1/translate(部署后本地调用) |
| 认证 | Bearer Token(云 API);本地部署免认证 |
| 模型类型 | NMT 翻译 / OCR 识别 / ASR 语音识别 |
| 部署方式 | Docker 容器 / 二进制 / 库集成 |
| GPU 加速 | 可选,NVIDIA CUDA 11+,CPU 亦可运行 |
| 网络要求 | 仅下载模型时需联网,部署后完全离线运行 |
💡 适用场景
金融、医疗、政府等对数据出网有严格要求的行业;偏远地区网络不稳定环境;嵌入式设备集成;军事、涉密单位等完全隔离网络环境。
获取可用模型列表
List Available Models
GET/v1/offline/models
认证
Authentication
云端 API 请求需在 HTTP Header 中携带 Access Token(下载模型时需要)。模型部署到本地后,本地 API 调用无需认证。
Authorization: Bearer {access_token}请求头
Request Headers
| 请求头 | 必填 | 说明 |
|---|---|---|
Authorization | required | 格式 Bearer {access_token},用于身份认证 |
查询参数
Query Parameters
| 参数 | 类型 | 说明 | |
|---|---|---|---|
| type | string | optional | 按类型筛选:nmt(翻译)/ ocr(识别)/ asr(语音) |
模型列表
Model List
| Model ID | 语言/能力 | 大小 | 类型 | 版本 | 说明 |
|---|---|---|---|---|---|
fanyi-nmt-base |
通用 100+ 语言 | 1.2 GB | NMT | v2.4 | 全量模型,翻译质量最高,推荐服务器部署 |
fanyi-nmt-small |
常用 30 语言 | 380 MB | NMT | v2.4 | 轻量模型,适合边缘设备和低资源环境 |
fanyi-nmt-zh-en |
中英双向 | 520 MB | NMT | v2.4 | 中英专用优化模型,翻译质量优于通用模型 |
fanyi-ocr-v2 |
中英日韩 + 通用 | 240 MB | OCR | v2.1 | 图片文字识别模型,支持印刷体和手写体 |
fanyi-asr-multilingual |
50+ 语言 | 1.8 GB | ASR | v3.0 | 语音识别模型,支持实时流式和批量识别 |
fanyi-asr-zh |
中文专用 | 680 MB | ASR | v3.0 | 中文语音识别专用模型,准确率更高 |
模型列表响应示例
Model List Response Example
{
"models": [
{
"model_id": "fanyi-nmt-base",
"type": "nmt",
"languages": "100+",
"size_bytes": 1288490188,
"version": "v2.4",
"description": "通用 NMT 翻译模型,100+ 语言",
"download_url": "https://api.itranslator.cc/v1/offline/models/fanyi-nmt-base/download",
"updated_at": "2026-06-15T00:00:00Z"
},
{
"model_id": "fanyi-nmt-small",
"type": "nmt",
"languages": "30",
"size_bytes": 398458884,
"version": "v2.4",
"description": "轻量 NMT 翻译模型,30 种常用语言",
"download_url": "https://api.itranslator.cc/v1/offline/models/fanyi-nmt-small/download",
"updated_at": "2026-06-15T00:00:00Z"
}
],
"total": 6
}查询模型详情
Get Model Details
GET/v1/offline/models/{model_id}
查询单个模型的详细信息,包括支持的语言列表、版本历史和下载地址。
curl -X GET https://api.itranslator.cc/v1/offline/models/fanyi-nmt-base \ -H "Authorization: Bearer YOUR_ACCESS_TOKEN"
{
"model_id": "fanyi-nmt-base",
"type": "nmt",
"languages": ["zh", "en", "ja", "ko", "de", "fr", "es", "..."],
"language_count": 104,
"size_bytes": 1288490188,
"version": "v2.4",
"description": "通用 NMT 翻译模型,支持 100+ 语言互译",
"min_ram": "4 GB",
"gpu_optional": true,
"download_url": "https://api.itranslator.cc/v1/offline/models/fanyi-nmt-base/download",
"checksum": "sha256:a1b2c3d4e5f6...",
"updated_at": "2026-06-15T00:00:00Z",
"versions": [
{ "version": "v2.4", "updated_at": "2026-06-15T00:00:00Z", "changelog": "优化小语种翻译质量" },
{ "version": "v2.3", "updated_at": "2026-03-10T00:00:00Z", "changelog": "新增 5 种非洲语言" }
]
}下载模型
Download Model
GET/v1/offline/models/{model_id}/download
下载模型压缩包(.tar.gz 格式),下载后解压到本地 models 目录即可使用。建议下载后校验 checksum 确保文件完整性。
# 下载模型 curl -o fanyi-nmt-base.tar.gz \ -H "Authorization: Bearer YOUR_ACCESS_TOKEN" \ https://api.itranslator.cc/v1/offline/models/fanyi-nmt-base/download # 解压到 models 目录 tar -xzf fanyi-nmt-base.tar.gz -C ./models # 校验文件完整性 sha256sum ./models/fanyi-nmt-base/model.bin
下载说明
- 模型文件较大,建议使用
stream模式下载,避免内存溢出 - 下载链接有效期 24 小时,过期后需重新获取
- 支持断点续传,下载中断后可使用
Range请求头继续
请求示例
Request Examples
curl "https://api.itranslator.cc/v1/offline/models?type=nmt" \ -H "Authorization: Bearer YOUR_ACCESS_TOKEN"
本地部署 / Docker
Local Deploy via Docker
推荐使用 Docker 部署离线翻译服务,支持 CPU 和 GPU 两种镜像。部署后通过本地 HTTP 接口调用,无需联网。
CPU 部署
CPU Deployment
docker pull itranslator/offline-server:latest
docker run -d \
--name itranslator-offline \
-p 8080:8080 \
-v ./models:/models \
-e MODEL_PATH=/models/fanyi-nmt-base \
-e MAX_WORKERS=4 \
--restart unless-stopped \
itranslator/offline-server:latest
# 查看服务状态
docker logs -f itranslator-offline
# 本地调用(无需认证)
curl -X POST http://localhost:8080/v1/translate \
-H "Content-Type: application/json" \
-d '{"source_lang":"zh","target_lang":"en","text":"你好世界"}'GPU 部署(NVIDIA)
GPU Deployment (NVIDIA)
docker pull itranslator/offline-server:latest-gpu docker run -d \ --name itranslator-offline-gpu \ -p 8080:8080 \ --gpus all \ -v ./models:/models \ -e MODEL_PATH=/models/fanyi-nmt-base \ -e DEVICE=cuda \ -e MAX_WORKERS=8 \ --restart unless-stopped \ itranslator/offline-server:latest-gpu
Docker Compose 部署
Docker Compose
# docker-compose.yml
version: "3.8"
services:
itranslator-offline:
image: itranslator/offline-server:latest
ports:
- "8080:8080"
volumes:
- ./models:/models
environment:
- MODEL_PATH=/models/fanyi-nmt-base
- MAX_WORKERS=4
- LOG_LEVEL=info
restart: unless-stopped
healthcheck:
test: ["CMD", "curl", "-f", "http://localhost:8080/health"]
interval: 30s
timeout: 10s
retries: 3
# 启动
docker-compose up -d环境变量配置
Environment Variables
| 变量 | 默认值 | 说明 |
|---|---|---|
MODEL_PATH | 必填 | 模型目录路径,如 /models/fanyi-nmt-base |
DEVICE | cpu | 推理设备:cpu / cuda |
MAX_WORKERS | 4 | 最大并发工作线程数 |
MAX_BATCH_SIZE | 32 | 批量推理最大句子数 |
LOG_LEVEL | info | 日志级别:debug / info / warn / error |
LISTEN_PORT | 8080 | 服务监听端口 |
本地 API 参考
Local API Reference
服务部署后,通过本地 HTTP 接口调用翻译能力,接口与云端 文本翻译 API 兼容。
POSThttp://localhost:8080/v1/translate
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| text | string | required | 待翻译文本,最大 5000 字符 |
| source_lang | string | required | 源语言代码,auto 为自动检测 |
| target_lang | string | required | 目标语言代码 |
curl -X POST http://localhost:8080/v1/translate \
-H "Content-Type: application/json" \
-d '{
"text": "人工智能正在改变世界",
"source_lang": "zh",
"target_lang": "en"
}'{
"translated_text": "Artificial intelligence is changing the world",
"source_lang": "zh",
"target_lang": "en",
"detected_lang": "zh",
"processing_time_ms": 85
}
💡 云端与本地 API 对比
- 本地 API 免认证,响应更快(无网络延迟),适合内网环境
- 云端 API 支持更多语言和高级特性(术语库、翻译记忆库、润色等)
- 建议重要数据走本地,非敏感内容走云端以获得更优翻译质量
系统要求
System Requirements
| Minimum | Recommended | |
|---|---|---|
| 操作系统 | Linux x86_64 / macOS | Ubuntu 22.04 / CentOS 8+ |
| CPU | 4 核 | 8+ 核 |
| 内存 | 4 GB | 16 GB |
| 磁盘 | 10 GB | 50 GB SSD |
| GPU | 可选 | NVIDIA CUDA 11+ / 8GB VRAM |
| Docker | 20.10+ | 24.0+(推荐 Compose v2) |
| 网络 | 仅下载时需要 | 部署后完全离线 |
性能参考
| 配置 | 吞吐量 | 延迟 |
|---|---|---|
| 4 核 CPU + 4GB | ~200 字/秒 | ~50ms |
| 8 核 CPU + 16GB | ~500 字/秒 | ~30ms |
| GPU RTX 3090 | ~3000 字/秒 | ~15ms |
错误码
Error Codes
| HTTP Code | 错误码 | 说明 |
|---|---|---|
| 200 | 0 | 成功 |
| 400 | 1001 | 参数错误,请检查必填参数和参数格式 |
| 400 | 1002 | 不支持的语言代码 |
| 400 | 1017 | 模型 ID 不存在或不可用 |
| 400 | 1018 | 模型与指定语言不兼容,该模型不支持此语言对 |
| 401 | 2001 | 认证失败,Token 无效或已过期 |
| 403 | 2003 | 无权限访问该资源或未开通离线 SDK 权限 |
| 404 | 2005 | 模型文件不存在或下载链接已过期 |
| 413 | 3001 | 请求文本超出长度限制(最大 50,000 字符) |
| 429 | 4001 | 请求频率超限,请稍后重试 |
| 456 | 4002 | 套餐配额已用尽,请升级或等待重置 |
| 500 | 5001 | 服务器内部错误,请重试或联系技术支持 |
| 503 | 5002 | 服务暂时不可用,建议稍后重试 |
最佳实践
Best Practices
- 按需选择模型:仅需中英翻译选
fanyi-nmt-zh-en,多语言选fanyi-nmt-base,资源受限设备选fanyi-nmt-small。 - GPU 加速提升吞吐:高并发场景部署 GPU 版本,吞吐量可达 CPU 的 6~10 倍,延迟降低 50%+。
- 模型版本管理:定期查询模型详情接口检查更新,新版本通常提升翻译质量,更新时建议灰度切换。
- 校验文件完整性:下载后务必校验
checksum,避免传输损坏导致模型加载失败。 - 健康检查:Docker 部署配置
healthcheck,定期访问/health端点监控服务可用性。 - 混合部署策略:敏感数据走本地离线服务,非敏感内容走云端 API 获得更优翻译质量和高级特性。
应用场景
Use Cases
| 场景 | 推荐模型 | 说明 |
|---|---|---|
| 🏦 金融/银行 | fanyi-nmt-zh-en | 内网部署,合同/报告翻译不出网,满足合规审计要求 |
| 🏥 医疗/病历 | fanyi-nmt-base | 病历、处方本地翻译,保护患者隐私数据 |
| 🏛️ 政府/涉密 | fanyi-nmt-base + OCR | 完全隔离网络环境,文档翻译+图片识别全程离线 |
| 📡 边缘设备 | fanyi-nmt-small | 低资源嵌入式设备,轻量模型占用小、启动快 |
| 🌐 多语言客服 | fanyi-nmt-base + ASR | 本地语音识别+翻译,实时多语言客服无网络依赖 |
| 📦 离线翻译机 | fanyi-nmt-small + ASR | 便携翻译设备,无网环境下语音实时翻译 |
使用说明
- 所有 API 请求均使用 HTTPS,建议开启 HTTP Keep-Alive 以提高性能。
- 请勿在客户端代码中暴露 Access Token,建议通过后端代理调用。
- 推荐设置合理的超时时间(30 秒),并实现指数退避重试策略。
iTranslator