大家好,我是超哥。今天给大家分享 腾讯 Hy-MT2 1.8B 多语言翻译 AI 模型本地部署教程。这是一款体积小、运行门槛低的翻译模型,即使是低配电脑,也能轻松运行。模型最大支持 262K 上下文,单次最多可翻译约 13 万字中文内容。模型支持 30多种语言,除了常规翻译,还支持指令遵循和 JSON 等结构化内容的翻译。部署完成后,支持离线使用,不受网络限制。下面我们开始教程。

博主电脑环境
显卡:NVIDIA GeForce RTX 4080 SUPER(16GB)
CPU:AMD Ryzen 9 7900X 12-Core Processor(12核)
内存:64GB(3600 MHz)
主板:微星 MAG B650 TOMAHAWK WIFI(MS-7D75)
主硬盘:三星 SSD 970 EVO Plus 1TB
一、Hy-MT2-1.8B AI模型下载
Hugging Face下载地址:https://huggingface.co/tencent/Hy-MT2-1.8B-GGUF/tree/main
夸克网盘下载地址:https://pan.quark.cn/s/07ee3dc9652e?pwd=fBYU
迅雷网盘下载地址:https://pan.xunlei.com/s/VP1ix5adxmLddbUvEXCnOblHA1?pwd=dxmw
电脑配置选择推荐:
| 模型版本 | 文件大小 | 适用电脑 | 推荐说明 |
|---|---|---|---|
| Hy-MT2-1.8B-Q4_K_M | 约 1.13 GB | 2GB 显存/普通 CPU | 文件最小,适合资源有限的电脑,优先推荐 |
| Hy-MT2-1.8B-Q6_K | 约 1.47 GB | 2GB 显存/普通 CPU | 精度更高,体积与效果均衡,适合大多数电脑 |
| Hy-MT2-1.8B-Q8_0 | 约 1.91 GB | 4GB 显存/普通 CPU | 精度更高,适合希望获得更好翻译效果的用户 |
X超哥推特:https://x.com/xchaoge
二、下载并配置 llama.cpp
1、下载并安装 llama.cpp
Github下载地址:https://github.com/ggml-org/llama.cpp/releases
夸克网盘下载地址:https://pan.quark.cn/s/c2266cd43d47?pwd=vn1G
迅雷网盘下载地址:https://pan.xunlei.com/s/VP1iy0s10mgF1i0U93yeWTm7A1?pwd=kp99

| 版本 | 适用硬件 | 说明 |
|---|---|---|
| Windows x64 (CPU) | Intel / AMD CPU | 仅使用处理器运行 |
| Windows arm64 (CPU) | ARM 架构 Windows 设备 | 适用于骁龙 X Elite 等 ARM 平台 |
| Windows x64 (CUDA 12) | NVIDIA 显卡 | 推荐大多数 RTX/GTX 用户使用 |
| Windows x64 (CUDA 13) | NVIDIA 显卡 | 适用于较新的 NVIDIA 驱动 |
| Windows x64 (Vulkan) | AMD / Intel / NVIDIA 显卡 | 通用显卡加速版本 |
| Windows x64 (SYCL) | Intel Arc 显卡 | Intel Arc 用户专用版本 |
| Windows x64 (HIP) | AMD Radeon 显卡 | AMD 用户首选版本 |
注意:显卡用户别忘了下载下图主程序后面的DLLs文件,下载后把里面的内容解压到llama.ccp主程序的根目录里,不然无法使用显卡运行模型。

2、Hy-MT2-1.8B 接入 llama.cpp
把下载到的大模型放到 llama.ccp 程序的根目录下的 models 目录里(需自行创建目录)
3、配置启动脚本
创建启动脚本,命名成:启动.bat
@echo off title Hy-MT2-1.8B - llama.cpp cd /d "%~dp0" echo. echo ======================================== echo XGDN.Com echo llama.cpp Local AI Server echo ======================================== echo. llama-server.exe ^ -m "models\模型名" ^ --host 127.0.0.1 ^ --port 8085 ^ -c 32768 ^ -ngl 99 ^ -fa auto ^ --jinja ^ --parallel 1 ^ --alias Hy-MT2-1.8B ^ --temp 0.7 ^ --top-p 0.6 ^ --top-k 20 ^ --repeat-penalty 1.05 ^ -n 4096 pause
访问控制面板 URL:
代码说明:
-m "models\模型名" ^
--port 端口号 ^
-c 上下文长度 ^
| 上下文设置 | 预计可容纳中文字符 | 适合用途 |
|---|---|---|
| -c 4096 | 约 2,000 字 | 短句、短段落翻译 |
| -c 8192 | 约 4,000 字 | 短篇文章、普通段落翻译 |
| -c 16384 | 约 8,000 字 | 中短篇文章翻译 |
| -c 32768 | 约 1.6 万字 | 一万字左右文章翻译 |
| -c 65536 | 约 3.2 万字 | 较长文章、报告翻译 |
| -c 131072 | 约 6.5 万字 | 长篇文章、长报告翻译 |
| -c 262144 | 约 13 万字 | 超长文本处理 |