小体积也能打!腾讯 Hy-MT2 1.8B 多语言翻译 AI 模型本地部署教程|33种语言|无需联网|CPU也能跑

大家好,我是超哥。今天给大家分享 腾讯 Hy-MT2 1.8B 多语言翻译 AI 模型本地部署教程。这是一款体积小运行门槛低翻译模型,即使是低配电脑,也能轻松运行。模型最大支持 262K 上下文,单次最多可翻译约 13 万字中文内容。模型支持 30多种语言,除了常规翻译,还支持指令遵循JSON 等结构化内容的翻译。部署完成后,支持离线使用不受网络限制。下面我们开始教程。

博主电脑环境

显卡:NVIDIA GeForce RTX 4080 SUPER(16GB)

CPU:AMD Ryzen 9 7900X 12-Core Processor(12核)

内存:64GB(3600 MHz)

主板:微星 MAG B650 TOMAHAWK WIFI(MS-7D75)

主硬盘:三星 SSD 970 EVO Plus 1TB

一、Hy-MT2-1.8B AI模型下载

Hugging Face下载地址:https://huggingface.co/tencent/Hy-MT2-1.8B-GGUF/tree/main

夸克网盘下载地址:https://pan.quark.cn/s/07ee3dc9652e?pwd=fBYU

迅雷网盘下载地址:https://pan.xunlei.com/s/VP1ix5adxmLddbUvEXCnOblHA1?pwd=dxmw

电脑配置选择推荐:

模型版本 文件大小 适用电脑 推荐说明
Hy-MT2-1.8B-Q4_K_M 约 1.13 GB 2GB 显存/普通 CPU 文件最小,适合资源有限的电脑,优先推荐
Hy-MT2-1.8B-Q6_K 约 1.47 GB 2GB 显存/普通 CPU 精度更高,体积与效果均衡,适合大多数电脑
Hy-MT2-1.8B-Q8_0 约 1.91 GB 4GB 显存/普通 CPU 精度更高,适合希望获得更好翻译效果的用户

X超哥推特:https://x.com/xchaoge

二、下载并配置 llama.cpp

1、下载并安装 llama.cpp

Github下载地址:https://github.com/ggml-org/llama.cpp/releases

夸克网盘下载地址:https://pan.quark.cn/s/c2266cd43d47?pwd=vn1G

迅雷网盘下载地址:https://pan.xunlei.com/s/VP1iy0s10mgF1i0U93yeWTm7A1?pwd=kp99

版本 适用硬件 说明
Windows x64 (CPU) Intel / AMD CPU 仅使用处理器运行
Windows arm64 (CPU) ARM 架构 Windows 设备 适用于骁龙 X Elite 等 ARM 平台
Windows x64 (CUDA 12) NVIDIA 显卡 推荐大多数 RTX/GTX 用户使用
Windows x64 (CUDA 13) NVIDIA 显卡 适用于较新的 NVIDIA 驱动
Windows x64 (Vulkan) AMD / Intel / NVIDIA 显卡 通用显卡加速版本
Windows x64 (SYCL) Intel Arc 显卡 Intel Arc 用户专用版本
Windows x64 (HIP) AMD Radeon 显卡 AMD 用户首选版本

注意:显卡用户别忘了下载下图主程序后面的DLLs文件,下载后把里面的内容解压到llama.ccp主程序的根目录里,不然无法使用显卡运行模型。

2、Hy-MT2-1.8B 接入 llama.cpp

把下载到的大模型放到 llama.ccp 程序的根目录下的 models 目录里(需自行创建目录)

3、配置启动脚本

创建启动脚本,命名成:启动.bat

@echo off
title Hy-MT2-1.8B - llama.cpp

cd /d "%~dp0"

echo.
echo ========================================
echo       XGDN.Com
echo       llama.cpp Local AI Server
echo ========================================
echo.

llama-server.exe ^
  -m "models\模型名" ^
  --host 127.0.0.1 ^
  --port 8085 ^
  -c 32768 ^
  -ngl 99 ^
  -fa auto ^
  --jinja ^
  --parallel 1 ^
  --alias Hy-MT2-1.8B ^
  --temp 0.7 ^
  --top-p 0.6 ^
  --top-k 20 ^
  --repeat-penalty 1.05 ^
  -n 4096

pause

访问控制面板 URL:

http://127.0.0.1:8085

代码说明

-m "models\模型名" ^

--port 端口号 ^

-c 上下文长度 ^

上下文设置 预计可容纳中文字符 适合用途
-c 4096 约 2,000 字 短句、短段落翻译
-c 8192 约 4,000 字 短篇文章、普通段落翻译
-c 16384 约 8,000 字 中短篇文章翻译
-c 32768 约 1.6 万字 一万字左右文章翻译
-c 65536 约 3.2 万字 较长文章、报告翻译
-c 131072 约 6.5 万字 长篇文章、长报告翻译
-c 262144 约 13 万字 超长文本处理
上一篇无审查2B模型,太爽了!MiniCPM5-2B AI 模型本地部署教程|接入 Hermes Agent 下一篇没有了