惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

G
Google Developers Blog
GbyAI
GbyAI
Y
Y Combinator Blog
The GitHub Blog
The GitHub Blog
B
Blog
博客园 - 叶小钗
V
Visual Studio Blog
小众软件
小众软件
阮一峰的网络日志
阮一峰的网络日志
博客园 - 聂微东
S
SegmentFault 最新的问题
Engineering at Meta
Engineering at Meta
博客园 - Franky
V
V2EX
人人都是产品经理
人人都是产品经理
H
Hackread – Cybersecurity News, Data Breaches, AI and More
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
月光博客
月光博客
IT之家
IT之家
T
The Blog of Author Tim Ferriss
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
C
Check Point Blog
N
Netflix TechBlog - Medium
博客园 - 【当耐特】

Prompt 语宙

kimi-thinking-preview – 月之暗面推出的多模态思考模型 pdf-craft – 开源 PDF 转 Markdown 工具 UltraMem – 字节豆包大模型团队推出的全新超稀疏模型架构 EasyControl – Tiamat AI 联合上海科大等开源的图像生成控制框架 GaussianCity – 南洋理工大学 S-Lab 团队推出的 3D 城市生成框架 X-Prompt – 用于多模态视频目标分割的通用框架 豆包大模型1.5 – 字节跳动推出的最新版大模型 GaussianAnything – 南洋理工 S-Lab 和上海 AI Lab 等推出的 3D 生成框架 Cube 3D – Roblox 推出的 AI 3D 生成模型 OpenMath-Nemotron – 英伟达开源的数学推理系列模型 MAI Transcribe-1.5 – 微软 MAI 推出的语音转文本模型 Seed1.5-Embedding – 字节跳动 Seed 团队推出的向量模型 2026世界杯人机大战引爆!联想携手DeepSeek等顶尖AI大模型,对战亿万球迷预测冠军 高考公平守护战!豆包、文心等主流大模型集体禁用拍题功能 ShotAdapter – Adobe联合UIUC推出的多镜头视频生成框架 Devstral – Mistral AI联合All Hands AI开源的编程专用AI模型 MMaDA – 字节联合普林斯顿大学等推出的多模态扩散模型 Software Copyright Materials Skill – 开源软著资料生成Skill Dulus – 开源的 CLI AI Agent,可驱动多模型工具调用 Reasonix – 专为 DeepSeek 推出的开源终端编程 Agent Mega-ASR – NTU、NUS、上海AI Lab开源的语音识别模型 CodeGraph – 开源代码知识图谱工具,加速代码理解和分析 MiniCPM5-1B – 面壁智能联合清华开源的端侧文本基座模型 Horizon – 开源 AI 信息聚合系统,构建专属新闻雷达 BitCPM-CANN – 面壁智能联合清华开源的端侧大模型 Xiaomi Auto World Model – 小米推出的辅助驾驶世界模型 opera-browser-cli – Opera Neon 开源的命令行工具 omp – 开源的 AI 终端编程智能体,能与 IDE 深度联动 Claude Opus 4.8 – Anthropic 推出的旗舰级大语言模型 Hy-Memory – 腾讯混元推出的 Agent 记忆插件
腾讯混元Tencent-HY-MT1.5开源翻译模型:1.8B端侧量化仅需1GB...
站外新闻 · 2026-06-14 · via Prompt 语宙

💡 站外导读:随着全球化进程加速与AI技术渗透,高质量、低延迟、可离线的多语言翻译需求日益迫切,尤其在移动办公、跨境交流和专业内容创作领域。腾讯混元团队正式开源其翻译模型Tencent-HY-MT1.5,旨在解决现有翻译工具在端侧部署、小语种覆盖、专业术语一致性以及长上下文理解方面的核心痛点,为开发者与用户提供兼顾性能与实用性的新选择。

Tencent-HY-MT1.5 是腾讯混元开源的翻译模型,包含两个版本Tencent-HY-MT1.5-1.8B 和 Tencent-HY-MT1.5-7B。模型支持33种国际语言互译及5种民汉/方言翻译,覆盖多种小语种。1.8B版本经过量化处理,仅需1GB内存即可在手机等消费级设备上实现端侧离线实时翻译,处理速度快。7B版本面向高性能场景,翻译准确率高,有效减少译文中夹带注释和语种混杂的情况。

  • Tencent-HY-MT1.5是什么
  • Tencent-HY-MT1.5的主要功能
  • Tencent-HY-MT1.5的技术原理
  • 如何使用Tencent-HY-MT1.5
  • Tencent-HY-MT1.5的项目地址
  • Tencent-HY-MT1.5的应用场景
      • 📝 站长洞察 (Editor’s Insight)

Tencent-HY-MT1.5

Tencent-HY-MT1.5的主要功能

  • 多语言支持:涵盖 33 个语种的互译以及 5 种民汉/方言,除常见的中、英、日语等,还包括捷克语、马拉地语、爱沙尼亚语、冰岛语等小语种。

  • 端侧部署能力:HY-MT1.5-1.8B 经过量化处理,仅需 1GB 内存即可在手机等消费级设备上实现离线实时翻译,处理 50 个 tokens 的平均耗时仅 0.18 秒,远快于主流商用翻译 API 的 0.4 秒。

  • 翻译质量高:HY-MT1.5-1.8B 在 FLORES-200 等权威测试集中,效果达到 Gemini-3.0-Pro 等超大尺寸闭源模型的 90 分位水平,全面超越中等尺寸开源模型。

  • 实用性增强:支持术语库自定义、上下文长文本理解以及带格式文本翻译,用户可导入专业术语表,模型能基于前文语境优化后续翻译,并保留原始排版格式。

Tencent-HY-MT1.5的技术原理

  • On-Policy Distillation 策略:1.8B 模型采用了 On-Policy Distillation(大尺寸模型蒸馏)策略,由 7B 大模型作为教师实时引导训练,避免小模型死记硬背标准答案,通过纠正在预测序列分布时的偏移,让小模型从错误中学习,显著提升了小模型的泛化能力和翻译质量。

  • 术语库自定义:用户可针对不同行业与专业场景构建专属术语对照表,导入术语库后,模型在翻译过程中会优先采纳用户定义的标准术语,确保关键术语的准确性和一致性。

  • 上下文翻译:模型具备长文本与对话上下文理解能力,可基于前文语境持续优化后续翻译结果,适用于会议记录、访谈内容、小说章节、技术文档等长篇内容的翻译。

  • 带格式翻译:模型能保持翻译前后的格式信息不变,适用于网页、文档等结构化内容的翻译。

如何使用Tencent-HY-MT1.5

  • 获取模型:访问腾讯混元官网在线体验;可访问GitHub或 HuggingFace平台,下载所需的 Tencent-HY-MT1.5-1.8B 或 Tencent-HY-MT1.5-7B 模型部署使用。

  • 端侧部署:Tencent-HY-MT1.5-1.8B 经过量化,仅需 1GB 内存即可在手机等消费级设备上实现端侧直接部署和离线实时翻译。

  • 云侧部署:Tencent-HY-MT1.5-7B 适合高性能场景,可部署在云端,与 1.8B 模型协同使用,提升效果的一致性和稳定性。

Tencent-HY-MT1.5的项目地址

  • GitHub仓库:https://github.com/Tencent-Hunyuan/HY-MT)
  • HuggingFace模型库:https://huggingface.co/collections/tencent/hy-mt15

Tencent-HY-MT1.5的应用场景

  • 移动设备翻译:Tencent-HY-MT1.5-1.8B 经过量化处理,仅需 1GB 内存即可在手机等消费级设备上实现端侧离线实时翻译,适用于移动设备上的即时翻译需求,如旅行中的语言交流、即时通讯中的跨语言对话等。

  • 高性能翻译服务:Tencent-HY-MT1.5-7B 面向高性能场景,适合部署在云端,为需要高翻译质量的企业级应用提供服务,如跨国企业的文档翻译、专业领域的技术文档翻译等。

  • 多语言内容创作:支持 33 种国际语言互译及 5 种民汉/方言翻译,能满足内容创作者在多语言环境下的创作需求,如多语言视频字幕制作、跨语言文学创作等。

  • 专业术语翻译:支持术语库自定义,用户可导入专业术语表,模型在翻译过程中会优先采纳用户定义的标准术语,适用于专业领域的翻译需求,如医学、法律、科技等行业的翻译。

  • 长文本翻译:具备长文本与对话上下文理解能力,能基于前文语境持续优化后续翻译结果,适用于会议记录、访谈内容、小说章节、技术文档等长篇内容的翻译。

  • 格式化内容翻译:能保持翻译前后的格式信息不变,适用于网页、文档等结构化内容的翻译,确保翻译后的格式与原文一致。

📝 站长洞察 (Editor’s Insight)

腾讯混元此次开源的Tencent-HY-MT1.5,精准切中了当前AI落地的一个关键矛盾:大模型的高性能与端侧设备资源有限之间的冲突。其1.8B版本通过先进的量化与蒸馏技术,将强大翻译能力压缩至1GB内存即可运行,这不仅是技术上的突破,更预示了未来“AI平民化”与“边缘智能”的重要趋势——真正的智能应无处不在,而非仅限于云端。同时,支持术语库自定义与上下文翻译,显示了腾讯对产业实际需求的深刻理解,翻译正从“通用工具”向“行业伙伴”演进。此次开源,不仅为开源社区贡献了高质量的翻译基座模型,也为中国AI企业在垂直领域构建技术护城河提供了新范式。