腾讯混元OCR模型宣布开源：参数量1B 支持14种小语种翻译

IP属地中国·北京 编辑：吴婷凤凰网科技 时间：2025-11-25 16:10:01

11月25日，腾讯混元于11月25日推出开源OCR模型HunyuanOCR，该模型参数量为1B，基于混元原生多模态架构构建，在多项OCR应用评测中取得当前最优效果。
该模型采用端到端训练推理范式，通过单次前向推理即可完成多项任务，相比传统级联方案更具效率优势。其架构由原生分辨率视频编码器、自适应视觉适配器与轻量化语言模型三部分组成。
在性能方面，HunyuanOCR在复杂文档解析评测OmniDocBench中获得94.1分，超过谷歌Gemini3-pro等模型；在涵盖文档、街景、手写等九大场景的测试集上，其文字检测与识别能力领先同类开源及商业模型。同时，该模型支持14种小语种翻译，并在ICDAR2025文档翻译比赛中获得小模型赛道冠军。
目前该模型已应用于票据字段抽取、视频字幕识别及拍照翻译等场景，并正式对外开放源代码。

标签：模型文档翻译架构 分辨率 开源 商业模型 赛道

免责声明：本网信息来自于互联网，目的在于传递更多信息，并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益，请及时联系我们，本站将会在24小时内处理完毕。

同类资讯

理想L6升级51kWh电池包：增程老将转型，纯电浪潮下如何破局突围？

2026海南欢乐节启幕！欢乐巴士、自驾、公交等多样出行攻略来啦

阿里“AI编程第一”，智谱、Kimi答应吗？

B站连续三年亮相WAIC 月均超1.9亿用户消费AI内容

华为MateBook Pro获国家级人工智能认证L3级首证

Kimi K3震荡美股，有望最快6个月内港股上市

全站最新

理想L6升级51kWh电池包：增程老将转型，纯电浪潮下如何破局突围？

2026海南欢乐节启幕！欢乐巴士、自驾、公交等多样出行攻略来啦

保时捷911 GT3测试车现身纽北，“鸭尾”设计重现经典元素引关注

智己LS9 Hyper携线控转向入场30万级市场，技术实力能否撬动销量？

热门推荐

理想L6升级51kWh电池包：增程老将转型，纯电浪潮下如何破局突围？

2026海南欢乐节启幕！欢乐巴士、自驾、公交等多样出行攻略来啦

五菱星光L上市，思行：产品外观在所有的购车因素里排名第一

阿里“AI编程第一”，智谱、Kimi答应吗？

B站连续三年亮相WAIC 月均超1.9亿用户消费AI内容

华为MateBook Pro获国家级人工智能认证L3级首证

Kimi K3震荡美股，有望最快6个月内港股上市

实测Kimi K3：强得意外，慢得着急

吉利银河同款技术下放！领克20官宣搭载全球首款16合1电驱

造车新规矩落地！工信部要求车企自查零部件供应链一致性

一只猴卖20万！净利润飙涨超1300%，“猴茅”昭衍新药赚翻了

黄牛捏造张凌赫三地见面会疯狂售票阿维塔发布严正声明

荣耀CEO李健：AI将向“伙伴型类人生命体”演进

机器人不缺表演，缺的是工作经验

网传尚界汽车脱离鸿蒙智行，官方辟谣