首页 游戏 软件 资讯 排行榜 专题
首页
科技数码
Grab视觉语言模型新突破!攻克东南亚多语言文档识别难题

Grab视觉语言模型新突破!攻克东南亚多语言文档识别难题

热心网友
93
转载
2025-11-30

东南亚科技企业Grab近日宣布,其自主研发的视觉大语言模型在文档处理领域取得突破性进展。这款专为东南亚多语言环境设计的模型,成功解决了传统技术处理非拉丁字母文档的难题,在身份证、驾照等关键证件识别任务中展现出显著优势。

作为覆盖新加坡、马来西亚、印尼等八个国家的超级应用平台,Grab每日需处理海量多语言文档。工程技术团队发现,现有商业模型在解析东南亚语言时普遍存在两大缺陷:一是字符识别错误率居高不下,二是图像处理延迟严重。即使开源视觉模型在效率上表现优异,但面对复杂文档模板时仍难以保证准确性,这给客户身份验证等合规工作带来巨大挑战。

研发团队经过技术评估,最终选定阿里云Qwen2-VL模型的作为基础架构。该模型具备三大核心优势:支持东南亚多语言处理、可动态适配不同分辨率图像,且模型体积适中便于部署。为构建专属训练数据集,工程师们从Common Crawle开源库中筛选东南亚语言内容,同时开发内部合成系统,生成包含多样化字体和背景的文本图像样本。

在模型优化阶段,团队采用分阶段微调策略。初期通过低秩适配技术快速验证印尼文本文档的处理效果,当发现泰语、越南语等语言存在特殊视觉模式后,立即启动全参数微调。经过数轮迭代训练,最终诞生的轻量化模型不仅在字符识别准确率上超越主流OCR工具,其图像处理速度较通用模型提升40%。

这项技术突破已产生实质性应用价值。在马来西亚驾照识别场景中,新模型将错误率从18%降至3.2%;越南身份证信息提取的完整率提升至97%,较传统方案提高23个百分点。Grab工程负责人表示,通过精准筛选高质量训练数据,小型专业模型完全能够实现效率与效果的双重突破。

目前,该模型已集成至Grab核心业务系统,支持打车、外卖、金融等场景的实时文档核验。研发团队正着手扩展模型能力边界,计划开发支持手写体识别、多语言混合文档解析等高级功能,以应对东南亚市场日益复杂的数字化需求。

来源:https://www.itbear.com.cn/html/2025-11/1009384.html
免责声明: 游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。

最新APP

宝宝过生日
宝宝过生日
应用辅助 04-07
台球世界
台球世界
体育竞技 04-07
解绳子
解绳子
休闲益智 04-07
骑兵冲突
骑兵冲突
棋牌策略 04-07
三国真龙传
三国真龙传
角色扮演 04-07

热门推荐

Cursor AI代码编辑器:智能编程工具的功能与使用指南
AI教程
Cursor AI代码编辑器:智能编程工具的功能与使用指南

在追求极致效率的现代软件开发中,一款名为Cursor的AI代码编辑器正引领着开发范式的变革。它被定义为“面向未来的IDE”,其核心理念清晰而有力:将人工智能深度无缝地集成到编码工作流的每一个步骤,为开发者创造一种前所未有的“AI结对编程”体验。 Cursor sh应用场景 那么,这款AI驱动的编辑器

热心网友
05.23
美图WHEE-WHEE AI视觉创作工具使用指南与功能详解
AI教程
美图WHEE-WHEE AI视觉创作工具使用指南与功能详解

在众多AI图像生成工具中,WHEE凭借其精准的产品定位与持续的功能迭代,正成为越来越多设计师和内容创作者的首选工具。它专注于打造高品质的AI视觉素材生成器,核心使命就是帮助用户快速、高效地获得可直接使用的优质图片素材。 那么,这款AI绘图工具究竟有哪些核心优势?下面我们从其关键特性与功能设计进行深入

热心网友
05.23
NightCafe Creator AI艺术生成器:手机创作数字绘画
AI教程
NightCafe Creator AI艺术生成器:手机创作数字绘画

在AI绘画工具不断涌现的当下,一款名为NightCafe Creator的应用以其全面的AI艺术生成能力脱颖而出。它不仅是一个简单的图片处理工具,更是一个融合了多种前沿人工智能技术的创意平台,帮助用户轻松实现从构思到成品的艺术创作。 NightCafe Creator是什么? NightCafe C

热心网友
05.23
加密市场恐慌蔓延 比特币以太坊为何领跌山寨币
web3.0
加密市场恐慌蔓延 比特币以太坊为何领跌山寨币

近期加密货币市场受到宏观经济不确定性及流动性紧缩影响,比特币(BTC)、以太坊(ETH)以及多种山寨币出现明显下行走势,市场情绪趋于谨慎。 比特币近期走势分析 比特币的价格近期表现如何?简单来说,它跌破了几个市场公认的关键支撑位,而且伴随交易量的放大。这种放量下跌的信号,往往意味着多空分歧加剧。无论

热心网友
05.23
蔡司6月2日发布新品镜头技术迎来重大突破
科技数码
蔡司6月2日发布新品镜头技术迎来重大突破

蔡司宣布将于6月2日发布一款新镜头,并称其为镜头技术的重大突破,标志着全新纪元的开启。官方仅公布了产品剪影,但措辞暗示其可能带来根本性的技术升级,例如全新光学结构、先进镀膜或对焦系统改进。具体细节需待发布日揭晓。

热心网友
05.23