阿里云大模型服务平台 “百炼” 近日完成了通义千问 VL-OCR 模型的升级,新版本基于 Qwen-VL 训练的 OCR 识别大模型在复杂场景下的文字识别能力显著提升。特别值得一提的是,针对医疗单据、古文献等特殊字体的识别准确率提高了 23%,为金融、档案数字化等行业提供了更高效的标准化解决方案。此外,该模型还支持多语言混合排版识别,进一步拓宽了应用场景。

  • 古文献数字化终于有救了!以前很多古籍因为字体特殊,识别率低,现在能提升 23%,简直是文化保护的利器。

  • 多语言混合排版识别太实用了,跨境电商能用上。

  • 医疗单据的 OCR 识别一直是难点,这次升级对医院和医疗信息化企业来说简直是福音!期待能尽快应用到实际系统中,减少人工录入的工作量。

前往“AIWW”小程序,更好用