Techub News 消息,Jina AI 发布了端到端视觉文档解析模型 jina-ocr-v1。该模型总参数量为 34 亿,每次推理激活约 5.7 亿解码器参数,内置推测解码技术,旨在服务于 NVIDIA L4 等低预算 GPU。模型可将 PDF、扫描件、表格、图表或发票一次性转换为干净的 Markdown 格式。 在 OmniDocBench v1.6 基准测试中,jina-ocr-v1 得分为 91.14,在 olmOCR-Bench 上得分为 83.4。在单张 A100 40GB GPU 上,其解析速度为每秒 2.57 页,在 Jina AI 测试的 14 个系统中最高。模型权重约 6.8 GB,采用 BF16 格式,基于 CC BY-NC 4.0 许可,供研究和非商业用途使用。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。
本网站不保证信息的准确性、有效性、及时性和完整性。
任何依赖于本网站所提供信息的行为,均由用户自行承担风险。
Techub News 消息,Jina AI 发布了端到端视觉文档解析模型 jina-ocr-v1。该模型总参数量为 34 亿,每次推理激活约 5.7 亿解码器参数,内置推测解码技术,旨在服务于 NVIDIA L4 等低预算 GPU。模型可将 PDF、扫描件、表格、图表或发票一次性转换为干净的 Markdown 格式。 在 OmniDocBench v1.6 基准测试中,jina-ocr-v1 得分为 91.14,在 olmOCR-Bench 上得分为 83.4。在单张 A100 40GB GPU 上,其解析速度为每秒 2.57 页,在 Jina AI 测试的 14 个系统中最高。模型权重约 6.8 GB,采用 BF16 格式,基于 CC BY-NC 4.0 许可,供研究和非商业用途使用。(MarkTechPost)
如您认为本页面(或本平台)内容存在侵权或违规情形,请您在发现之日起尽快与我们联系,并提供:权利人姓名/名称及联系方式、被侵权作品名称及权属证明、具体侵权链接及情况说明。我们在核实后将及时处理相关内容。
联系方式:creator@techub.news
商务合作:contacting@techub.news
点击链接下载 Techub News App,获取最新讯息:
https://www.techub.news/download
(或扫描下方二维码下载)

本网站所提供的所有信息仅供参考之用。本网站不保证信息的准确性、有效性、及时性和完整性。任何依赖于本网站所提供信息的行为,均由用户自行承担风险。