DeepSeek开源3B OCR模型:97%精度刷新长文本压缩极限-冷钱包app下载官网

DeepSeek开源3B OCR模型:97%精度刷新长文本压缩极限-冷钱包app下载官网

快科技10月21日消息,据媒体报道,DeepSeek在GitHub上开源了其最新研究成果DeepSeek-OCR模型。

据介绍,DeepSeek-OCR的参数量约为3B,是研究团队对光学二维映射压缩技术在长文本上下文处理中可行性的首次探索。

该模型核心由DeepEncoder与DeepSeek3B-MoE-A570M解码器构成:DeepEncoder能够在高分辨率输入条件下保持低激活状态,实现高压缩比并生成适量的视觉token;解码器则负责将这些视觉token准确转化为文本信息。

实验数据显示,当文本token数量控制在视觉token的10倍以内(压缩率<10 x )时,OCR识别精度可达97%;即使压缩率提升至20×,模型准确率仍能维持在60%左右。

研究团队表示,这一成果为长上下文压缩技术以及大语言模型的记忆与遗忘机制研究提供了新的思路与方向。

论文标题:DeepSeek-OCR: Contexts Optical Compression

项目地址:https://github.com/deepseek-ai/DeepSeek-OCR

论文地址:https://github.com/deepseek-ai/DeepSeek-OCR/blob/main/DeepSeek_OCR_paper.pdf

Hugging Face:https://huggingface.co/deepseek-ai/DeepSeek-OCR

honglian
cc 管理员

  • 声明:本文由cc于2025-10-21发表在imtoken官网下载/imtoken钱包下载/imtoken安卓版app下载/imtoken钱包app下载,如有疑问,请联系我们。
  • 本文地址:https://www.hk-sz.com/dianshang/8351.html
上一篇:vivo X300系列两杯销量超越X200系列三杯销量:创历史新高-imtoken钱包官方版下载
下一篇:大突破!腾讯AI可预测肺癌基因突变:准确率99%-imtoken钱包下载苹果官网