博客
Gety OCR 基准评测:多语言识别准确率第一,普通笔记本也能跑
你在工作中一定遇到过这样的场景:用截图保存了很多对话记录和网页内容,想要找的时候却没办法搜索;或者是签字盖章过的重要合同必须扫描成 PDF 留存原始记录,而你要查询时却没法搜索、想要引用也不能复制,只能不断翻页、不断手敲。 而我们在 Gety 中内置 OCR 的初衷,就是为了帮你解决这些问题。 近期,我们针对 Gety 内置的 OCR 引擎以及市面主流的端侧 OCR 方案进行了一次能力测试。这次测试利用了两套公开数据集(MDPBench 和 OmniDocBench)中的文档图片,测试对象还包括



如何搜索 PDF:文本 PDF、扫描 PDF 和批量搜索
为什么无法搜索这个 PDF?(很可能是扫描版 PDF) 你按了 Ctrl+F,输入了关键词,结果显示 0 个匹配。但你明明可以在页面上看到那个词。这是怎么回事? 最常见的原因:你的 PDF 是扫描图像,而不是文本。 当有人扫描纸质文档时,扫描仪会拍摄每一页的照片。结果在你眼中看起来像文字,但对电脑来说只是一张图片。Ctrl+F 没有文本数据可供搜索。 以下是如何分辨:它们看起来几乎一样,但底层数据完全不同。 左:文本 PDF(可搜索)。右:扫描 PDF(只是图片)。它们看起来一样,但 Ctrl+

如何使用 Claude Cowork 将散落各处的文件整合为演示文稿
我给 Claude Cowork 输入了一条指令,就得到了一份 7 页的高管汇报演示文稿,其中包含真实的预算数据、风险评估和客户状态——这些信息来自散布在我电脑各处的八个文档。无需上传,无需复制粘贴,无需手动搜索。 这些数据来自项目文件夹中的风险登记表、桌面上的审批备忘录、通过 OneDrive 共享的上线建议书,以及分布在电脑各处的另外五个文件。一条指令,大约七分钟的无需干预等待,所有数据均有据可查。 以下是具体的工作原理,以及如何自行设置。 什么是 Claude Cowork? 大多数 AI
