ブログ

Gety OCRベンチマーク:多言語OCR精度でトップ、普通のノートPCで動作

仕事で、こんな場面に心当たりがあるはずです。後で見返すためにチャットのやり取りやWebページをスクリーンショットとして残したのに、いざ必要になったとき、その画像内の文字は検索できない。あるいは、署名・捺印済みの重要な契約書を原本として記録に残すためにPDF化したものの、後で内容を確認したり一節を引用したりしようとすると、検索もコピーもできず、ページをめくりながら手で打ち直すしかない。 Gety の内蔵 OCR は、この問題を解決するためのものです。 その効果を確かめるために、私たちは 2 つの公

Petard JonsonXinyi大 K
3 authors

PDFの検索方法:テキストPDF、スキャンPDF、一括検索

なぜこのPDFを検索できないのか?(おそらくスキャンPDFです) Ctrl+Fを押してキーワードを入力したのに、0件 という結果が出ました。でもそのページに確かにその単語が見えています。何が起きているのでしょうか? 最も一般的な原因:PDFがテキストではなくスキャン画像だからです。 紙の文書をスキャンすると、スキャナーは各ページを写真として撮影します。結果は人の目にはテキストのように見えますが、コンピュータにとっては単なる画像です。Ctrl+Fが検索できるテキストデータが存在しないのです。 見分

Channing Dai
Channing Dai

Claude Cowork で散在するファイルをプレゼンテーションにまとめる方法

Claude Cowork にプロンプトを1つ入力しただけで、実際の予算データ、リスク評価、顧客ステータスを含む7スライドのエグゼクティブ向けプレゼンテーションが完成しました。これらの情報は、コンピュータ上に散らばった8つのドキュメントから取得されたものです。アップロードもコピー&ペーストも手動検索も不要でした。 データの出典は、プロジェクトフォルダ内のリスク台帳、デスクトップ上の承認メモ、OneDrive で共有されたローンチ推奨書、そしてマシン上の他の場所にある5つのファイルです。プロンプト

Channing Dai
Channing Dai