サポートされているローカル入力
| フォーマット | 拡張 | 主な行動 |
|---|---|---|
.pdf | テキストとページ構造を抽出します。スキャンされたページにはローカルOCRを使用します。 | |
| プレーンテキスト | .txt、 .text および互換性のあるプレーンテキストタイプ | 読みやすいテキストを保存します。 |
| 値下げ | .md、 .markdown および互換性のあるタイプ | Markdownを権威あるソースコンテンツとして保持します。 |
| HTML | .html、 .htm | リモートリソースを読み込むことなく、ローカルHTML構造を抽出します。 |
| リッチテキスト | .rtf | スタイリッシュなテキストをMarkdown互換の構造に抽出します。 |
| 画像 | .png、 .jpg、 .jpeg、 .tif、 .tiff、 .heic、 .heif | ローカルOCRを使用します。 |
| マイクロソフトワード | .docx | サポートされている見出し、段落、リスト、表、および既存の画像処理を抽出します。 |
| マイクロソフトパワーポイント | .pptx | スライドの境界、タイトル、リスト、テキスト、表を抽出します。 |
| マイクロソフトエクセル | .xlsx | シート境界とテーブルを抽出します。 |
Safari拡張機能は、Webページ、選択範囲、ハイライト、現在のウインドウにある複数のタブもキャプチャします。SafariのWebサイトアクセス許可に従って、Webサイトのllms.txtコレクションを検出し、取得できます。ローカルのllms.txt読み込みはオフラインのまま行われ、インデックスと、含まれる.md、.markdown、.txtファイルへの相対リンクを受け付けます。
iPhoneとiPad
Safariからは、許可されたWebページをキャプチャし、llms.txtリサーチコレクションを読み込みます。共有シート、ファイル、またはリサーチを読み込む…からは、次の形式を読み込めます。
- テキストPDF、スキャンPDF、混在PDF。ネイティブテキストが不十分なページだけローカルVision OCRを使用します。
- Appleの画像フレームワークでデコードできる画像(JPEG、PNG、HEIC/HEIF、TIFFなど)。
- RTF、Markdown、プレーンテキスト、単独の
llms.txt。 - AIリファレンスパックZIP、OKF v0.2バンドルZIP、ポータブル
llms.txtパッケージZIPの書き出し。
PDFとRTFは、Macの変換ポリシーと同様に、元の書類ではなく正規Markdownを保存します。読み込んだ画像はソースの非公開アセットに元のバイトを保存するため、オフラインでも表示できます。元のバイトに埋め込まれたメタデータもローカルに留まります。認識・変換されたテキストは通常のライブラリ検索に含まれます。
変換とOCRはすべてデバイス上で行われます。パスワード保護されたPDFはソースを作成せず、安全に失敗します。RTFD、Office書類、HTMLファイル変換、フォルダ読み込みはiPhoneとiPadでは未対応です。共有拡張機能は汎用のpublic.dataには登録しません。アプリ内の明示的なファイル選択では、署名または実際のデコード結果から、誤った形式として提供された対応ファイルを安全に認識できます。
直接サポートされていません
レガシーオフィス .doc、 .ppt、そして .xls ファイルは検出されますが、変換されません。それらを次のように保存します .docx、 .pptx、または .xlsx 最初に。
現在の制限には、高度なスプレッドシート式評価、PowerPointアニメーション/メディア/スピーカーノート、新しく抽出された埋め込みOfficeメディア、Word脚注と追跡された改訂、完璧なOCR、および複雑なスキャンレイアウトの保存が含まれます。
出力形式
すべての変換でMarkdownが作成されます。Macでは、AIリファレンスパックZIP、OKF v0.2バンドルZIP、Markdownコンテキストパック、ポータブルllms.txtパッケージZIP、llms.txtコレクションフォルダ、クリップボードのMarkdownを書き出せます。iPhoneとiPadでは、システム共有シートからAIリファレンスパックZIP、OKF v0.2バンドルZIP、ポータブルllms.txtパッケージZIPを書き出せます。