Markdown、Word、HTML、TXT、JSON、CSV 之間可以任意方向互轉,共 36 條路徑,每一條下面都有獨立頁面。
完整的 GitHub 風格 Markdown:標題、巢狀清單、表格、帶語言標記的程式碼圍欄、引用、連結與圖片。寫在錢字號之間的公式會被辨識為數學式,而不是當成字面文字。
.docx 會在頁面內解壓並依 WordprocessingML 解析:標題樣式還原成標題層級,真正的編號定義還原成有序與無序清單,帶邊框的段落還原成引用,整段等寬字型還原成程式碼區塊。內嵌圖片不會帶過來,轉換器會告訴你略過了幾張。
頁面按真正的文件來解析,而不是用正規表達式去摳。輸入是整張網頁時,會優先取 <article> 或 <main> 主體,把導覽、側欄與頁尾排除在外;指令碼、樣式與內嵌 SVG 會被丟棄,標題、清單、表格、帶語言類別的程式碼區塊、引用、連結與圖片都會保留。
純文字按字面對待。以 # 開頭的行仍然是以 # 開頭的行——.txt 裡沒有可解釋的標記,不會有任何內容被悄悄升格成標題、清單或連結,段落之間只以空行劃分。
符合我們 saveai.doc.v1 結構的 JSON(一個標題加一組帶型別的 block)會被還原成真正的文件,標題、段落、清單、引用、程式碼與表格都會恢復。其它形狀的 JSON 會原樣放進程式碼圍欄裡,而不是靠猜測解析——既不臆造,也不遺失。
CSV、TSV 或分號分隔的匯出檔案依 RFC 4180 解析:帶引號的欄位、成對跳脫的引號、儲存格內部的逗號與換行都能保住,分隔符是自動辨識而非假定。首列作為標題列;含換行的儲存格會被壓成一行——Markdown 表格的一列不能跨多行。
PDF 只作為目標格式出現。我們能把文件算繪成 PDF,但不解析 PDF 回文字,所以這裡沒有 PDF 轉其它格式的頁面。要做好它需要版面重建與 OCR,與其做一個讓人失望的頁面,不如直說。
SaveAI 是一個瀏覽器擴充功能,可以把 ChatGPT、Claude、Gemini、DeepSeek 的整段對話儲存成 PDF、Word、Markdown 等格式,圖片、程式碼與公式一併保留。