知識區塊切割

上傳文件或貼上文字,AI 依章節、段落、概念的優先順序切割成知識區塊,完成後以 JSONL 格式顯示並輸出 JSONL 檔案下載。

知識區塊切割小幫手使用與知識庫匯入相同的 AI 分割方法,把整份內容切割成一個個完整的知識區塊。可以直接在輸入框貼上文字,也可以上傳 txt、docx、xlsx、pptx、pdf 文件檔案,系統會先把檔案解開成純文字再處理。送出後畫面會依序串流顯示切割進度:AI 會先掃描整份文件建立章節結構,再依優先順序切割——文字有章節時依章節切割,沒有章節時依段落切割,沒有章節也沒有段落時依概念切割,每個區塊完整呈現一個章節、段落或概念,並自動產生包含書名與章節名稱的搜尋關鍵字。全部切割完成後,畫面會以與下載檔案內容一致的 JSONL 格式顯示全部知識區塊,並生成一個 JSONL 檔案提供下載連結,一列一筆知識區塊,欄位包括 output(區塊原文)、keyword(關鍵字)、remark(x/y,標示為該份內容的第幾塊與總塊數)與 vector(把區塊內容經 AI 向量模型編碼成的向量值,可直接用於向量檢索)。產出的 JSONL 檔案可直接用知識庫的「匯入 JSON」功能匯入知識庫,或用於 RAG 檢索、模型微調等資料準備工作。內容很長時會分成多個視窗依序分析,請耐心等候串流完成。 單次上傳總大小上限:256MB(全部檔案與訊息內容合計)。 可接受文件格式:pdf、docx、xlsx、pptx、txt、csv(文件內容以文字擷取後提供給模型)。 可接受圖片格式:gif、jpeg、jpg、png、webp。 GIF 動畫僅分析第一幀。 圖片數量上限:600 張。 一次上傳超過 20 張時,單張圖片每邊最多 2,000 像素。 單張圖片檔案大小上限:10MB(以 base64 編碼後大小計)。 單次訊息圖片總大小上限:20MB(文字與對話歷史共用同一請求容量,接近上限時仍可能被 AI 服務拒絕)。 圖片尺寸:每邊 200~8,000 像素。 輸出內容格式:文字 單次輸入上限:約 5,000,000 tokens。 檔案輸出格式:JSONL(可直接匯入知識庫)。 不支援連續對話。