外觀
文件存進去之後不是立刻就能被 AI 查到,中間會經過幾個狀態:
處理中——文件還在被切塊,這時候還沒有任何一段(chunk)切出來。
學習中——已經切出了 chunk,但還沒有全部做完 embedding(讓 AI 能用語意檢索到)。 這個狀態下 AI 可能查得到已經學習完的段落,但還查不到剩下的部分。
已就緒——全部 chunk 都完成 embedding,AI 檢索得到這份文件的完整內容。
失敗——處理過程中出錯了,最常見的原因是圖片辨識沒跑成功。這份文件目前 AI 完全查不到,需要重新處理或重新上傳。
為什麼要特別分辨「失敗」
失敗跟處理中,表面上看起來都是「還沒有 chunk」,畫面上都會轉圈。但失敗的檔案 不會自己好——它不是在排隊等處理,是已經跑完但沒有成功。如果沒有另外標成失敗, 畫面會一直顯示處理中、轉圈轉到天荒地老,你也不知道該重新上傳還是繼續等。
為什麼試算表(CSV / Excel)沒有這幾個狀態
試算表類型的文件是直接被工具查表用的,不走切塊、也不做 embedding, 上傳完就能被查,跟切塊/學習的進度無關。所以它一律顯示成已完成, 不會卡在處理中或學習中——這是刻意的判斷順序:先認出是試算表類型, 再看 chunk 數量,不然一份沒有 chunk 的試算表會被誤判成永遠處理不完。