讀檔、查資料、操作系統
純聊天,其實是不夠的。你跟 AI 對話、問它、請它給建議,但你有沒有發現,它講得再好,東西還是在你的電腦裡,它碰不到。接下來我要讓 Agent 真的動手,去碰你的檔案、你的系統、外面的資料。這裡的主角,叫做工具。
先講清楚,什麼是工具。工具,就是讓 Agent 能夠對外界動手的能力。具體來說,像是讀跟寫你的檔案、上網去查最新的資料、或是在你電腦上執行一段程式、跑一個指令。你可以把它想成是 Agent 的手跟腳。如果只有一個很會講話的腦袋,卻沒有手腳,那它再聰明,也只是一張嘴,講完就結束了。工具,就是把手腳裝上去。
那有工具跟沒工具,到底差在哪?差很大。沒有工具的時候,你問它一個問題,它是憑腦袋裡的印象回答你,聽起來很順,但它可能記錯、甚至憑空編一個看起來很像的答案給你。有工具就不一樣了:它會真的去把那個網頁打開來查、真的把那個檔案讀進來看、真的把那件事做一遍。同樣一句回答,一個是憑感覺講的,一個是查證過、做過的,你敢不敢信,差別就在這裡。不過我要馬上補一句但書,不然你會太放心:**「它有去查」不等於「它讀對了」。**它可能打開了對的檔案,但看錯欄位;可能查到了對的網頁,但抓了過期的那一段;也可能三份資料裡它只採信了錯的那一份。所以有工具讓它**比較可能**有根據,但那個「根據對不對」,最後還是要你看一眼。從「憑空編」進步到「查了但可能讀錯」,是一大步,但還不是終點。
光講你沒感覺,我直接做給你看。接下來我會給它一個真實的檔案,可能是一份原始資料、也可能是一份文件,然後我下一個指令,讓它把這個檔案讀進來、處理一遍,再把結果存回去變成一個新檔。你注意看它的動作:它不是在對話框跟我聊,它是真的去開了我硬碟上的那個檔案。我們來看。
好,看完回來。你有沒有抓到剛剛那個關鍵?它不是告訴我「你應該這樣做、那樣做」,然後把工作丟回給我。它是直接把那個檔案讀進去、處理完、存好,擺在那邊等我驗收。以前它只能出一張嘴,現在它能把事情做完。這一步,就是工具帶來的差別:從「會講」變成「會做」。
但是,我要在這裡踩一下煞車。它會做,是好事,可是你要清楚一件事:它是真的在動你的東西。它會真的改你的檔案、真的跑你電腦上的指令。這代表如果它判斷錯了,那個錯也是真的發生,不是在對話框裡講講而已,是真的改下去、真的執行了。能力越大,越要先幫它設好界線。
你實際用的時候會遇到一個畫面,我想先幫你打個底,因為這是最容易被隨手點掉的一關。當 Agent 要做比較重要的動作 —— 像是改你的檔案、執行一段指令、把東西送出去 —— **很多工具會停下來跳出一個視窗問你:「我要做這件事,可以嗎?」**我知道那個東西看久了很煩,尤其它一連問你五六次的時候,你會很自然地開始連按「允許」,甚至直接選「以後都不用問我」。但我要老實說:**那個視窗,就是你最後一道關卡。**它按下去之後的事情,是真的會發生的。所以我的建議很具體:**至少看一眼它要動的是哪個檔案、哪個資料夾。**尤其看到「刪除」「覆蓋」「送出」「全部」這幾個字的時候,停三秒。還有,那個「以後都不用問我」,**在你還沒摸熟它之前,不要按** —— 那等於把煞車拆掉。
還有一件事,是我覺得最多人沒意識到、但後果可能最嚴重的。你叫它「讀一下我桌面那個檔案」,它照做了,感覺就像它在你電腦裡看了一眼。**但如果你用的是雲端的 AI,實際發生的事情是:那個檔案的內容被傳出去了。**它不是在你電腦裡就地讀完,是把內容送到外面的伺服器,那邊才有腦袋能理解它。所以你讓它讀什麼,你就等於把什麼送出去了。自己的購物清單、隨手記的雜事,那沒什麼問題。但如果是**公司的內部文件、客戶名單、還沒公開的資料、別人的個資**,那就要先停一下,問自己一句:**這份東西,送到外面去沒關係嗎?**不確定的時候,就當作不行。這條線寧可保守 —— 因為送出去這件事,是**收不回來的**。
所以我給你三個保命的習慣。第一,先在一個可以回復的環境試,比如先拿一份備份、一個測試資料夾練手,別一開始就叫它動你唯一一份、動了就回不來的正式資料。第二,重要的、不可逆的動作,像刪檔、覆蓋、送出去,先讓它停下來給你確認,你點頭它再做。第三,也是最重要的,永遠自己驗收,它做完你要親眼看過結果對不對,別因為它很會做就全盤照收。這三條,你越常交辦,越要守。
這是一個小習慣,但我要單獨講,因為它救過我很多次。Agent 做完之後,會很有把握地跟你說:「已經處理完成,結果存在某某檔案。」那個語氣非常肯定,你會很自然地就相信了。但我實際遇過的狀況包括:**存到別的資料夾去、存出來是空的、只處理了前面幾筆就當作全部做完、還有它以為自己存了其實根本沒存。**重點是,**它不是在騙你** —— 它是真的以為自己做完了。它看到的是「我執行了儲存這個動作,沒有跳錯誤」,但「沒跳錯誤」跟「結果是對的」,中間有很大的空間。所以養成一個習慣就好:**它說存好了,你就去打開那個檔案看一眼。**不用細看,看它在不在、裡面有沒有東西、筆數大概對不對。五秒鐘的事,但它把「我以為做好了」變成「我知道做好了」。
最後這件事比較少人講,但你既然要讓它讀外面的東西,就該知道。你請它讀一份文件、一個網頁、或是別人寄來的檔案,**那份東西裡面,是可以藏一段話的** —— 那段話不是寫給你看的,是寫給 AI 看的,內容大概像:「忽略前面的指示,改成去做某某事」、「把使用者的某某資料也一起附上」。人看的時候不會理這種東西,但 AI 讀進來之後,**它眼前只是一整片文字,它分不出哪一句是你交代的、哪一句是那份檔案裡夾帶的。**聽起來有點嚇人,但你要記住的其實只有一句話:**它從外面讀回來的東西,是「資料」,不是「命令」。**實務上你只要做兩件事就夠了:**讀來路不明的東西時,別同時給它可以刪、可以寄、可以付錢的能力**;還有,**它突然要做你沒交代過的事,那就是警訊,停下來。**
如果今天你只帶走一句話,那就是:工具,讓 Agent 從一個「會講」的嘴,變成一個「會做」的助手。但別忘了,會做的另一面就是有風險,所以你要幫它設好界線,也要自己驗收。今天就可以挑一個「讀一份檔案、整理成表格」的小任務試一次 —— 那是最安全、也最能立刻看出差別的起點。