ChatGPT Atlas 剛推出的時候,討論度一度衝到很高,不少人搶著在 macOS 上第一時間裝來玩。可是現在想找它下載,會發現這個名字快要消失了。2026 年 3 月,OpenAI 內部就已經傳出要把 ChatGPT Atlas 瀏覽器、電腦版的 ChatGPT App,還有寫程式用的 Codex,整合成同一個桌面應用程式的計畫;同年 7 月,OpenAI 正式對外宣布這項整併,並表示 Atlas 預計 8 月起停用,不再以獨立瀏覽器的身分提供下載。
一款上市不到一年就收掉獨立身份的產品,原因不是做得不好,而是它背後這整個類別,也就是 AI 瀏覽器(也叫代理瀏覽器,agentic browser),目前都還在快速變動。這不是換個介面、換個名字這麼簡單,而是把「瀏覽器」原本的工作內容整個改了。過去瀏覽器只負責顯示網頁,等使用者自己動手;現在有一種瀏覽器開始會自己讀懂頁面,自己動手把事情辦完。
先搞懂這類瀏覽器跟一般瀏覽器內建的 AI 聊天功能差在哪裡,再往下看它怎麼一步步完成一個任務、目前有哪些做法,又帶來什麼風險。
AI 瀏覽器(代理瀏覽器)是什麼?
AI 瀏覽器,也叫代理瀏覽器,英文是 agentic browser,指的是把大型語言模型整合進瀏覽器本體,或是以擴充功能的形式加裝到既有瀏覽器上的產品。單看名字容易誤會成瀏覽器裡多了一個聊天視窗,但真正的差異不在這裡,而在有沒有代理模式(agent mode,也叫 agentic mode)。有代理模式的瀏覽器,能先讀懂目前這個頁面在講什麼,規劃出該做哪些步驟,再實際去操作頁面上的元素:點擊按鈕、輸入文字、換頁、送出表單,一路把一段任務做完,不是只講給使用者聽。
把整個瀏覽器本體都拿來做這件事的,像是 ChatGPT Atlas、Perplexity 的 Comet、Opera 的 Neon;另一種做法是在原本就在用的瀏覽器裡加裝這層能力,像 Anthropic 的 Claude for Chrome、Microsoft Edge 的 Copilot,兩種路線後面會再拆開講。
跟瀏覽器內建的 AI 聊天功能,有什麼差異?
多數主流瀏覽器,像 Edge、Chrome,本來就有 AI 聊天側欄,能回答問題、幫忙做摘要、比較資訊,這點最容易讓人搞混。但那多半是唯讀的功能,AI 只負責讀懂網頁、講給使用者聽,實際要按、要填、要送出,還是得自己動手。微軟在介紹 Edge 的 Copilot 時,就把這兩層分得很清楚。一般情況下它會幫忙搜尋、比較、填寫表單、協助完成任務,但真正送出動作之前,都要先經過使用者同意才會定案。
這類瀏覽器跟聊天側欄真正的差別,就在後面「動手做」這一段——AI 自己點擊、自己填欄位、自己送出,不用你再操作一次。可以想像成兩種秘書:一種是把資料整理好放在桌上,等你簽名確認;另一種是拿到你的授權後,直接把整件事辦完再回報結果。代理(agent)這兩個字,指的正是後者這種被授權去行動的角色。

AI 瀏覽器怎麼一步步完成一個任務?
分清楚唯讀功能跟動手做的差別之後,下一步是看它實際怎麼動手,一段任務是怎麼被拆解、完成的。以訂一間下週五的飯店為例,使用者只要用一句自然語言講出目標,接下來的動作就交給瀏覽器自己完成。
AI 先讀取目前頁面的畫面內容與版面結構,判斷該去哪個網站、該做什麼;接著把整個任務拆解成一連串步驟,逐步執行,像點擊搜尋結果、輸入日期、換到下一頁。以 ChatGPT Atlas 為例,執行任務時會把整個瀏覽器介面框上一圈藍色提示,明確標出 AI 正在操作,讓使用者不會搞混這段時間是誰在動滑鼠。
遇到會造成實際後果的動作,像是送出訂單、完成付款,各家目前的共同做法是先停下來,等使用者確認才繼續,不會自己一路按到底。微軟介紹 Edge 的 Copilot 時也是同樣的設計:搜尋、比較、填表單、完成任務,但都要等使用者同意之後,動作才會真正定案。
Google 對 Project Mariner 的說明也一樣,強調操作過程中會讓使用者隨時掌握進度,也能隨時介入喊停。等任務跑完,AI 會回報結果,把辦好的事簡單整理給使用者看一次。

為什麼「找資訊」開始變成「請它辦事」?
這一整套流程能出現,不是憑空發生的,得放回搜尋這件事一路怎麼演變來看。傳統的瀏覽器加搜尋引擎做的事情其實很單純,就是幫使用者找出一串相關連結,剩下的判斷跟動作都留給使用者自己來。ChatGPT、Perplexity 這類問答式搜尋出現後,情況先往前走了一步,不用逐一點開連結,AI 直接把答案整理出來給使用者看。

AI 瀏覽器又往前走了一步,不只回答問題,還能代替使用者實際完成操作。這個轉變不是一夕之間發生的,Google 的 Project Mariner 就是一個很清楚的例子。它在 2024 年 12 月以研究原型的身分推出,一開始只以 Chrome 擴充功能的形式運作;到了 2025 年 5 月,開放給美國的 Google AI Ultra 訂閱者使用,當時也規劃把它的能力整合進 Gemini API、Vertex AI,以及還在測試階段的 Search AI Mode。
只是這個類別變動的速度比想像中快。2026 年 5 月,這個研究預覽本身就被停用了,只留下它一路想併入日常搜尋工具的方向。
AI 瀏覽器目前分成哪幾種做法?
既然這個轉變已經在發生,接下來實際落地的產品,大致走了兩條不同的路線,邏輯不一樣,分別適合不同的使用習慣。
路線一:直接打造一個新瀏覽器
第一條路線是直接打造一個全新的瀏覽器,從瀏覽器本體開始就圍繞代理功能設計,把它當成核心賣點。Perplexity 的 Comet 走的就是這條路,2025 年 7 月先開放給訂閱層級較高的使用者,同年 10 月才開放所有人免費下載;Opera 的 Neon 則在同年 9 月上線,把自己定位成一款生來就是要付諸行動的代理瀏覽器。
前面提到的 ChatGPT Atlas 也是從這條路線起步的,2025 年 10 月上市時只有 macOS 版,原本規劃 Windows、iOS、Android 版本即將推出,結果不到半年,2026 年 3 月就傳出要整併進一個更大的桌面應用,同年 7 月 OpenAI 正式對外宣布整併,並表態 8 月起停用獨立瀏覽器身分。這條路線目前還在快速整併,還沒有一個定型下來的產品形態。
路線二:在原本的瀏覽器裡加裝代理功能
第二條路線是留在使用者原本已經在用的瀏覽器裡,額外加裝一層代理能力,不用整個換掉習慣的瀏覽器。Microsoft Edge 的 Copilot 是內建在瀏覽器裡的做法;Anthropic 的 Claude for Chrome、Google 的 Project Mariner,則是先以瀏覽器擴充功能的形式推出。
Claude for Chrome 的擴大過程,可以看出這類產品目前的共同節奏:2025 年 8 月先以研究預覽的形式,小範圍找 1000 名 Max 方案使用者測試;三個月後,2025 年 11 月擴大到所有 Max 訂閱者;再一個月,2025 年 12 月開放給 Pro、Team、Enterprise 等所有付費方案。先小範圍測試,確認沒有明顯問題才逐步擴大開放,是目前多數廠商共同的做法。

AI 瀏覽器目前有哪些已知的風險?
不管走哪條路線,讓 AI 直接動手操作頁面,都會帶來同一種新風險。最直接的是提示詞注入(prompt injection)。惡意網頁可以把偽裝成指令的文字藏在頁面裡,像是用白底白字或隱藏欄位,誘騙 AI 在使用者不知情的狀況下執行動作,例如刪除信件,或是把資料送到別的地方。
Anthropic 自己公布的紅隊測試數字,具體說明了這個風險的量級。在沒有防護機制的情況下,123 個測試案例、涵蓋 29 種攻擊情境裡,攻擊成功率是 23.6%;加上防護機制後,降到 11.2%。針對瀏覽器專屬的 4 種攻擊類型,成功率則從 35.7% 降到 0%。

英國國家網路安全中心(NCSC)在 2023 年就對這類問題表態,認為提示詞注入很可能是大型語言模型技術本身固有的問題,目前業界還沒有能徹底解決它的方法,各家能做的是持續降低風險,不是完全消除。這也是為什麼各家瀏覽器目前的共同做法,是替容易出事的動作,像是送出付款、刪除資料,額外加一道使用者確認的關卡,呼應前面提到敏感動作要先停下來確認的設計。
對經營網站、品牌的人來說,未來的訪客不見得都是「人」
這些風險多半是從使用者的角度在談,但事情還有另一面:對經營網站、做品牌的人來說,這波轉變也在改變誰會出現在你的網站上。如果連瀏覽器都能自己讀懂頁面、自己操作完成任務,代表以後造訪你網站的,不一定是坐在螢幕前的人,也可能是代替人操作的 AI。
這不是要在這裡展開一整套該怎麼因應的教學,那是另一個題目該處理的事;但方向值得先記在心裡,你網站上清楚的按鈕文字、看得懂的表單欄位,原本是為了方便真人使用者操作,現在也開始跟 AI 讀不讀得懂、操作不操作得了有關。
回頭看 ChatGPT Atlas 這半年多的際遇就知道,這個類別的產品形態還沒有真正定型下來。它上市時只有 macOS 版,Windows、iOS、Android 版一直停留在即將推出的狀態,結果沒等到這些版本真的上線,整個產品就先被併進更大的應用裡收掉了。Project Mariner 走的也是類似的路,從研究原型到開放給訂閱者,規劃要併入更多產品,最後研究預覽本身也先一步停用。
與其記住哪個名字現在正紅,不如先記住這個轉變的方向。瀏覽器正在從「幫你找」,變成「幫你做」。
