返回 AI

AI / 工具比較

ChatGPT、Gemini、Claude、Perplexity 有甚麼分別?同一 Prompt 實測比較

四個 AI 助手,一條 Prompt。唔講空泛冠軍榜,逐樣睇清楚每個工具實際適合做甚麼。

01 / AI

唔好俾 logo 幫你揀答案

ChatGPT、Gemini、Claude 同 Perplexity 有重疊,但每個產品的重心唔同。真正有用的問題唔係邊個「最聰明」,而係邊個最少阻滯咁處理你的工作、來源、檔案、語言和 workflow。

四個 chat 視窗,四個品牌,一個有少少攰的人問:「我應該用邊個?」網上通常即刻頒獎,拎 benchmark screenshot 出嚟,或者宣布某個模型「贏咗」——好似學生做 presentation 同 developer 修 code,係參加同一場拳賽咁。

佢哋唔係同一款產品,即使四個都可以寫 email、解釋 SEO,或者將一段亂糟糟文字改到似樣。ChatGPT 比較似多用途 assistant 加工作台;Gemini 同 Google 生態和研究工具連得比較深;Claude 偏向細膩寫作、長文件、coding 同可重用 artifact;Perplexity 就係 search-first,主打搵來源、列 citation 和追查資料。呢啲係重心,唔係鐵律。

“最好用的 AI,通常係令你清楚下一步做乜嗰個。” — 一條冇咁花巧但比較穩陣的揀法
香港大學講堂內,學生跟隨數碼商業個案的真實照片
The Standard 發布的真實課堂照片。代表學生用數碼工具學習,唔係四個產品的相片,也不代表任何產品成效。
快速答案

想要一個全能起點,先試 ChatGPT;工作大量用 Google Search、Gmail、Drive 或 NotebookLM,就試 Gemini;要改長文、睇大份文件、寫 code 或整 artifact,就試 Claude;要搵最新資料、早早見到 citation,就先試 Perplexity。之後用同一個 prompt 自己跑一次,因為你的語言、plan 同工作會改變結果。

先提一句:app 名唔等於 model 名。Plan、地區、使用量、web access、揀到的 model 和 feature rollout 都會變。六個月前寫得好認真的 review,今日都可能已經舊。AI 比較有時比 office pantry 的切開水果更快變質。

02 / AI

四個工具,其實想做甚麼?

四個產品正在互相靠近,但核心重心仍然不同:多用途工作台、Google 生態 assistant、長文件合作夥伴,以及研究優先的答案引擎。
工具核心重心通常邊類工作順手要慢一慢檢查甚麼
ChatGPT多用途 assistant 及工作台混合工作:起稿、分析、coding、檔案、圖像、聲音、project 和研究流程。功能及 model 按 plan 有差異;寫得流暢唔等於一定啱。
Gemini連住 Google 的多模態 assistantGoogle Search 研究、Workspace、Canvas、NotebookLM、視覺和結構化解釋。來源、帳戶權限和 feature availability;連住 Google 唔代表自動核實。
Claude寫作、推理、code 和 artifact 合作夥伴長文件、改稿、code review、整理複雜想法、分享獨立作品。語氣太靚會令不確定性縮細;web search 要睇當時帳戶有冇開。
PerplexitySearch-first 研究介面快搵來源、直接 link、follow-up、不同搜尋模式和 visible citations。Citation 只表示來源存在,唔保證 synthesis 一定對;最後品牌文案可能要再改。

目前產品功能以官方文件為基礎:OpenAI 的 ChatGPT overviewcapabilities 說明;Google 的 Gemini Deep ResearchCanvasGems;Anthropic 的 web searchArtifacts;以及 Perplexity 的 Pro Search 說明。

香港專業工作坊,參加者學習 AI screen-sharing workflow 的真實照片
UOW College Hong Kong 發布的真實工作坊照片。只代表人學習 AI workflow,唔係產品比較測試,也唔代表任何 vendor。

當佢哋係四位同事咁睇:ChatGPT 係轉場快的 generalist;Gemini 係已經坐喺 Google 大樓入面的同事;Claude 拎住紅筆、大文件夾,鍾意乾淨結構;Perplexity 入門時已經拎住一疊 receipts。重要資料唔好交俾任何一位獨自決定,尤其係冇人 check 的時候。

03 / AI

同一個 Prompt 實測:點樣唔好作弊?

公平測試要固定 prompt、工作、語言、日期、來源要求和輸出格式,同時記低 web search、deep research、檔案和 model 有冇開。

本文採用的 editorial benchmark prompt 如下,四個工具都應該貼同一段:

四個工具共用同一 Prompt

You are advising a Hong Kong student or working professional who wants to learn practical AI tools for research and marketing. Compare ChatGPT, Gemini, Claude, and Perplexity for this exact job: explain the difference between SEO and SEM for a Hong Kong business; recommend a realistic 30-day learning plan; cite current official sources; identify what may be outdated or uncertain; and finish with one clear recommendation for a beginner. Use plain English, a compact comparison table, and separate facts from your own judgement. Do not invent prices, rankings, or product features.

呢條 prompt 故意唔複雜,但夠貼近日常:學生或在職人士要 AI 搵資料、解釋、整學習計劃、列最新 citation,再講清楚不確定性。亦有個小陷阱:SEO 同 SEM 容易講到似懂非懂,而 current product facts 如果冇 browsing,好容易自行作出嚟。

控制項目四個測試都保持一樣點解重要
日期時間同一星期跑,記低 model、plan 和 timestamp。產品功能和 web 結果會變;冇日期的結果只完成了一半。
Prompt連標點都照貼,不要睇完一個答案先幫另一個改 prompt。一改 prompt,就由比較變成偏好測試。
來源規則全部要求 current official sources,重要 claim 要自己開 link。有 citation 唔代表 link 相關、未過時或真係支持旁邊句子。
Context相同語言、不加額外檔案、同一 follow-up policy、盡量一樣的 browsing。一個工具 upload 咗 file,工作已經變咗。
評分準確性、來源質素、可用度、不確定性、香港相關性和 edit time。「我鍾意個 tone」有用,但唔係完整測試。

唔好 Perplexity 開住 citation,另一個工具關閉 browsing,之後話某個 model 輸咗。呢個唔係公平比賽,係叫圖書館員同一個被蒙住眼的人鬥搵資料。功能唔能夠完全拉平,就將差異本身記入產品體驗。

本文可以講到幾盡?

呢個係實用產品比較,不是科學 benchmark。Model routing、plan limit、地區 rollout、system instruction 和即時 web 結果都會改答案。測試方法可以重複,但唔應該當成永久排名。

04 / AI

同一條 prompt,四個答案通常有咩味道?

同一條混合 prompt 下,ChatGPT 往往最平均,Gemini 容易將研究和 Google context 放埋一齊,Claude 常有較完整的修訂感,Perplexity 就通常最早展示來源線索。
測試項目ChatGPTGeminiClaudePerplexity
解釋 SEO 同 SEM可按初學者或 technical level 快速調整,整體比較平均。結構和 current-search framing 通常清楚,尤其開 Search 時。語氣平穩、有條理,通常加到 caveat 但唔會變法律文件。較 concise、source-forward,常先交代資料從哪裡來。
30 日學習計劃容易變成 steps、checklist、portfolio task。如果涉及 Google tools、Workspace 或研究來源,會比較順。排序和教學感較好,適合整理成可以慢慢跟的文件。搵課程和工具資料方便,但計劃仍要自己改到貼身。
最新官方來源開 web/research 後可做,重要 link 仍要自己核對。Deep Research 預設用 Google Search,視乎帳戶可加入 Drive、Gmail 等。有 web search 時可以 grounding,但唔好假設永遠自動開。Citation 和搵來源係產品主場,Pro Search 尤其明顯。
最後文字質素風格彈性最大,適合 casual、professional、雙語或格式化。視覺、結構和 Google workflow 輸出常有優勢。細膩改稿和長文連貫感通常舒服。研究骨架好用,最後品牌 tone 可能要再執。
主要風險有信心的 synthesis 可能混埋已知、推論和生成內容。連住資料會令人誤以為答案已經自動驗證。文字好順,錯誤假設反而較難即時發覺。一長串 citation 會似證明,但 source-to-claim 未必貼。
香港學生市場營銷講座,投影幕展示 agency 和 in-house 比較的真實照片
PolyU HKCC 發布的真實市場營銷講座照片。只提供香港學生學習 context,唔係任何 AI model 的 screenshot 或測試結果。

呢啲係傾向,不是成績表。Prompt 寫得好,安靜的工具都可以突然唱歌;prompt 寫得差,再勁的工具都可以煮出一鍋湯。日常工作最明顯的差別,很多時唔係 raw intelligence,而係產品幫你搵證據、保存 context、修改輸出和行下一步有幾順。

做 SEO 更加係咁。叫 AI 列十個 keywords,你可能得到十個樣樣似真的 phrase;叫佢分搜尋意圖、為 claim 找來源、標記 assumptions,再提出可以喺 Search Console 驗證的 test,先至真正測到判斷力,而唔係 autocomplete。

05 / AI

真正取捨:來源、長 context、檔案和 workflow

按 workflow 揀,不要按單一 benchmark 揀。研究優先、Google 連接、長文件協作和多用途工作台,係喺不同位置幫你慳時間。
01

要 receipts
Perplexity 由一開始展示來源,適合想早啲睇 links 的研究。

02

要乾淨改稿
Claude 通常適合做長文、複雜 draft 的第二雙眼。

03

要混合工具箱
一個工作由檔案跳去分析、寫作、聲音或 code,ChatGPT 係好起點。

04

要 Google context
工作已經放喺 Search、Drive、Gmail 或 NotebookLM,就值得先試 Gemini。

05

要持續使用
真正最好係你明白佢的限制和 context 規則,而且每星期會開。

Workflow 問題選之前要檢查
可以 browsing 嗎?Web access 係自動、可選、按 plan 限制,定係你個帳戶未有?
可以 citation 嗎?Citation 係咪直接、相關,重要 claim 背後條 source 開唔開到?
可以處理我的檔案嗎?睇 file size、格式、私隱、context limit,以及回答有冇真係用到 file。
結果可唔可以重用?睇 Projects、Canvas、Artifacts、custom instructions、Gems、export、sharing 和 version。
團隊用得安全嗎?睇帳戶類型、data control、connector、retention、permission 和客戶資料規則。
香港語言用得自然嗎?測繁中、廣東話味、英文 source terms,睇會唔會亂譯到冇人咁講。

Google 現時 Gemini 文件說明 Deep Research 預設會用 Google Search,按功能和帳戶可加入 Gmail、Drive、upload file 或 NotebookLM。Perplexity 說明 selected premium sources 和 direct citations;Anthropic 就說明 web search 要按當時介面或 workspace 設定開啟。留意每段的「可以」——account、plan 和 rollout 真係會影響。

私隱唔係 footnote

唔好為咗比較 tone,就將客戶機密 traffic report、客戶名單、未推出產品或個人資料貼入四個 consumer account。慳到二十分鐘,但之後解釋唔到資料去咗邊,唔係抵。

香港仲有一個小麻煩:語言切換。工具可以寫到好正的書面中文,但捉唔到廣東話 query 背後的搜尋意圖;又或者將英文 SEO term 直譯成市場根本唔會搜尋的字。保留原 query、翻譯版本和母語讀者 check,三樣都要有。

06 / AI

學生或在職人士,應該用邊個?

先按你每星期重複的工作揀,再睇邊個減到最多 friction。學生多數要解釋、查來源和整作品;在職人士就更在意 context、檔案、私隱和輸出穩定性。
你的情況第一個測試組合原因
學生做 reportPerplexity 搵來源,再用 ChatGPT 或 Claude 重整和解釋。將找證據同寫成論點分開。
學生學 marketing/SEOChatGPT 或 Gemini 做 guided practice,再以 Google 官方文件做事實底座。AI 可以教你,但 fundamentals 應該由官方文件 anchor。
在職人士寫報告用 Claude 和 ChatGPT 同時改同一份 anonymised draft。比較 instruction-following、改稿質素和最後要執幾多。
在職人士重度用 Google Workspace先試 Gemini,尤其係 connected research 和文件流程。生態連接慳的時間,可能比一兩句 prose 差異更值錢。
Marketer 做 current researchPerplexity 加開 web research 的 Gemini/ChatGPT。比較來源透明度、新鮮程度和核查時間。
Developer 或 technical learnerChatGPT 和 Claude 用同一 bug、spec 或 repository excerpt;工作靠 Google 就加試 Gemini。Code、context 和 trade-off 解釋,比 generic chatbot 排名重要。
數碼營銷課堂內,學員討論和分享實作的真實照片
iNGO Academy 發布的真實數碼營銷課堂照片。代表合作式學習,唔係產品 endorsement,也不是 AI 生成圖。

我會建議養成兩工具習慣,而唔係四個 tab 宗教。用一個搵或 challenge evidence,再用另一個整理 final work。分開兩個角色,比較容易發現一段好靚的句子其實冇穩固地板。

如果你只想揀一個免費起點,就揀你聽日真係會開嗰個。理論上最勁,但 workflow 麻煩到你唔想用的工具,在你生活入面就唔係最好。呢個唔係哲學,係 calendar management 戴咗頂 AI 小帽。

07 / AI

一份可以重複的同 Prompt 評分表

評估你可以核實的輸出,而唔係第一眼最討好的答案。用 30 分簡單評分,已經足夠睇到實質差異。
項目0 分1–3 分5 分
準確性有重大錯誤或虛構產品功能。大致正確,但 claim 無支持或講得含糊。claim 準確、有界線,而且易核實。
來源質素冇來源或 link 不相關。有少量相關 link,但 source-to-claim 要重做。主要用當前 primary source,貼住 claim。
工作可用度泛泛而談,套落任何人都得。有 outline,但要大幅重整。有現實 plan、具體下一步和限制。
不確定性當所有事都確定。提到限制但冇講清位置。分開 fact、inference、unknown 和下一步核查。
香港相關性忽略語言、香港市場和實際 context。提香港但仍然好 generic。自然處理香港語言、例子、搜尋習慣和限制。
Edit time幾乎全部要重寫。要中量 cleanup 和 fact check。人手合理 review 後可以再用。

保存 raw answer、prompt、model name、plan、browsing status、timestamp、citation 和分數。冇呢份記錄,「Claude 好啲」或者「Gemini 聰明啲」只係 office folklore,距離下一份 PPT 得一步。

  1. 第一讀:有冇答中工作?好靚但答非所問,仍然係 fail。逐項 mark 返要求是否出現。
  2. 第二讀:重要 claim 核唔核到?開 source、睇日期,reject 只係碰巧有相同字眼的 link。
  3. 第三讀:佢假設咗甚麼?留意受眾、預算、地區、語言、產品等隱藏假設。
  4. 第四讀:聽日有甚麼用?保留真正減工的 checklist、brief、table、experiment 或 decision。
  5. 最後讀:邊度要人簽名?事實、私隱、客戶 claim、錢、法律和公開建議,都要人負責。
唔好將流暢當真相

順口係 style result,不是 source、計數或保證。Receipts 要自己睇。

08 / AI

FAQ:大家其實想要的直接答案

冇一個永久冠軍。你要全能 productivity、Google-connected work、長文協作,還是 citation-first research,答案會唔同。

ChatGPT、Gemini、Claude、Perplexity 邊個最準?

冇 universal winner,而「準確」亦取決於工作。開住 current search 的工具可能比較適合今日的產品資料;context 強的工具可能比較適合大份文件;citation 清楚的工具就比較容易 audit。準確性要測和核實,不係一個 app 永久擁有的 badge。

做 SEO 應該用邊個?

可以分工。Perplexity 或 Gemini 搵 current sources 和 terminology;ChatGPT 或 Claude 就將 verified brief 變 outline、audit explanation 或客戶 draft。但任何一個都代替唔到 Search Console、Analytics、technical inspection、母語判斷和你對公開 claim 的責任。

學生最適合邊個?

由幫你理解而唔係只係幫你交功課嗰個開始。ChatGPT、Gemini 可做 tutor 和 structure;Perplexity 令搵來源更透明;Claude 可幫你改長文。叫佢解釋、反駁和列 source,再自己寫返一部分。通常老師睇得出你冇做。

在職人士應該點試?

用一個真正但 anonymised 的 workflow:meeting notes 變 action list、報告變 executive summary、研究變 recommendation,或者 brief 變 first draft。量度 fact check 之後慳到幾多時間,唔好只量度未 check 前有幾快。接 file 或貼客戶資料前,先睇公司規則。

有 citation 就可以信嗎?

唔可以。Citation 改善 auditability,唔會自動製造真相。自己開 link,睇佢係咪支持 exact claim、日期新唔新,以及答案有冇將窄 source 拉闊成一個大結論。

要唔要四個都付費?

大概唔需要。先試免費或你已有的 access,揀一個 primary tool;只有當另一個真係補到 specific gap——搵來源、Google context、長文件、coding——先加第二個。四份 subscription,有時只係一個好貴的逃避揀 workflow 方法。

最後建議

用同一個 prompt、保存 raw output、評 evidence 和 edit time,揀嗰個令你做決定更好,而唔係網上嘈得最大聲嗰個。

ChatGPT、Gemini、Claude 和 Perplexity 唔係四道一模一樣、通去同一間房的門。佢哋係四條走廊,各有捷徑,也有幾道樣子可疑的門。行最貼近你實際工作的那條,自己個 judgement 記得開住。

研究+圖片來源

來源、產品備註與圖片 credits

  1. OpenAI ChatGPT overview
  2. OpenAI ChatGPT capabilities
  3. OpenAI ChatGPT Pro 說明
  4. Google Gemini 3.1 Pro
  5. Google Gemini Deep Research
  6. Google Gemini Canvas
  7. Google Gemini Gems
  8. Anthropic Claude Opus 5
  9. Anthropic Claude Sonnet 4.6
  10. Anthropic web search 說明
  11. Anthropic Artifacts 說明
  12. Perplexity Pro Search
  13. Perplexity premium data sources
  14. Perplexity

圖片來源

Research current through 2026-09-16 UTC. AI model names, plans, limits, web access, source connectors and product features can change; the comparison records public product documentation and a repeatable same-prompt method, not a permanent ranking. Image reuse rights remain with the original publishers or photographers. 產品功能、model routing、plan 和 availability 會變;作出購買或工作決定前,請核對最新產品頁。

想為未來 90 日整一套實用 AI workflow?

由你重複做的工作開始,用同一條 Prompt 測試,再由人保留最後決定權。

WhatsApp 聯絡 Locke Lee