文章目錄+
01 / AI
唔好俾 logo 幫你揀答案
四個 chat 視窗,四個品牌,一個有少少攰的人問:「我應該用邊個?」網上通常即刻頒獎,拎 benchmark screenshot 出嚟,或者宣布某個模型「贏咗」——好似學生做 presentation 同 developer 修 code,係參加同一場拳賽咁。
佢哋唔係同一款產品,即使四個都可以寫 email、解釋 SEO,或者將一段亂糟糟文字改到似樣。ChatGPT 比較似多用途 assistant 加工作台;Gemini 同 Google 生態和研究工具連得比較深;Claude 偏向細膩寫作、長文件、coding 同可重用 artifact;Perplexity 就係 search-first,主打搵來源、列 citation 和追查資料。呢啲係重心,唔係鐵律。
“最好用的 AI,通常係令你清楚下一步做乜嗰個。” — 一條冇咁花巧但比較穩陣的揀法

想要一個全能起點,先試 ChatGPT;工作大量用 Google Search、Gmail、Drive 或 NotebookLM,就試 Gemini;要改長文、睇大份文件、寫 code 或整 artifact,就試 Claude;要搵最新資料、早早見到 citation,就先試 Perplexity。之後用同一個 prompt 自己跑一次,因為你的語言、plan 同工作會改變結果。
先提一句:app 名唔等於 model 名。Plan、地區、使用量、web access、揀到的 model 和 feature rollout 都會變。六個月前寫得好認真的 review,今日都可能已經舊。AI 比較有時比 office pantry 的切開水果更快變質。
02 / AI
四個工具,其實想做甚麼?
| 工具 | 核心重心 | 通常邊類工作順手 | 要慢一慢檢查甚麼 |
|---|---|---|---|
| ChatGPT | 多用途 assistant 及工作台 | 混合工作:起稿、分析、coding、檔案、圖像、聲音、project 和研究流程。 | 功能及 model 按 plan 有差異;寫得流暢唔等於一定啱。 |
| Gemini | 連住 Google 的多模態 assistant | Google Search 研究、Workspace、Canvas、NotebookLM、視覺和結構化解釋。 | 來源、帳戶權限和 feature availability;連住 Google 唔代表自動核實。 |
| Claude | 寫作、推理、code 和 artifact 合作夥伴 | 長文件、改稿、code review、整理複雜想法、分享獨立作品。 | 語氣太靚會令不確定性縮細;web search 要睇當時帳戶有冇開。 |
| Perplexity | Search-first 研究介面 | 快搵來源、直接 link、follow-up、不同搜尋模式和 visible citations。 | Citation 只表示來源存在,唔保證 synthesis 一定對;最後品牌文案可能要再改。 |
目前產品功能以官方文件為基礎:OpenAI 的 ChatGPT overview 和 capabilities 說明;Google 的 Gemini Deep Research、Canvas 和 Gems;Anthropic 的 web search 和 Artifacts;以及 Perplexity 的 Pro Search 說明。

當佢哋係四位同事咁睇:ChatGPT 係轉場快的 generalist;Gemini 係已經坐喺 Google 大樓入面的同事;Claude 拎住紅筆、大文件夾,鍾意乾淨結構;Perplexity 入門時已經拎住一疊 receipts。重要資料唔好交俾任何一位獨自決定,尤其係冇人 check 的時候。
03 / AI
同一個 Prompt 實測:點樣唔好作弊?
本文採用的 editorial benchmark prompt 如下,四個工具都應該貼同一段:
You are advising a Hong Kong student or working professional who wants to learn practical AI tools for research and marketing. Compare ChatGPT, Gemini, Claude, and Perplexity for this exact job: explain the difference between SEO and SEM for a Hong Kong business; recommend a realistic 30-day learning plan; cite current official sources; identify what may be outdated or uncertain; and finish with one clear recommendation for a beginner. Use plain English, a compact comparison table, and separate facts from your own judgement. Do not invent prices, rankings, or product features.
呢條 prompt 故意唔複雜,但夠貼近日常:學生或在職人士要 AI 搵資料、解釋、整學習計劃、列最新 citation,再講清楚不確定性。亦有個小陷阱:SEO 同 SEM 容易講到似懂非懂,而 current product facts 如果冇 browsing,好容易自行作出嚟。
| 控制項目 | 四個測試都保持一樣 | 點解重要 |
|---|---|---|
| 日期時間 | 同一星期跑,記低 model、plan 和 timestamp。 | 產品功能和 web 結果會變;冇日期的結果只完成了一半。 |
| Prompt | 連標點都照貼,不要睇完一個答案先幫另一個改 prompt。 | 一改 prompt,就由比較變成偏好測試。 |
| 來源規則 | 全部要求 current official sources,重要 claim 要自己開 link。 | 有 citation 唔代表 link 相關、未過時或真係支持旁邊句子。 |
| Context | 相同語言、不加額外檔案、同一 follow-up policy、盡量一樣的 browsing。 | 一個工具 upload 咗 file,工作已經變咗。 |
| 評分 | 準確性、來源質素、可用度、不確定性、香港相關性和 edit time。 | 「我鍾意個 tone」有用,但唔係完整測試。 |
唔好 Perplexity 開住 citation,另一個工具關閉 browsing,之後話某個 model 輸咗。呢個唔係公平比賽,係叫圖書館員同一個被蒙住眼的人鬥搵資料。功能唔能夠完全拉平,就將差異本身記入產品體驗。
呢個係實用產品比較,不是科學 benchmark。Model routing、plan limit、地區 rollout、system instruction 和即時 web 結果都會改答案。測試方法可以重複,但唔應該當成永久排名。
04 / AI
同一條 prompt,四個答案通常有咩味道?
| 測試項目 | ChatGPT | Gemini | Claude | Perplexity |
|---|---|---|---|---|
| 解釋 SEO 同 SEM | 可按初學者或 technical level 快速調整,整體比較平均。 | 結構和 current-search framing 通常清楚,尤其開 Search 時。 | 語氣平穩、有條理,通常加到 caveat 但唔會變法律文件。 | 較 concise、source-forward,常先交代資料從哪裡來。 |
| 30 日學習計劃 | 容易變成 steps、checklist、portfolio task。 | 如果涉及 Google tools、Workspace 或研究來源,會比較順。 | 排序和教學感較好,適合整理成可以慢慢跟的文件。 | 搵課程和工具資料方便,但計劃仍要自己改到貼身。 |
| 最新官方來源 | 開 web/research 後可做,重要 link 仍要自己核對。 | Deep Research 預設用 Google Search,視乎帳戶可加入 Drive、Gmail 等。 | 有 web search 時可以 grounding,但唔好假設永遠自動開。 | Citation 和搵來源係產品主場,Pro Search 尤其明顯。 |
| 最後文字質素 | 風格彈性最大,適合 casual、professional、雙語或格式化。 | 視覺、結構和 Google workflow 輸出常有優勢。 | 細膩改稿和長文連貫感通常舒服。 | 研究骨架好用,最後品牌 tone 可能要再執。 |
| 主要風險 | 有信心的 synthesis 可能混埋已知、推論和生成內容。 | 連住資料會令人誤以為答案已經自動驗證。 | 文字好順,錯誤假設反而較難即時發覺。 | 一長串 citation 會似證明,但 source-to-claim 未必貼。 |

呢啲係傾向,不是成績表。Prompt 寫得好,安靜的工具都可以突然唱歌;prompt 寫得差,再勁的工具都可以煮出一鍋湯。日常工作最明顯的差別,很多時唔係 raw intelligence,而係產品幫你搵證據、保存 context、修改輸出和行下一步有幾順。
做 SEO 更加係咁。叫 AI 列十個 keywords,你可能得到十個樣樣似真的 phrase;叫佢分搜尋意圖、為 claim 找來源、標記 assumptions,再提出可以喺 Search Console 驗證的 test,先至真正測到判斷力,而唔係 autocomplete。
05 / AI
真正取捨:來源、長 context、檔案和 workflow
要 receipts
Perplexity 由一開始展示來源,適合想早啲睇 links 的研究。
要乾淨改稿
Claude 通常適合做長文、複雜 draft 的第二雙眼。
要混合工具箱
一個工作由檔案跳去分析、寫作、聲音或 code,ChatGPT 係好起點。
要 Google context
工作已經放喺 Search、Drive、Gmail 或 NotebookLM,就值得先試 Gemini。
要持續使用
真正最好係你明白佢的限制和 context 規則,而且每星期會開。
| Workflow 問題 | 選之前要檢查 |
|---|---|
| 可以 browsing 嗎? | Web access 係自動、可選、按 plan 限制,定係你個帳戶未有? |
| 可以 citation 嗎? | Citation 係咪直接、相關,重要 claim 背後條 source 開唔開到? |
| 可以處理我的檔案嗎? | 睇 file size、格式、私隱、context limit,以及回答有冇真係用到 file。 |
| 結果可唔可以重用? | 睇 Projects、Canvas、Artifacts、custom instructions、Gems、export、sharing 和 version。 |
| 團隊用得安全嗎? | 睇帳戶類型、data control、connector、retention、permission 和客戶資料規則。 |
| 香港語言用得自然嗎? | 測繁中、廣東話味、英文 source terms,睇會唔會亂譯到冇人咁講。 |
Google 現時 Gemini 文件說明 Deep Research 預設會用 Google Search,按功能和帳戶可加入 Gmail、Drive、upload file 或 NotebookLM。Perplexity 說明 selected premium sources 和 direct citations;Anthropic 就說明 web search 要按當時介面或 workspace 設定開啟。留意每段的「可以」——account、plan 和 rollout 真係會影響。
唔好為咗比較 tone,就將客戶機密 traffic report、客戶名單、未推出產品或個人資料貼入四個 consumer account。慳到二十分鐘,但之後解釋唔到資料去咗邊,唔係抵。
香港仲有一個小麻煩:語言切換。工具可以寫到好正的書面中文,但捉唔到廣東話 query 背後的搜尋意圖;又或者將英文 SEO term 直譯成市場根本唔會搜尋的字。保留原 query、翻譯版本和母語讀者 check,三樣都要有。
06 / AI
學生或在職人士,應該用邊個?
| 你的情況 | 第一個測試組合 | 原因 |
|---|---|---|
| 學生做 report | Perplexity 搵來源,再用 ChatGPT 或 Claude 重整和解釋。 | 將找證據同寫成論點分開。 |
| 學生學 marketing/SEO | ChatGPT 或 Gemini 做 guided practice,再以 Google 官方文件做事實底座。 | AI 可以教你,但 fundamentals 應該由官方文件 anchor。 |
| 在職人士寫報告 | 用 Claude 和 ChatGPT 同時改同一份 anonymised draft。 | 比較 instruction-following、改稿質素和最後要執幾多。 |
| 在職人士重度用 Google Workspace | 先試 Gemini,尤其係 connected research 和文件流程。 | 生態連接慳的時間,可能比一兩句 prose 差異更值錢。 |
| Marketer 做 current research | Perplexity 加開 web research 的 Gemini/ChatGPT。 | 比較來源透明度、新鮮程度和核查時間。 |
| Developer 或 technical learner | ChatGPT 和 Claude 用同一 bug、spec 或 repository excerpt;工作靠 Google 就加試 Gemini。 | Code、context 和 trade-off 解釋,比 generic chatbot 排名重要。 |

我會建議養成兩工具習慣,而唔係四個 tab 宗教。用一個搵或 challenge evidence,再用另一個整理 final work。分開兩個角色,比較容易發現一段好靚的句子其實冇穩固地板。
如果你只想揀一個免費起點,就揀你聽日真係會開嗰個。理論上最勁,但 workflow 麻煩到你唔想用的工具,在你生活入面就唔係最好。呢個唔係哲學,係 calendar management 戴咗頂 AI 小帽。
07 / AI
一份可以重複的同 Prompt 評分表
| 項目 | 0 分 | 1–3 分 | 5 分 |
|---|---|---|---|
| 準確性 | 有重大錯誤或虛構產品功能。 | 大致正確,但 claim 無支持或講得含糊。 | claim 準確、有界線,而且易核實。 |
| 來源質素 | 冇來源或 link 不相關。 | 有少量相關 link,但 source-to-claim 要重做。 | 主要用當前 primary source,貼住 claim。 |
| 工作可用度 | 泛泛而談,套落任何人都得。 | 有 outline,但要大幅重整。 | 有現實 plan、具體下一步和限制。 |
| 不確定性 | 當所有事都確定。 | 提到限制但冇講清位置。 | 分開 fact、inference、unknown 和下一步核查。 |
| 香港相關性 | 忽略語言、香港市場和實際 context。 | 提香港但仍然好 generic。 | 自然處理香港語言、例子、搜尋習慣和限制。 |
| Edit time | 幾乎全部要重寫。 | 要中量 cleanup 和 fact check。 | 人手合理 review 後可以再用。 |
保存 raw answer、prompt、model name、plan、browsing status、timestamp、citation 和分數。冇呢份記錄,「Claude 好啲」或者「Gemini 聰明啲」只係 office folklore,距離下一份 PPT 得一步。
- 第一讀:有冇答中工作?好靚但答非所問,仍然係 fail。逐項 mark 返要求是否出現。
- 第二讀:重要 claim 核唔核到?開 source、睇日期,reject 只係碰巧有相同字眼的 link。
- 第三讀:佢假設咗甚麼?留意受眾、預算、地區、語言、產品等隱藏假設。
- 第四讀:聽日有甚麼用?保留真正減工的 checklist、brief、table、experiment 或 decision。
- 最後讀:邊度要人簽名?事實、私隱、客戶 claim、錢、法律和公開建議,都要人負責。
順口係 style result,不是 source、計數或保證。Receipts 要自己睇。
08 / AI
FAQ:大家其實想要的直接答案
ChatGPT、Gemini、Claude、Perplexity 邊個最準?
冇 universal winner,而「準確」亦取決於工作。開住 current search 的工具可能比較適合今日的產品資料;context 強的工具可能比較適合大份文件;citation 清楚的工具就比較容易 audit。準確性要測和核實,不係一個 app 永久擁有的 badge。
做 SEO 應該用邊個?
可以分工。Perplexity 或 Gemini 搵 current sources 和 terminology;ChatGPT 或 Claude 就將 verified brief 變 outline、audit explanation 或客戶 draft。但任何一個都代替唔到 Search Console、Analytics、technical inspection、母語判斷和你對公開 claim 的責任。
學生最適合邊個?
由幫你理解而唔係只係幫你交功課嗰個開始。ChatGPT、Gemini 可做 tutor 和 structure;Perplexity 令搵來源更透明;Claude 可幫你改長文。叫佢解釋、反駁和列 source,再自己寫返一部分。通常老師睇得出你冇做。
在職人士應該點試?
用一個真正但 anonymised 的 workflow:meeting notes 變 action list、報告變 executive summary、研究變 recommendation,或者 brief 變 first draft。量度 fact check 之後慳到幾多時間,唔好只量度未 check 前有幾快。接 file 或貼客戶資料前,先睇公司規則。
有 citation 就可以信嗎?
唔可以。Citation 改善 auditability,唔會自動製造真相。自己開 link,睇佢係咪支持 exact claim、日期新唔新,以及答案有冇將窄 source 拉闊成一個大結論。
要唔要四個都付費?
大概唔需要。先試免費或你已有的 access,揀一個 primary tool;只有當另一個真係補到 specific gap——搵來源、Google context、長文件、coding——先加第二個。四份 subscription,有時只係一個好貴的逃避揀 workflow 方法。
用同一個 prompt、保存 raw output、評 evidence 和 edit time,揀嗰個令你做決定更好,而唔係網上嘈得最大聲嗰個。
ChatGPT、Gemini、Claude 和 Perplexity 唔係四道一模一樣、通去同一間房的門。佢哋係四條走廊,各有捷徑,也有幾道樣子可疑的門。行最貼近你實際工作的那條,自己個 judgement 記得開住。
研究+圖片來源
來源、產品備註與圖片 credits
- OpenAI ChatGPT overview
- OpenAI ChatGPT capabilities
- OpenAI ChatGPT Pro 說明
- Google Gemini 3.1 Pro
- Google Gemini Deep Research
- Google Gemini Canvas
- Google Gemini Gems
- Anthropic Claude Opus 5
- Anthropic Claude Sonnet 4.6
- Anthropic web search 說明
- Anthropic Artifacts 說明
- Perplexity Pro Search
- Perplexity premium data sources
- Perplexity
圖片來源
- 01-hku-lecture.jpg — 網上找到的真實課堂/工作坊照片,來源:www.thestandard.com.hk;圖片直連。
- 02-uowhk-workshop.jpg — 網上找到的真實課堂/工作坊照片,來源:www.uowchk.edu.hk;圖片直連。
- 03-polyu-hkcc-seminar.jpg — 網上找到的真實課堂/工作坊照片,來源:www.hkcc-polyu.edu.hk;圖片直連。
- 04-digital-marketing-class.webp — 網上找到的真實課堂/工作坊照片,來源:ingoacademy.ntu.edu.tw;圖片直連。
Research current through 2026-09-16 UTC. AI model names, plans, limits, web access, source connectors and product features can change; the comparison records public product documentation and a repeatable same-prompt method, not a permanent ranking. Image reuse rights remain with the original publishers or photographers. 產品功能、model routing、plan 和 availability 會變;作出購買或工作決定前,請核對最新產品頁。