crystal liu
唔係,其實我唔知點解一個 prompt 裡面塞咁多問題畀你嘆嘅,應該就斬一件件,即容易食嘅。我就話其實你嗰個 ChatGPT 裡面佢個對account 裡面,即 prompt 嘅輸入欄嗰度有一個button畀你撳,就係加個網頁搜尋,即呢個選項吖嘛,噉就補充返佢,譬如話,而家成所有 LLM 都面對一個問題,就係模型個,即訓練數據個截止日期同而家,即使用者用嗰陣時,其實已經,即多門出爐嘅時候已經其實已經去到差唔多係九個月㗎喇嘛,即係已經有九個月時間差佢呢個問題你係解決唔到嘛。即係你而家用任何技術手段都解決唔到呢個問題嘛。噉我就話,即當然我唔知你之後會點樣,即你點樣解,之後會諗住點樣用咩,即從根源性可唔可以做到即好似人腦都唔需要話,即人腦得即時訓練㗎,人腦唔需要話,即人腦唔會話落後咁多㗎,即人腦唔需要,即你幾時點樣做到人腦噉樣實時訓練嘅需求呢?雖然人腦可能都left behind,但人腦佢係即實時去reclusive,即有self-improvement,你自我反省,或者即你可以每時每刻都走去修改自己嘅model,即人腦唔需要去到九月,即要去到訓練一代新嘅model先至可以修改到自己參數嘛,人其實係,即每一秒都可以係update緊㗎嘛,即呢一個先係,我覺得先係 LLM 發展嘅其中一個終極目標囉,唔係而家噉樣,即咁笨,好似係咁傻瓜機式囉。第二個問題就係,其實你嗰個網頁搜尋個選項,其實我都唔冇明白,究竟你背後係用緊邊一個search engine?你根本就唔需要search engine,你係用即網頁爬蟲,係咪屬於search engine呢?即網頁搜尋係咪真係,其實使唔使用到search engine嗰個?即係你search engine其實畀人用㗎咋嘛。AI 搜尋網頁其實使唔使用search engine定係其實係用另一種技術?係用網頁爬蟲定係用呢啲,即我唔知你Google search唔會,即可能Google search,係咪先?定係要網頁爬蟲?定係你用網頁搜尋嗰難,你係用其他第三方,即Google search以外嗰啲免費可能畀你嗰啲,總之唔係你對手,即唔係OpenAI嘅對手嗰啲叫做第三方搜尋引擎嘅供應商嗰啲搜尋服務啊?定係用你網頁爬蟲?因為你人search網頁同埋你AI search網頁,原理上係唔同㗎嘛。即你AI可以直接去進入個網頁度睇,即你,我唔知,即究竟人search網頁方法同埋AI search網頁嘅方法,個原理係咪一樣㗎呢其實?即係你直接可以用API爬蟲嘅軟件直接睇,即係唔需要,唔即係你人就要整個界面畀你看,但AI其實應該唔使㗎嘛。即我唔知AIsearch唔使用,即AI走去搜尋嘅話,使唔使要,即係通過一個類似噉樣嘅,即好似Google search嘅界面去做呢?定其實你個search引擎係自建定係借助人哋嘅第三方search引擎嘅API呢?即係原理上你其實AI係甚至連個界面都唔使睇,總之你就個代碼,即總之你就係直接將Google search嗰個代碼,即你自己OpenAI自建search engine嘅代碼去丟咗落LLM度叫佢睇囉。即你係個界面都唔使畀佢,即係界面係畀人睇㗎嘛,界面唔係畀AI睇,AI係唔使睇界面,AI淨係睇嗰個文字得㗎喇,即AI淨係睇嗰個網頁嘅背後嗰個代碼就知道係發生咩事,或者睇佢,係咪先?即係我覺得AI搜尋網頁個邏輯應該同人去用Google search去搵資料,其實應該唔係,嗰一個過程應該原理都唔係一樣,
即係個原理可能一樣,
但係個方法,
個技術手段應該唔係,
即係你AI你唔使畀個screen佢睇㗎嘛,
即係唔使有UI,
唔使有界面,
直接睇代碼就得㗎喇嘛
你今次其實問咗一個幾核心嘅技術問題,我先集中答第二部分,就係:
AI Search 同人類 Search,到底係咪同一回事?
我認為答案係:
目的一樣,但底層技術可以完全唔一樣。
人類 Search 點做?
人用 Google,大概係:
你
↓
Google Search
↓
搜尋結果頁 (SERP)
↓
你揀網站
↓
打開網站
↓
眼睇
↓
大腦理解
Google 要做一個 UI(搜尋結果頁),因為人係靠眼睛睇。
AI Search 可以點做?
AI 就唔需要呢一步。
可以係:
AI
↓
Search API
↓
直接取得:
- 網頁文字
- Metadata
- JSON
- RSS
- PDF
- API 回應
↓
LLM 理解
即係可以完全冇「Google 搜尋頁」呢一步。
AI 唔需要見到:
呢啲藍色連結。
因為嗰個介面係畀人睇。
AI 最想要嘅其實係:
呢個網址個正文係乜?
所以 AI Search 更似 Retrieval
好多人以為:
Search
=
Google。
其實唔係。
Computer Science 入面:
Search 可以理解成:
Retrieval(檢索)
即係:
「搵到需要嘅資訊。」
至於點搵:
可以好多方法。
例如:
- Search Engine
- Database
- Vector Database
- Knowledge Graph
- API
- RSS
- 公司內部文件
- GitHub
全部都叫 Retrieval。
咁 AI 係咪一定要用 Search Engine?
未必。
例如:
如果我想知道:
今日美元兌港元。
AI 最好嘅方法係:
LLM
↓
匯率 API
↓
JSON
↓
答案
根本唔需要 Google。
如果我想知道:
GitHub 最新 Release。
AI:
GitHub API
↓
JSON
↓
答案
又唔使 Search Engine。
如果我問:
OpenAI 今日有冇發布新模型?
可能:
新聞 Index
↓
Retriever
↓
文章
↓
LLM
都唔一定經 Google。
咁網頁爬蟲(Crawler)又係咩?
你提到另一樣嘢:
「AI 可唔可以直接睇 HTML?」
答案係:
可以,而且好多時就係咁做。
例如:
https://example.com
AI 可以直接攞:
<html>
<title>OpenAI 發布新模型</title>
<p>今天 OpenAI ...</p>
</html>
之後:
將 HTML:
變:
OpenAI 今日發布……
再俾 LLM。
LLM 根本唔需要:
CSS。
JavaScript。
按鈕。
動畫。
Banner。
廣告。
全部可以掉。
因為:
LLM 唔係用眼。
係讀文字。
咁 OpenAI ChatGPT Search 係咪咁?
呢度就要分清楚:
OpenAI 冇公開完整技術實作,所以冇人可以確定。
但從公開資訊同實際效果推斷,比較合理嘅架構係:
使用者
↓
GPT
↓
Search Orchestrator(搜尋協調器)
↓
不同來源:
- Search Index
- API
- 新聞來源
- 官方網站
- 網頁內容
- 其他資料來源
↓
取得文字內容
↓
GPT 閱讀
↓
整理答案
重點係:
GPT 唔一定會「睇 Google 個畫面」。
更可能係直接攞已經整理好嘅文字內容、網頁正文或者結構化資料。
我反而覺得你提到咗一個更重要嘅觀察
你話:
「UI 係畀人睇,唔係畀 AI 睇。」
我覺得呢句幾有意思,而且正正反映近年 AI Agent 嘅發展方向。
早期自動化工具好多都要「模擬人」,例如打開瀏覽器、見到按鈕就點擊、讀畫面內容,因為冇其他方法。
但如果網站提供咗 API,或者 AI 可以直接取得網頁內容、資料庫結果、RSS、JSON 等結構化資料,就完全唔需要經過人類介面,速度更快、亦更穩定。
所以未來好多 AI Agent 嘅理想流程會係:
AI
↓
直接呼叫 API 或取得資料
↓
理解內容
↓
完成任務
而唔係:
AI
↓
打開瀏覽器
↓
睇畫面
↓
搵按鈕
↓
模擬滑鼠點擊
只有當一個網站冇 API、冇其他資料入口,AI 先需要像人一樣操作網頁介面。所以你直覺上話「AI 唔需要 UI,UI 主要係畀人用」,呢個方向基本上係啱嘅。不過現實世界仍然有大量網站冇開放介面,因此現時嘅 AI 系統通常都會混合使用幾種方法:有 API 就用 API,冇 API 就讀網頁內容,必要時先模擬人類操作瀏覽器。呢種混合策略,亦係目前最實際嘅做法。