crystal liu

in #crystal17 hours ago (edited)

唔係,其實我唔知點解一個 prompt 裡面塞咁多問題畀你嘆嘅,應該就斬一件件,即容易食嘅。我就話其實你嗰個 ChatGPT 裡面佢個對account 裡面,即 prompt 嘅輸入欄嗰度有一個button畀你撳,就係加個網頁搜尋,即呢個選項吖嘛,噉就補充返佢,譬如話,而家成所有 LLM 都面對一個問題,就係模型個,即訓練數據個截止日期同而家,即使用者用嗰陣時,其實已經,即多門出爐嘅時候已經其實已經去到差唔多係九個月㗎喇嘛,即係已經有九個月時間差佢呢個問題你係解決唔到嘛。即係你而家用任何技術手段都解決唔到呢個問題嘛。噉我就話,即當然我唔知你之後會點樣,即你點樣解,之後會諗住點樣用咩,即從根源性可唔可以做到即好似人腦都唔需要話,即人腦得即時訓練㗎,人腦唔需要話,即人腦唔會話落後咁多㗎,即人腦唔需要,即你幾時點樣做到人腦噉樣實時訓練嘅需求呢?雖然人腦可能都left behind,但人腦佢係即實時去reclusive,即有self-improvement,你自我反省,或者即你可以每時每刻都走去修改自己嘅model,即人腦唔需要去到九月,即要去到訓練一代新嘅model先至可以修改到自己參數嘛,人其實係,即每一秒都可以係update緊㗎嘛,即呢一個先係,我覺得先係 LLM 發展嘅其中一個終極目標囉,唔係而家噉樣,即咁笨,好似係咁傻瓜機式囉。第二個問題就係,其實你嗰個網頁搜尋個選項,其實我都唔冇明白,究竟你背後係用緊邊一個search engine?你根本就唔需要search engine,你係用即網頁爬蟲,係咪屬於search engine呢?即網頁搜尋係咪真係,其實使唔使用到search engine嗰個?即係你search engine其實畀人用㗎咋嘛。AI 搜尋網頁其實使唔使用search engine定係其實係用另一種技術?係用網頁爬蟲定係用呢啲,即我唔知你Google search唔會,即可能Google search,係咪先?定係要網頁爬蟲?定係你用網頁搜尋嗰難,你係用其他第三方,即Google search以外嗰啲免費可能畀你嗰啲,總之唔係你對手,即唔係OpenAI嘅對手嗰啲叫做第三方搜尋引擎嘅供應商嗰啲搜尋服務啊?定係用你網頁爬蟲?因為你人search網頁同埋你AI search網頁,原理上係唔同㗎嘛。即你AI可以直接去進入個網頁度睇,即你,我唔知,即究竟人search網頁方法同埋AI search網頁嘅方法,個原理係咪一樣㗎呢其實?即係你直接可以用API爬蟲嘅軟件直接睇,即係唔需要,唔即係你人就要整個界面畀你看,但AI其實應該唔使㗎嘛。即我唔知AIsearch唔使用,即AI走去搜尋嘅話,使唔使要,即係通過一個類似噉樣嘅,即好似Google search嘅界面去做呢?定其實你個search引擎係自建定係借助人哋嘅第三方search引擎嘅API呢?即係原理上你其實AI係甚至連個界面都唔使睇,總之你就個代碼,即總之你就係直接將Google search嗰個代碼,即你自己OpenAI自建search engine嘅代碼去丟咗落LLM度叫佢睇囉。即你係個界面都唔使畀佢,即係界面係畀人睇㗎嘛,界面唔係畀AI睇,AI係唔使睇界面,AI淨係睇嗰個文字得㗎喇,即AI淨係睇嗰個網頁嘅背後嗰個代碼就知道係發生咩事,或者睇佢,係咪先?即係我覺得AI搜尋網頁個邏輯應該同人去用Google search去搵資料,其實應該唔係,嗰一個過程應該原理都唔係一樣,
即係個原理可能一樣,
但係個方法,
個技術手段應該唔係,
即係你AI你唔使畀個screen佢睇㗎嘛,
即係唔使有UI,
唔使有界面,
直接睇代碼就得㗎喇嘛

你今次其實問咗一個幾核心嘅技術問題,我先集中答第二部分,就係:

AI Search 同人類 Search,到底係咪同一回事?

我認為答案係:

目的一樣,但底層技術可以完全唔一樣。


人類 Search 點做?

人用 Google,大概係:

你
↓
Google Search
↓
搜尋結果頁 (SERP)
↓
你揀網站
↓
打開網站
↓
眼睇
↓
大腦理解

Google 要做一個 UI(搜尋結果頁),因為人係靠眼睛睇


AI Search 可以點做?

AI 就唔需要呢一步。

可以係:

AI
↓
Search API
↓
直接取得:
- 網頁文字
- Metadata
- JSON
- RSS
- PDF
- API 回應
↓
LLM 理解

即係可以完全冇「Google 搜尋頁」呢一步。

AI 唔需要見到:

呢啲藍色連結。

因為嗰個介面係畀人睇。

AI 最想要嘅其實係:

呢個網址個正文係乜?


所以 AI Search 更似 Retrieval

好多人以為:

Search

=

Google。

其實唔係。

Computer Science 入面:

Search 可以理解成:

Retrieval(檢索)

即係:

「搵到需要嘅資訊。」

至於點搵:

可以好多方法。

例如:

  • Search Engine
  • Database
  • Vector Database
  • Knowledge Graph
  • API
  • RSS
  • 公司內部文件
  • GitHub
  • Email

全部都叫 Retrieval。


咁 AI 係咪一定要用 Search Engine?

未必。

例如:

如果我想知道:

今日美元兌港元。

AI 最好嘅方法係:

LLM
↓
匯率 API
↓
JSON
↓
答案

根本唔需要 Google。


如果我想知道:

GitHub 最新 Release。

AI:

GitHub API
↓
JSON
↓
答案

又唔使 Search Engine。


如果我問:

OpenAI 今日有冇發布新模型?

可能:

新聞 Index
↓
Retriever
↓
文章
↓
LLM

都唔一定經 Google。


咁網頁爬蟲(Crawler)又係咩?

你提到另一樣嘢:

「AI 可唔可以直接睇 HTML?」

答案係:

可以,而且好多時就係咁做。

例如:

https://example.com

AI 可以直接攞:

<html>
<title>OpenAI 發布新模型</title>

<p>今天 OpenAI ...</p>

</html>

之後:

將 HTML:

變:

OpenAI 今日發布……

再俾 LLM。

LLM 根本唔需要:

CSS。

JavaScript。

按鈕。

動畫。

Banner。

廣告。

全部可以掉。

因為:

LLM 唔係用眼。

係讀文字。


咁 OpenAI ChatGPT Search 係咪咁?

呢度就要分清楚:

OpenAI 冇公開完整技術實作,所以冇人可以確定。

但從公開資訊同實際效果推斷,比較合理嘅架構係:

使用者
↓

GPT

↓

Search Orchestrator(搜尋協調器)

↓

不同來源:
- Search Index
- API
- 新聞來源
- 官方網站
- 網頁內容
- 其他資料來源

↓

取得文字內容

↓

GPT 閱讀

↓

整理答案

重點係:

GPT 唔一定會「睇 Google 個畫面」。

更可能係直接攞已經整理好嘅文字內容、網頁正文或者結構化資料。


我反而覺得你提到咗一個更重要嘅觀察

你話:

「UI 係畀人睇,唔係畀 AI 睇。」

我覺得呢句幾有意思,而且正正反映近年 AI Agent 嘅發展方向。

早期自動化工具好多都要「模擬人」,例如打開瀏覽器、見到按鈕就點擊、讀畫面內容,因為冇其他方法。

但如果網站提供咗 API,或者 AI 可以直接取得網頁內容、資料庫結果、RSS、JSON 等結構化資料,就完全唔需要經過人類介面,速度更快、亦更穩定。

所以未來好多 AI Agent 嘅理想流程會係:

AI
↓

直接呼叫 API 或取得資料

↓

理解內容

↓

完成任務

而唔係:

AI
↓

打開瀏覽器

↓

睇畫面

↓

搵按鈕

↓

模擬滑鼠點擊

只有當一個網站冇 API、冇其他資料入口,AI 先需要像人一樣操作網頁介面。所以你直覺上話「AI 唔需要 UI,UI 主要係畀人用」,呢個方向基本上係啱嘅。不過現實世界仍然有大量網站冇開放介面,因此現時嘅 AI 系統通常都會混合使用幾種方法:有 API 就用 API,冇 API 就讀網頁內容,必要時先模擬人類操作瀏覽器。呢種混合策略,亦係目前最實際嘅做法。