|
八 個 成員 要 到 這裡 。 這 個 星期 , 張宏江 小組 的 七 名 成員 每 天 上午 一頭 鑽進 「 火藥庫 」 , 在 這裡 提出 一 個 全新 的 理論 , 試圖 徹底 改變 「 搜尋 引擎 」 的 傳統 研究 方法 , 卻 遭到 來自 微軟 總部 的 多媒體 專家 蘇珊 的 激烈 反對 。 「 搜尋 引擎 」 專案 的 主旨 是 在 一 大 堆 浩如 煙海 的 資料 中 , 以 最 快捷 準確 的 速度 找到 自己 需要 的 東西 。 很 明顯 , 這 個 東西 一旦 成功 , 立即 可 讓 千萬 用戶 受益 無窮 。 所以 , 之前 已 有 無數 科學家 將 注意力 集中 於 這 個 領域 , 不過 迄 今 為止 的 研究 全 都 是 讓 用戶 在 電腦 裡 輸入 一 個 「 關鍵 字彙 」 , 然後 電腦 根據 這 個 提示 來 找尋 有關 資料 , 其 結果 是 一 個 關鍵 字彙 可能 帶來 成千上萬 的 結論 , 這 對 用戶 來 說 等於 無用 。 張宏江 小組 把 這 種 方法 叫做 「 上 一 代 搜尋 引擎 」 。 他們 決心 開闢 「 下 一 代 搜尋 引擎 」 , 也 就是 讓 電腦 具有 更 強 的 選擇性 , 在 用戶 提出 問題 之後 , 僅僅 交還 用戶 幾 個 最 精確 的 答案 。 這 一 計畫 建立 在 一 個 假設 的 邏輯 上 : 大多數 人 提出 的 大部分 問題 , 其實 只 集中 在 幾 個 概念 , 少數 人 提出 的 概念 一般 可以 覆蓋 很多 問題 , 這 構成 了 張宏江 小組 研究 的 基本 理論 。 他們 希望 新一代 「 搜尋 引擎 」 能夠 證明 此 一 理論 , 倘若 如願以償 , 則 有 可能 在 電腦 網路 技術 發展史 上 佔有 一 頁 。 但 蘇珊 來到 北京 之後 所 做 的 第一 件 事情 , 就是 向 這 個 「 假設 」 提出 挑戰 。 在 「 火藥庫 」 的 會議 上 , 蘇珊 堅決 表示 : 「 這 個 東西 不 對 。 」 __UNDEF__ 蘇珊 在 美國 微軟 總部 研究 搜尋 引擎 多 年 , 做 過 無數 實驗 , 腦子 裡 充滿 了 權威 的 論點 和 多 年 的 經驗 , 其中 最 重要 的 一 個 就 是 用戶 給 電腦 提出 的 「 關鍵字 」 越 少 , 電腦 提供 用戶 的 結果 就 越 多 。 這 是 一 個 鐵 的 規律 , 所以 , 希望 透過 減少 關鍵字 的 辦法 使 答案 精確化 是 行不通 的 。 一 群 年輕 的 中國人 申辯 說 他們 想 交給 電腦 的 不 是 「 詞彙 」 , 而是 「 概念 」 。 按照 張宏江 的 解釋 , 提出 「 關鍵字 」 和 提出 「 關鍵 概念 」 不 是 同 一 回 事 , 但 蘇珊 看 不 出 這 兩 者 有 什麼 區別 。 這 場 爭論 為 張宏江 小組 帶來 技術 上 的 陰影 , 但 他們 不 在乎 這 個 , 認為 自己 才 是 新 世界 的 開拓 者 。 這 場 爭論 中 無論 誰 是 對 的 , 我們 都 能夠 得出 一 個 結論 , 即 這些 年輕 的 中國人 放 在 希格瑪 大廈 裡 的 不僅僅 是 時間 , 還 有 熱情 和 智慧 。 然而 還 有 更加 重要 的 事 。 從 時間 的 先後 來 看 , 當 「 龍苑 會議 」 召開 時 , 這 個 爭論 剛剛 結束 。 李開復 並 不能 斷定 是非 誰 屬 , 也 明白 這 中間 沒有 什麼 理論 的 問題 , 只有 靠 實驗 。 當 張宏江 表示 這 個 專案 的 本質 是 讓 機器 更 像 一 個 人 的 時候 , 他 就 半 玩笑 半 認真 地 說 : 「 其實 我們 不能 設想 讓 機器 完全 像 一 個 人 。 比如 人 與 機器 對話 , 它 要是 老實 地 回答 你 的 問題 , 你 就 會 覺得 它 不 是 一 個 人 ; 它 要是 罵人 、 胡說八道 , 例如 問 它 『 天氣 如何 』 , 它 反問 『 你 憑 什麼 問 我 這 個 』 , 這 就 像是 一 個 人 了 , 卻 不 像 一 個 二十一世紀 的 技術 。 」 可是 無論 機器 能否 變成 人 , 李開復 都 確信 「 這 個 工作 對 公司 的 價值 可能 超過 其他 東西 。 」 他 根據 以往 的 經驗 告訴 張宏江 : 「 最 好 的 結果 都 是 最 沒有 學問 的 。 」 還 將 這 個 專案 列入 最近 的 目標 , 劃出 一 道 「 死亡線 」 , 顯然 這 也 就 是 支持 張宏江 小組 向 傳統 方法 挑戰 的 決心 。 最初 的 設計 是 圍繞 旅遊 專案 展開 的 。 「 比起 過去 的 搜尋 引擎 , 我們 的 東西 多 了 一 個 『 自然 語言 分析器 』 。 」 楊強 對 大家 說 , 「 比如 你 想 知道 從 北京 到 上海 的 距離 , 過去 的 搜尋 引擎 只 能 把 『 北京 』 、 『 上海 』 、 『 距離 』 這 幾 個 關鍵字 抓出來 , 分別 扔到 資料庫 去 查詢 。 我們 的 東西 不 是 這樣 , 而是 要 把 『 北京 』 和 『 上海 』 都 當做 距離 的 參數 , 讓 機器 找出 其中 的 關係 。 所以 我們 不 是 輸入 關鍵字 , 而是 輸入 一 個 意思 。 」 「 我們 先 建立 『 資料庫 』 , 還是 先 設計 『 搜尋 引擎 』 ? 」 有 人 問 。 這 問題 恰恰 正中 此 一 計畫 的 要害 。 「 是 啊 , 」 楊強 承認 , 「 這 是 一 個 先 有 雞 還是 先 有 蛋 的 問題 。 『 搜尋 引擎 』 是 雞 , 『 資料庫 』 是 蛋 ; 沒有 雞 就 沒有 蛋 , 沒有 蛋 就 沒有 雞 。 」 孫燕峰 是 傾向 先 有 「 雞 」 的 , 「 無論如何 , 搜尋 引擎 這 東西 不 弄 起來 , 就 無法 繼續 研究 。 比如 我們 設計 鞋子 , 總 要 知道 用戶 想要 什麼 樣子 才 好 進一步 做 鞋 。 假造 一 個 『 雞 』 拿去 讓 用戶 使用 , 就 會 有 『 蛋 』 , 我們 拿到 『 蛋 』 就 會 研究出 更 好 的 『 雞 』 。 」 也 有 人 傾向於 先 有 「 蛋 」 , 「 沒有 足夠 的 資料 , 你 的 『 引擎 』 不可能 足夠 好 。 不 好 的 『 引擎 』 , 用戶 就 不 願意 用 , 用戶 不 用 , 又 從 哪裡 得到 資料 ? 」 在 一 番 激烈 的 爭論 之後 , 大家 決定 讓 「 雞 」 和 「 蛋 」 交錯 前進 。 五 名 研究員 圍 著 一 張 小 圓桌 , 製造出 「 最初 的 蛋 」 ( 各自 寫出 最 希望 知道 的 十 個 問題 ) , 然後 開始 設計 「 最初 的 雞 」 ( 一 個 搜尋 引擎 ) 。 張高 為 這 隻 「 雞 」 做 了 一 個 漂亮 的 「 臉 」
|