前 OpenAI 技術長 Mira Murati 創立的 AI 公司 Thinking Machines,於週一宣布他們正在開發一種名為「互動模型」的技術。根據 Thinking Machines 的說法,互動模型的理念是讓人類能夠「像我們彼此之間自然協作一樣與 AI 協作 — 它們能持續接收音訊、視訊和文字,並即時思考、回應和行動」。

現有的模型以單一線程體驗現實。在使用者完成打字或說話之前,模型會等待,無法感知使用者正在做什麼或如何做。直到模型完成生成,其感知會凍結,在完成或被中斷之前無法接收新資訊。這為人機協作創造了一個狹窄的通道,限制了多少人的知識、意圖和判斷能傳達給模型,以及模型的工作有多少能被理解。想像一下,試圖透過電子郵件而不是面對面來解決一個關鍵的分歧。

在 Thinking Machines,我們相信可以透過讓 AI 在任何媒介上實現即時互動來解決這個頻寬瓶頸。這使得 AI 介面能夠在人類所在的地方與他們會面,而不是迫使人類為了適應 AI 介面而扭曲自己。

Thinking Machines 還分享了幾個模型實際運作的範例,包括在故事中偵測動物的提及、即時翻譯語音,以及在使用者駝背時提醒他們。

您可以在 Thinking Machines 的網站上閱讀對互動模型的更深入解釋。然而,您目前還無法親自嘗試互動模型;Thinking Machines 計畫在「未來幾個月內」開放「有限的研究預覽」,並目標在「今年稍晚」進行「更廣泛的發布」。

Murati 在 2025 年 2 月離開 OpenAI 後創立了 Thinking Machines。該 AI 實驗室已經面臨許多重要成員的離職,其中一些關鍵成員跳槽到 Meta 甚至重返 OpenAI。