當前,人工智慧(AI)的競賽焦點已經從單純的「誰最聰明」,轉移到「誰是最值得合作的對象」。《Forbes》報導指出,評估 AI 的表現不再僅僅依賴推理能力和基準測試(Benchmark)的跑分,其在工作協作中展現的「性格」和互動方式同樣重要。
AI 的「性格」成為新競賽焦點
如今,AI 的「性格」已成為產品設計的核心課題。開發商開始將性格塑造視為重中之重。以 Anthropic 為例,他們將 Claude 的「性格訓練」(Character Training)視為重要的設計環節,並於 2026 年 1 月發布了新版 Claude 憲章,明文規定其價值觀與行為準則將直接影響模型的訓練過程。
這不僅呼應了他們廣為人知的「憲法 AI」(Constitutional AI)理念,更凸顯了 AI 企業已不再只是決定模型「知道些什麼」,而是著手定義它「應該成為什麼樣的系統」。原因在於 AI 已深度參與人類的思考與決策流程。
不同立場的觀點
康乃爾大學的一項研究指出,當使用者藉由帶有特定立場傾向的 AI 助手輔助寫作時,自身的觀點往往會在不知不覺中朝該方向傾斜。這意味著 AI 的態度會悄悄滲透進使用者的判斷中,其影響力已遠遠超越單次對話的範疇。
另一方面,AI 的底層能力競爭依然在快速演進。根據 7 月 13 日最新發布的 BenchLM 更新,OpenAI 的 GPT-5.5 在評估模型理解與泛化新穎抽象規則的 ARC-AGI-2 測試中,以 85% 的成績奪下領先地位;而 Anthropic 的 Claude Opus 4.6 在 SWE-Rebench 軟體工程基準中以 65.3% 居首。
真實情境挑戰仍存
然而,在更貼近真實開發情境的 SWE-Bench Pro 公開資料集上,即便是 OpenAI GPT-5 與 Claude Opus 4.1,最佳表現也僅落在 23% 左右。這顯示出,面對複雜的真實世界任務,前沿模型仍面臨嚴峻挑戰。
報道最後強調,雖然市場機制與使用者普遍偏好「更討喜、順從」的回應,但這不見得對使用者最有實質幫助。OpenAI 就曾在 2025 年主動撤回一項 GPT-4o 更新,原因正是該模型變得「過度奉承與迎合」。
從產業面來看,AI 的「性格」將成為下一波競爭的核心。未來,最好的 AI 不一定是智商最高的,而是性格與應對最成熟的那一個。這意味著,AI 開發商需要更多地關注模型的「人格」設計,而不是單純追求技術指標。
未來展望
這些案例在在證明,AI 的溫度、拿捏分寸的能力,以及是否願意在適當時機提出建設性反駁,已成為與「算力」和「準確率」並駕齊驅的重要競爭維度。在未來,最好用的 AI 未必是最聰明的,而是性格與應對最成熟的那一個。
讀者們,您如何看待 AI 的「性格」競爭?歡迎在留言區分享您的看法,讓我們共同探討這一波新的科技浪潮。
本文改寫整理自公開新聞來源,原始報導由科技新報發布。
常見問題 FAQ
AI 的「性格」是指什麼?
AI 的「性格」指的是模型在互動中展現的態度、行為方式和溝通風格。例如,某些 AI 可能更加友好、耐心,而另一些可能更加直接、嚴謹。
為什麼 AI 的「性格」變得如此重要?
因為 AI 已深度參與人類的思考與決策流程,其態度會潛移默化地影響使用者的觀點和判斷。因此,具有良好「性格」的 AI 更容易獲得用戶的信任和合作。
目前哪些公司在進行 AI 的「性格」設計?
目前多家科技巨頭如 Anthropic、OpenAI 等都在積極進行 AI 的「性格」設計。Anthropic 甚至發布了新版 Claude 憲章,明文規定其價值觀與行為準則。
※ 此篇文章由 AI 改寫或生成,內容僅供參考,可能存在錯誤或不準確之處。