Salesforce 聯手 Nvidia 推出首個推理模型 Koa:開源權重走企業專用路線

Salesforce 在本週的 Dreamforce 大會上發布名為 Koa 的人工智能模型,這是該公司首個推理模型,建基於 Nvidia 的開源權重 Nemotron 模型,並由兩間公司合作進行後訓練,專攻銷售、市場推廣及客戶服務相關任務。Koa 將成為其 Agentforce 平台上的模型選項之一。[1][2]

企業需求與前沿實驗室的分歧

報道分析指,Koa 展示了企業世界對人工智能的需求,正與前沿實驗室提供的方向分道揚鑣。前沿實驗室傾向讓企業把檔案、程式碼、提示及反饋直接上傳到其模型與代理,並為此花費數百萬美元。[1]

相對之下,Salesforce 向企業客戶提供的是:

  • 一個開源權重的替代方案,取代閉源前沿模型
  • 一個為特定工作任務訓練的模型,而非用於解決數學難題的通用模型
  • 一個沒有吸收任何真實客戶數據、因此無法洩漏他人數據的模型
  • 一個能降低人工智能開支的模型,因為完成同樣工作所需的 token 更少
  • 一個可視需要自動經人工智能「閘道」路由的模型
  • 一個符合客戶所有數據要求、並將安全機制內嵌於 Salesforce 的模型

Salesforce AI 執行副總裁 Jayesh Govindarajan 向 TechCrunch 表示:「我們建立過許多小型任務專用語言模型,它們是 Agentforce 產品組合的一部分。但推理一直是我們依賴前沿模型供應商的環節。直至現在為止。」在 Koa 之前,若代理需要推理一個長時間或多步驟任務,相關提示會經 Agentforce 的人工智能閘道,路由至 Claude 或 ChatGPT 等前沿模型。

為何以前做不到

Govindarajan 解釋,他們一直想自行訓練企業級前沿模型,但挑戰一直是缺少一個可以起步的預訓練底座:「在 Nemotron 出現之前,沒有一個主權美國預訓練模型是既可用、又屬最先進水平、而且有清晰數據來源的。我們完全不知道 Qwen 用甚麼訓練。」他指的是阿里巴巴廣受歡迎的中國開源權重模型。

以合成數據訓練

兩間公司並沒有使用 Salesforce 客戶的真實數據作後訓練。相反,他們製作合成數據來模擬客戶的行為模式。Govindarajan 描述:「我們實際上模擬了一個客戶服務環境,包含一個客戶服務專業人員的角色,包括致電客服中心的不滿客戶,以至嘗試達成交易的銷售專業人員。」

Koa 的目標是在 Salesforce 客戶希望代理完成的工作上表現更好,並以更少的 token 消耗節省成本,勝過把同樣任務送往 Claude 或 ChatGPT。Nvidia 企業生成式人工智能軟件副總裁 Kari Ann Briski 表示,Nemotron 具備「獨特的推理架構以達致 token 效率」,並形容這正是所需的「三合一」:主權人工智能、首個 token 時間、高效推理。

不過 Salesforce 並未放棄 Anthropic 或 OpenAI——該公司同時宣布了與 Anthropic 合作的 Claudeforce,讓企業以 Claude 作為人工智能介面,而數據仍保留在 Salesforce 的記錄系統內。[1][3]

參考資料

[1] TechCrunch — Salesforce and Nvidia’s new reasoning model is everything the AI labs should fear

[2] Salesforce — Koa

[3] Salesforce — Claudeforce

發佈留言

發佈留言必須填寫的電子郵件地址不會公開。 必填欄位標示為 *

*