AI研究筆記
首頁 / 新聞重點 / EP38
AI 新聞重點 · 2026-09-05 · EP38

Meta Muse Spark 1.3實際效能:官方分數可靠嗎?

快速回答

Meta於9月2日發布的Muse Spark 1.3,宣稱在代理式任務上效率提升,但官方秀出的最高62分Intelligence Index,是來自目前仍進行安全測試、一般開發者無法使用的max版本。獨立評測機構指出,目前可用的xhigh版本實際得分為61分,這顯示一般使用者無法立即獲得最佳效能。因此,在評估或導入此模型前,建議仔細核實可取得版本的實際數據。

發生了什麼?

  • Meta在9月2日發布Muse Spark 1.3,宣稱與前一版Muse Spark 1.2相比,代理式任務平均減少20%工具呼叫與25%token用量。
  • Meta官方表示,Muse Spark 1.3 max版本在Intelligence Index評測中獲得62分,逼近市場領先模型。
  • 獨立評測機構Artificial Analysis指出,目前一般開發者實際可用的Muse Spark 1.3 xhigh版本,在Intelligence Index測得61分。

對你有什麼影響?

對於依賴AI編程工具的上班族或付費訂閱者來說,如果只根據Meta宣傳的最高分數來決定是否更換工具,可能會導致預期與實際效能不符。這意味著使用者應更謹慎評估可得版本與其表現,避免因資訊落差而做出錯誤的選擇。

你可以怎麼做?

  • 在考慮使用Meta Muse Spark 1.3或其他AI工具前,務必確認宣傳的效能數據是否來自目前可用的版本。
  • 建議參考獨立評測機構如Artificial Analysis對Meta Muse Spark 1.3 xhigh版本測得的61分,作為實際評估基準。
  • 暫不急於升級或更換AI編程工具,可等待Meta Muse Spark 1.3 max版本正式開放後再重新評估。
  • 查閱AI產品發布新聞時,應留意不同版本之間的效能差異及是否有第三方查證結果。

節目裡的說法,查證結果是?

每個說法都追到原始來源,判定標準見判定方法。

常見問題

Meta Muse Spark 1.3何時發布?

Meta Muse Spark 1.3於9月2日發布,透過Muse Code及Meta Model API提供支援,上下文容量達100萬token。

Muse Spark 1.3宣稱的效率提升具體為何?

Meta官方比較指出,Muse Spark 1.3執行同樣的代理式任務時,與前一版Muse Spark 1.2相比,平均減少約20%的工具呼叫和25%的token用量。

一般使用者能取得的Meta Muse Spark 1.3版本在Intelligence Index得分多少?

根據獨立評測機構Artificial Analysis的測試,目前一般開發者實際能用到的Muse Spark 1.3 xhigh版本,在Intelligence Index測得61分。

Meta聲稱Muse Spark 1.3有哪些行為改善?

Meta官方部落格提到,新模型現在更常主動提出釐清問題、卡住時會主動告知使用者、遇到可能無法復原的動作會先確認,且較不會謊報未完成的工作,但這些改善目前無第三方量化數據佐證。

看節目:EP38

這篇由 AI 依節目腳本與查證紀錄整理,每個數字都核對過原稿。資料日期:2026-09-05。關於我們怎麼做

其他新聞重點