Meta今日推出Muse Spark 1.3,稱新版本處理長時間工作及寫程式的表現有所改善,現已陸續可經Muse Code及Meta Model API使用。原有推理模式今日已可使用,max reasoning模式則要待額外安全測試完成後才會推出。
Meta表示,新模型處理需時較長的工作時表現較好,可在一段長對話中兼顧多項任務,並從零散甚至互相矛盾的資料中整理出所需內容,發現原定做法有遺漏時會自行修正。它遇到含糊指示時會向用戶提問,受阻時亦會求助,涉及重大後果的行動則先取得確認。
在寫程式方面,Meta稱Muse Spark 1.3接受了更多長時間任務訓練,與Muse Spark 1.2相比,可減少不必要的來回對話,答案亦較精簡。Meta程式設計員的比較結果顯示,新版本使用工具的次數約少20%,token用量約少25%。
Meta公開的成績表顯示,Muse Spark 1.3在兩項MRCR長篇內容測試取得98.5及98.1分,上一代分別為66.3及55.5分。新模型在測試長時間寫程式能力的DeepSWE v1.1取得75.4分,高於上一代的55.0分,在SWEAtlas CodeBase QnA的分數亦由46.2升至59.4。
Muse Spark 1.3並非在每項測試都領先,例如它在DeepSearchQA取得89.4分,低於GPT 5.6 Sol的93.0分及Opus 5的90.4分。它在OSWorld 2.0取得66.9分,亦稍低於Opus 5的68.3分。
Meta亦計劃推出更大型模型和Muse Spark的開放模型(Open-weight),但未有公布時間表。

