馬斯克 xAI 推出 Grok-1.5 大語言模型!升級推理能力
導讀 3 月 29 日消息,馬斯克旗下人工智能公司xAI今天在官方博客中宣布,即將正式推出Grok-1.5 大語言模型。 據介紹,Grok-1.5
3 月 29 日消息,馬斯克旗下人工智能公司xAI今天在官方博客中宣布,即將正式推出Grok-1.5 大語言模型。
據介紹,Grok-1.5 具有改進的推理能力和 128k 的上下文長度,其中最顯著的改進之一是其在編碼和數學相關任務中的表現。Grok-1.5 將在未來幾天內在 平臺上向早期測試人員和現有的 Grok 用戶推出。
在官方測試中,Grok-1.5 在 MATH 基準上取得了 50.6% 的成績,在 GSM8K 基準上取得了 90% 的成績,這兩個數學基準涵蓋了廣泛的小學到高中競賽問題。此外,它在評估代碼生成和解決問題能力的 Humaneval 基準測試中得分為 74.1%。
據介紹,Grok-1.5 構建在基于 JAX、Rust 和 Kubernetes 的自定義分布式訓練框架之上。自定義訓練協調器可確保自動檢測到有問題的節點并將其從訓練作業中剔除。xAI還優化了檢查點、數據加載和訓練作業重新啟動,以最大限度減少發生故障時的停機事時間。
免責聲明:本文章由會員“劉龍林”發布如果文章侵權,請聯系我們處理,本站僅提供信息存儲空間服務如因作品內容、版權和其他問題請于本站聯系