雷遞網 樂天 9月30日
國產大模型與國產芯片協同進入新階段。
智譜今日正式發佈並開源新一代大模型 GLM-4.6,稱在 Agentic Coding 等核心能力上實現大幅躍升。這是繼 DeepSeek-V3.2-Exp 與 Claude Sonnet 4.5 之後,國慶節前業界的又一技術發佈。
智譜稱,在公開基準測試和真實編程任務中,GLM-4.6 的代碼生成能力已全面對齊 Claude Sonnet 4,成為目前國內最強的 Coding 模型。同時,模型在長上下文處理、推理能力、信息檢索、文本生成及智能體應用等方面均實現全面升級,整體性能超越 DeepSeek-V3.2-Exp。
智譜官方宣布,GLM-4.6 已在寒武紀領先的國產 AI 芯片上實現 FP8+Int4 混合量化推理部署,這也是首次在國產芯片上投產的 FP8+Int4 模型-芯片一體化解決方案。在保持模型精度不變的前提下,該方案大幅降低了推理成本,為國產芯片本地化運行大模型提供了可行路徑和示範意義。
與此同時,摩爾線程基於 vLLM 推理框架完成對 GLM-4.6 的適配,新一代GPU可在原生FP8 精度 下穩定運行模型,驗證MUSA 架構 及全功能GPU在生態兼容性和快速適配能力方面的優勢。
智譜指出,寒武紀與摩爾線程完成對 GLM-4.6 的適配,標誌着國產GPU已具備與前沿大模型協同迭代的能力,加速構建自主可控的 AI 技術生態。
雷遞由媒體人雷建平創辦,若轉載請寫明來源。