大模型測評報告:大模型多模態能力仍待提高

新京報貝殼財經訊(記者韋英姿 韋博雅)7月10日,在2025貝殼財經年會主題論壇「建設『開源』之都:智ai未來,生態共澎湃」上,新京報ai研究院聯合中國經濟傳媒協會發佈第二期《中國ai大模型測評報告——大模型賦能傳媒行業使用與滿足研究》(下稱:報告)。

報告顯示,約八成受訪者高度認同大模型提升了媒體工作效率。其中,56.13%的受訪者從大模型中獲得了適量幫助,人數佔比最高;25.16%的受訪者認為大模型非常有幫助。這兩類受訪者比例與去年調查時相比,都上升了10個百分點左右。

報告將大模型參與媒體工作拆解為「搜索近期熱點幫助尋找選題」「確定選題後,提供、梳理相關資料」等10個功能。今年報告數據顯示,受訪者對這10個功能的滿意傾向都比較高,僅兩項功能(即:搜索近期熱點幫助尋找選題、處理非母語郵件)的滿意度未達到90%,但也逼近90%,說明現有大模型技術能夠參與媒體基礎生產環節,且所生成內容符合基本要求。

受訪者尤其對「確定選題後,提供、梳理相關資料」「構思報道文本大綱或思路」「起標題或自動生成較為簡單的消息文本」這三項功能滿意度高,佔比均超過 96%,這些環節對大模型的搜索、文本生成能力提出要求,這兩項較為基礎的能力基本能應用到媒體工作場景中。

而受訪者僅對「利用多模態能力製作多媒體素材(如視頻、圖片等)」這一功能的滿意度處於中等偏下水平,在滿足媒體工作需要方面,大模型的多模態能力仍待提高。

相比去年,受訪者對大模型前述10項功能的滿意傾向都有所提升,從媒體工作應用情況來看,模型能力在不斷進化。其中,對於大模型的稿件審校功能,即優化初步成形的報道文本(如潤色文字、修正錯別字等),受訪者滿意度為96.03%,與去年相比增加15.9個百分點。

編輯 王進雨

校對 盧茜