东升国际官网

商湯「日日新6.5」全新升級,讓AI实现從“工具”到“人”的躍遷

5 分鐘閱读
东升国际官网-相信品牌力量

多模態資訊感知與處理的能力,是AGI的主题要求,也是從語言模型迈向AGI的必由之路 。

從多模態感知、推理,再到交互,多模態智能的演進將驅動AI下一阶段的發展 。

2025年7月27日,由全國工商聯人为智能委員會倾力主辦,商湯科技辰╧的【大爱無疆·模塑未來】WAIC 2025大模型论坛上,商湯科技發布全新「日日新SenseNova V6.5」(简稱“日日新V6.5”)大模型體系,多模態基座大模型迎來突破性升級,帶來AI從“生產力工具”到“生產力”的逾越 。商湯旗下主题產品商湯幼浣熊也实现智能體升級 。

1.jpg

1950年,圖靈通過“仿照游戏”將AI定義為」鷲人能力”,但實際的AI一向未能脱节“工具”的领域,一度陷入發展低谷 。而在大模型時代,AI 凭借多模態融合能力的突破,逐步觸達 AGI 邊界,真正開始向」鷲人”標準靠近 。

全國工商聯人为智能委員會主席團首任轮值主席、商湯科技董事長兼首席执行官徐立暗示:“商湯科技始終探寻人为智能本質,以技術創新激發最大智能,推動AI实现從“工具”到‘人’的躍遷,成為真正的生產力 。”

2.png

日日新V6.5焕新:突破性升級觸碰“理解的深度”

商湯「日日新V6.5」多模態基座大模型帶來三大突破性升級:

1.?強推理:圖文交错多模態思維链,推理机能比肩 Gemini 2.5 Pro、Claude 4-Sonnet ;

2.?高效能:多模態架構優化,性價比提升3倍以上 ;

3.?智能體:數據分析大幅領先,支持端到端的場景落地,實現價值閉環 。

通過多模態思維链數據進阶圖文交错思維链數據合成,商湯「日日新V6.5」多模態推理與交互机能實現了大幅提升:

3.png

【主题指標】文本推理能力和多模態推理大幅提升,超过Gemini 2.5 Pro、Claude 4-Sonnet ;多模態交互能力超过Gemini 2.5 Flash和GPT-4o,各方面机能凸起

商湯「日日新V6.5」率先突破圖文交错思維链技術,在大模型中引入形象思維,成為國內首個實現圖文交错思維的商業級大模型 。

在人類的思虑中,形象思維和逻輯思維一致沉要,兩者有机結合能力形玉成面的思維能力 。所谓“一圖勝千言”,一幅圖往往比大段文字更能引發有效思虑 。当前,主流的多模態模型固然已經實現了在输入端融合多種模態,但思虑推理過程依然重要依赖語言推理,圖形和空間推理仍存在短板 。

多模態思維链構造的關鍵在於資訊的圖形化表達,相比纯文本思維链更具挑战,不僅要呈現文字思虑過程,还需天生作為思虑節點的圖像,難以通過纯人为方式大規模實現 。商湯研發團隊先基於對思維過程的理解構造種子數據,經监督微調(SFT)训练讓模型初步具備圖文交错思虑能力,再通過多轮強化學習顯著提升多模態推理能力 。

?4.png

同時,商湯还改進了多模態模型的融合架構,促進跨模態早期融合 。新的架構选取了顯著變輕的視覺編碼器,以及深而窄的主干模型,使得視覺表征在前馈計算早期就與語言進行對齐和融合,從而使感知更高效,模態融合更深 。

得益於模型架構的改進,商湯「日日新V6.5」在實現成本優化的同時,预训练吞吐量提升了20%以上,強化學習效能提升了40%,推理吞吐量提升了35%以上,获得机能和成本的美满平衡 。相較「日日新V6.0」,「日日新V6.5」將性價比提升了3倍 。

5.png

AI是生產力:商湯幼浣熊,辦公最強智能體登場

大語言模型已成為当下不少人的工作辅助工具,但僅靠大語言模型,不及以讓AI实现從“工具”向“人”的躍升 。

人類的日常任務活動,天然涉及對文本、圖像、視頻、網頁等多模態資訊的處理 。從生產力工具到生產力,關鍵就在於多模態資訊的输入、處理與输出能力 。

基於「日日新V6.5」強大的多模態數據分析能力,商湯幼浣熊全面升級:可能勝任多模態复杂输入,進行多模態融合深刻分析,给出多模態結果输出,實現專業的可視化呈現,打造“辦公場景的AI生產力”,讓AI實現從「生產力工具」到「生產力」的逾越 。?

6.jpg

同時,商湯幼浣熊始終维持世界領先的复杂數據分析能力 。在客戶場景的综合測試中,幼浣熊達到在數據分析和智能體領域的國際標杆 Claude 4 Opus 的水平,大幅領先OpenAI o3等模型 。其中,在時序計算、數據匹配、斅讽計算和异常检測等任務中,準确率均可靠近?100% 。

7.png

現實辦公場景中,數據输入大局極為复杂 。在數據分析場景中,截圖、文档和PDF等各類樣式的文档屡見不鲜,而其中結構化資訊及表格僅占约70% 。即就是看似基礎的 Excel 表格,也常蕴含归并單元格、缺失值、嵌套子表格及內嵌圖表等复杂元素,大幅提升處理難度 。

商湯幼浣熊可能以多模態思維實現全局分析,通過思維链構造進行多步思虑與反思,最終输出結構化的結果 。

事實上一個表格看著简單,背後的逻輯因果却极度复杂,如今商湯幼浣熊能够讓复杂表格简單化 。

用戶上傳蕴含归并單元格、缺失值、子表格、內嵌圖表及表部圖片的复杂?Excel?表格 。商湯幼浣熊可能精準解析表格內容,成立子表格間的逻輯關聯,最終天生齐全的分析報告 。

8.png

另一個复杂输入的用戶案例,幼商戶在抖音等視頻平台刷到有效的表格內容,截圖後上傳 。商湯幼浣熊能够通過圖片資訊分化任務并去除滋扰,提取表格資訊,一鍵導出可編輯的Excel?表格供用戶填寫,输入、分析、输出全程都有多模態能力支持顺畅進行 。

9 (2).png

傳統AI工具多表演辅助角色,主题工作仍依赖用戶主導实现 ;而商湯幼浣熊實現了交互範式的升級——由AI主動承担主题任務,并通過精準提問和用戶确認關鍵資訊,交互逻輯如同同事協作 。

由AI主動承担主题任務,并通過精準提問和用戶确認關鍵資訊,交互逻輯如同同事協作 。

商湯幼浣熊如今推出的任務規划职能,其新鲜的交互模式更利於用戶理解,以前段時間大火的“苏超”為例 。

用戶上傳圖像表格,要求分析“苏超”TOP球員 。商湯幼浣熊會自動抓取網上資訊,并依附專家知識天生任務清單(如确定 “TOP5” 標準,分析青训成績等)進行系統性分析,最終天生高質量分析文档,还可導出為 Excel、PPT、HTML 等可編輯体式 。整體流程如下↓↓↓

10 (2).png

我們來看下分化步骤:当接管任務後,幼浣熊會主動梳理任務细節,就關鍵節點向用戶提出明确問題(如 “是否必要按以下 1、2、3 點推進?”),以确保任務方向準确,真正實現 “AI 主導干活、用戶决策把關” 的高效模式↓↓↓

11 (2).png

我們來看下分化步骤:当接管任務後,幼浣熊會主動梳理任務细節,就關鍵節點向用戶提出明确問題(如 “是否必要按以下 1、2、3 點推進?”),以确保任務方向準确,真正實現 “AI 主導干活、用戶决策把關” 的高效模式↓↓↓

12.png

專業數據+工具調用,實現高質量內容過程↓↓↓

13.png

最終天生高質量分析文档,还可導出為?Excel、PPT、HTML?等可編輯体式↓↓↓

14.png

凭借強大的复杂任務處理能力,商湯幼浣熊加快向行業渗入,这次推出了面向兩大具體場景的特造版本——教育版和金融版 。

商湯幼浣熊教育版可智能分析學生學習表現、课程成效、學習行為模式分析,目前已覆蓋500+院校、10餘種教育場景、25萬+教師和學生,幫助學生提升學習效能15~30%,并已在多所學校協助教研團隊,降低學業焦虑發生率 40%,讲堂参與度提高 2.1倍,資源错配率降低30%,生理健全过问及時性提升了50% 。

商湯幼浣熊金融版可為金融業提供知識副手、智能問數、多模態智能理赔產品與解决规划,構建金融領域的“人机協同”智能决策新範式 。

截至目前,“商湯幼浣熊家族”產品矩陣廣泛服務多行業企業,用戶數量實現1000萬+ 。

15.png

以多模態技術激活AI生產力,商湯日日新大模型將持續進化,與行業共同奔赴下一阶段AI進化的新征程,加快通往AGI時代 。

【网站地图】