亚洲第一天堂无码专区_一区二区欧美久久_精品剧情v国产在线观看在线_久久久精品综合

首頁 > 綜合 > 正文

把 4K 生圖門檻打下來!商湯開源 SenseNova U1.5 Lite 當前關注

2026-08-21 14:23:05來源:硅星人  

作者|樊雅婷微信|FFF111f__

以前的 AI 生圖,連六根手指、文字亂碼、透視錯亂這類基本關都過不了,更不用說商用了。


(相關資料圖)

如今模型能力大幅躍升,用戶的要求也隨之水漲船高。文字渲染、復雜版式、多圖參考、局部編輯、原生4K——這些過去需要多個工具協作才能完成的任務,現在正被壓縮進同一套模型之中。

但「能力出現」和「能力可用」之間,依然橫亙著不小的距離。一張商業海報可能同時包含人物、產品、商標文字、指定數量、前后空間關系、品牌色號以及若干禁改項,任何一個要素被模型遺漏,整張圖就要推倒重來。而每一次推倒重來,都意味著新的token消耗。

甲方的無數條修改意見,就這樣在反復生成中被放大為高昂的算力成本。

正因如此,當生圖模型真正進入創作流程之后,用戶的訴求已經非常明確:更快的時間,更好的交付,更低的成本。

8月3日,商湯開源 SenseNova U1.5 Lite Preview,初步展示了原生統一多模態模型在圖像生成與編輯上的能力邊界。今天,正式版 SenseNova U1.5 Lite繼續向前邁出一步,目標是讓這些能力真正融入視覺創作與交付流程。

這一次升級,商湯沒有繼續在模型規模上做文章。

由 SenseNova U1.5 Lite生成的圖書封面

通過精調訓練數據、重調后訓練流程、優化任務設計,最終打磨出的 SenseNova U1.5 Lite,是一款輕量級、原生統一多模態開源模型。它的目標也非常具體,就是解決用戶最真實的訴求,做到更穩、更準、更好。

1

先把分數擺上來

開源生圖從來不缺嘗試者。難的是在保持模型開放、輕量和可部署的同時,把畫質、文字、布局與編輯放進同一個模型,而且每一項都不能成為明顯短板。

SenseNova U1.5 Lite 與主流開源、閉源圖片模型橫向Benchmark

在完整橫向評測中,SenseNova U1.5 Lite 在所有維度都位于開源生圖模型的領先位置,并且展現了比較均衡的系統能力,在復雜指令、視覺質量和創意生成等維度都表現出較強競爭力。

正式版的提升沒有集中在某一項孤立技能上。生成質量、指令執行和編輯能力都在進步。

U1.5 Lite 還能在確保更高性能同時,實現更少的生成延遲。下圖顯示了測評中,SenseNova U1.5 Lite在 OneIG(EN、ZH)、LongText(EN、ZH)、BizGenEval(Easy、Hard)、CVTG、IGenBench 與 Qwen-Image-Bench 上的生成延遲與平均性能對比。

對于需要批量生成海報、電商圖和營銷素材的團隊,這樣帶來的意義就很直接。同樣的時間和預算,可以支持更多次嘗試,也能把生成能力放進更高頻的工作流。

不過,Benchmark 終究是一張坐標圖。

把這些分數塞進一份真實的設計需求,事情才開始變得有意思。

1

一些實測

一條長Prompt,能不能變成一張完整海報

以前的 AI 生圖,提示詞太長,模型執行指令時候就會變成金魚,出現遺忘現象。

所以,第一個測試,是一條長得有些不講道理的Prompt。

可以看到效果不錯,從真的理解到真的執行。

4K不只是把畫布放大

高分辨率生成最容易被誤解成像素數量的簡單增加。

真正困難的,是畫布變大之后,模型還能不能穩住整張圖的全局結構。標題、正文、圖標和人物之間的關系不能散,局部的文字邊緣、材質紋理和光影過渡也不能糊成一片。

U1.5 Lite 正式版原生支持 2K 和 4K 生成。在廣告級的畫幅下,細節經不經得起推敲,一張圖說了不算,放大到 100% 才算。

所以我決定拿時尚封面雜志來試。

可以看見成片保留要求的同時保留了紙張褶皺、皮膚紋理的真實感。

改一個地方,其他地方不動

第三組測試從一張已經完成的海報開始。

我給的提示詞是

再來一個更細節的。我給的 prompt 是

可以看到,這兩次海報的局部編輯,除了我的要求,其他地方什么都沒改變。

算是高質量的修改交付。

這也對應U1.5 Lite正式版后訓練中的一個重要目標:Editing Preservation。

好的編輯需要同時完成兩個動作。一邊準確執行修改,一邊保護原圖。該動的地方要動,不該動的地方盡量別動。

當這種保持能力逐漸穩定,圖片模型才能從一次性生成器變成可反復溝通的創作工具。用戶不再需要每次都推倒重來,可以在同一張作品上繼續修改。

下面我們嘗試下保持參考圖的風格和布局,進行編輯:

參考圖

成圖

接下來,我計劃再給模型多看幾張圖,難度還會繼續增加。

多張參考圖融合出成片

多圖參考真正難的地方,是模型能不能分清每張圖的職責。

可能它需要保留第一張圖里的人物身份,借用第二張圖的色彩和材質,再沿用第三張圖的版式關系。參考圖之間不能互相污染,風格遷移也不能吞掉主體。

U1.5 Lite支持單圖、多圖參考,以及 Bounding Box、Visual Marker 等控制方式。用戶可以指定對象和區域,完成元素插入、替換、局部精修和參考風格遷移。

我把我喜歡的動漫角色都放進一張海報里。

上傳這五張圖片之后,我給的 prompt 是:

可以看到最后的成圖信息清晰,符合要求。時間 / 地點 / 菜單三個部分以小卡片的形式獨立列出,還設計了 So yummy、Come & Enjoy 等符合人物形象的小對白,用氣泡呈現增加了活潑感。

模仿、借鑒,再創作

當你的靈感來自于他人的作品,這個時候就可以讓模型參考之后進行再創作。就像我覺得下面這張圖很好看,我想自己模仿這張圖設計一張其他主題的海報。所以我就

最后的效果呈現,實力無需多言。

圖一圖二圖三成圖

當模型能夠區分參考誰的主體、借用誰的風格、沿用誰的布局,多圖參考才真正離開玩法展示,進入創作流程。

1

一個模型,怎樣同時做好幾件事

SenseNova U1.5 Lite 延續了 NEO-unify 的原生統一多模態路線。

在同一個模型架構之下,視覺理解、圖像生成與圖像編輯被共同訓練。模型首先理解原始圖像和用戶指令,識別其中的主體、文字與空間關系,再完成像素級的最終生成。整個過程中,用戶無需在理解模型、生成模型和編輯工具之間反復切換。

統一帶來的價值,還進一步體現在能力的遷移上。

模型在視覺理解任務中習得了結構、位置、文字排布與信息層級,這些認知成果可以順滑地遷移到生成和編輯任務中。面對一條較長的自然語言指令,模型需要解析的已經不是孤立的關鍵詞,而是這些要求之間的內在關系:誰在左邊,誰不能被遮擋,哪段文字屬于哪個區域,修改時又有哪些內容必須被保留。這正是 U1.5 Lite 能夠處理層級化視覺需求,卻不需要依賴固定 JSON 模板的原因之一。

但統一訓練解決了能力共享的問題之后,新的矛盾也隨之浮現。

OCR 關心文字是否準確可讀,美學關心構圖、色彩和整體質感,編輯則還要兼顧主體身份與結構保持。如果簡單地把所有訓練目標混在一起,往往會出現一項能力變強、另一項反而被削弱的窘境。

正式版的應對策略,是讓各項專項能力先分別變強。

商湯訓練了 OCR、美學和編輯等多個 Expert:OCR Expert 強化中英文文字識別與排版質量,美學 Expert 改善構圖、色彩、材質、光影和真實感,編輯 Expert 則負責確保主體身份、空間結構以及非編輯區域的一致保持。隨后,通過 MOPD 將這些 Expert 的能力重新蒸餾回 U1.5 Lite 中。

最終部署的,仍然只有一個模型——沒有額外的 Router,用戶也無需關心該調用哪一個 Expert,生成和編輯繼續通過統一接口完成。

在此基礎上,正式版又引入了更精細的任務導向 RL。它優化的三個目標,都能與前面的測試維度一一對應:Instruction Compliance 關注復雜指令是否被執行完整,Visual Preference 關注構圖、真實感和整體完成度,Editing Preservation 關注指定區域是否改對、其他區域能否保持不變。

最后交付的,仍然是 U1.5 Lite,一個輕量級、易部署的統一模型。

1

多模態是一件慢回報的事

把鏡頭拉遠,多模態模型正在進入一個更現實的階段。

能力仍在增長,行業卻已經開始算賬。投入多少,成本幾何,回報又在哪。參數規模能快速制造話題,但真實視覺任務里的穩定性,靠的是數據、評測和一次次后訓練,慢慢磨出來。

長指令會不會漏、文字能不能寫對、4K下結構能否保持、局部編輯會不會破壞整張圖,這些看似微小的問題恰恰決定了模型能不能真正進入海報、信息圖、電商素材和品牌視覺的日常生產。

商湯選擇繼續沿著原生統一的路線投入。

從 U1 到 U1.5 Preview,再到正式版,SenseNova 沒有簡單疊加一份更長的能力清單。它在嘗試回答一個更實際的問題:一個輕量級、統一、開源的多模態模型,能不能更完整地承擔真實視覺創作任務?

U1.5 Lite 給出的答案是讓能力更強,也讓能力更穩。

把視野再拉開一點,視覺創作只是多模態進入現實世界的一站。一個模型需要先理解畫面中的對象、文字和空間關系,才能進一步生成、編輯,最終與更復雜的真實環境發生連接。

這條路不會很快。

但對今天的用戶來說,判斷它有沒有向前走并不難。只需要把它放在最真實的需求里,一試便知。

會生成只是起點,穩定地完成任務,才是開源視覺模型真正進入生產的開始。

GitHub:

https://github.com/OpenSenseNova/SenseNova-U1

Hugging Face:

https://huggingface.co/collections/sensenova/sensenova-u15

SenseNova Studio在線體驗:

https://unify.light-ai.top/

點個“愛心”,再走 吧

標簽: 商湯 生成器 全模態 lite sensenova

相關閱讀

精彩推薦

相關詞

推薦閱讀

主站蜘蛛池模板: 亚洲AV无码成人精品一区| 久久亚洲高清| 国产精品免费久久久久影院| 国产精品日韩在线一区| 91久久精品在线| 欧美精品在线观看91| 亚洲熟妇无码另类久久久| 国产精品美女av| 国产精品亚洲аv天堂网| 日本一区二区三区视频免费看| 亚洲中文字幕无码中文字| 国产成人精品午夜| 久久视频精品在线| 欧美精品久久久| 91精品国产综合久久久久久久久| 亚洲国产一区二区三区在线播| 日韩日本欧美亚洲| av日韩一区二区三区| 久久精品国产成人精品| 国产在线精品日韩| 亚洲v日韩v欧美v综合| 高清不卡日本v二区在线| 国产美女扒开尿口久久久| 久久久神马电影| 久久手机精品视频| 欧美 日韩 国产 高清| 欧美一级中文字幕| 欧美亚洲国产成人精品| 欧美在线视频a| 久久婷婷国产精品| 欧美国产综合在线V| 欧美视频在线播放一区| 婷婷视频在线播放| 亚洲色欲综合一区二区三区| 99久久精品免费看国产四区| 久久久久久成人| 国产精品自在线| 伊人久久在线观看| 欧美大香线蕉线伊人久久| 国产一区深夜福利| 日韩三级在线播放|