跳至主要內容
CITY DESK
科技 設計評論

一串連字號裡的「Exp」:DeepSeek 的多模態,先被命名才被看見

從 DeepSeek-V4-Flash-Vision-Exp 的命名與測評影片畫面看起,觀察一個多模態模型如何被設計成可傳播的介面。

SHAO MEDIA 新聞中心 閱讀約 4 分鐘

先從一個小細節看起:DeepSeek-V4-Flash-Vision-Exp。這串名字裡有五個連字號、四個修飾詞,最後綴著三個字母「Exp」,實驗版的縮寫。8 月 20 日前後,這個模型以 API 平臺上架的形式悄悄出現,沒有發表會,沒有官方長文,最先被讀到的,是這一長串名字本身。

在 B 站搜尋「DeepSeek 多模態模型表現如何」,結果頁幾乎被同一件事佔滿:影片封面上的模型名稱,被各個創作者用不同字級、不同斷句方式重新排了一次。有人把「Vision」放大標紅,有人把「Exp」單獨圈出來,有人索性只寫「DeepSeek 終於有眼睛了」。同一個模型,在搜尋結果頁裡長出了十幾張不同的臉。

這個現象本身,比模型的能力更值得看。

命名是一套排版系統

「V4-Flash-Vision-Exp」這個命名結構,其實是一份被壓縮的規格表。V4 標世代,Flash 標輕量定位,Vision 標能力,Exp 標成熟度。四個詞各佔一格,用連字號隔開,讀起來像零件清單。這種命名方式和蘋果那種「M4 Pro」式的極簡截然不同,它選擇把資訊全部攤在名字裡,讓開發者看一眼就知道自己在呼叫什麼。

但攤開的代價是轉譯。名字太長,傳播時必然被截斷,而每個截斷點都是一次編輯決定。測評影片的封面就是截斷的現場:「頂級體驗」「突然上線」「真的能看圖了」,這些標題替模型補上了官方沒給的表情。DeepSeek 給出的是一份零件清單,創作者們把它翻譯成了一連串情緒。

這與我們先前觀察過的玄戒晶片以「回片」兩個字現身有幾分相似:一個技術產品進入公眾視野的第一張臉,往往由最短的那組詞決定,而不是由規格書決定。

「有眼睛了」這個比喻的設計

掃過那些影片標題,會發現一個高頻句式:「DeepSeek 終於有眼睛了」「給純文字模型裝上眼睛」。這個比喻幾乎是自發的集體創作,而且早在模型上線之前,就已經有創作者在用第三方視覺模型幫 DeepSeek 的文字模型「外掛眼睛」,甚至繞過其他平臺的檢查。

「眼睛」是個值得停一下的詞。技術上,視覺模型做的事是把影像編碼成文字模型可讀的序列,但沒有人用「編碼」來講這件事。創作者選了身體,選了一個具備殘缺與補全敘事的器官。「終於」二字則暗示這個模型此前是殘缺的,需要被補上什麼。一個功能更新,就這樣被講成了一個成長故事。

從傳播設計的角度看,這套敘事效率極高,但也預先框定了評價標準:既然是「裝上眼睛」,測評就自然集中在看圖對不對、看得準不準。於是搜尋結果裡同時出現了「一句話生成遊戲效果不錯」和「四道題全錯,拉完了」兩種結論,同一個模型,在發布不到二十四小時內,被做成了兩種相反的畫面。

測評作為一種競速格式

那些影片的時長透露了另一件事:大量測評集中在兩到六分鐘之間,發布時間集中在模型上線後的十幾個小時內。有人跑了 1.5 億 token 的實測,有人只測了四道題。標題裡的數字成了可信度的替代品,「1 億 Token 實測」比測了什麼更早被讀到。

這種格式不是 DeepSeek 造成的,但 DeepSeek 的發布方式放大了它。沒有發表會、沒有完整技術報告同步公開,資訊真空就由最快出手的人來填。第一波畫面決定第一波印象,後續更嚴謹的測評要對抗的是已經被排好版的結論。這套機制我們在名人分析影片的封面設計裡已經看過一次:封面先於內容,結論先於論證。

回到模型本身。一個掛著「Exp」後綴的實驗版本,本來就承認自己未完成,那些「拉完了」的判詞和「霸榜」的封號,對它來說都太快了。命名裡那三個字母,是整個事件裡最誠實的設計:它把「實驗中」寫進了名字,只是搜尋結果頁的排版,幾乎沒有封面願意把「Exp」放大給人看。

#deepseek+模型介面#多模態模型+視覺傳播#模型命名+排版設計