小模型“反卷”大模型?適用才是真王道!
隨著“千模大戰(zhàn)”接近尾聲,由大模型掀起的算力競賽也逐漸進入“下半場”,由“建算力”過渡到“用算力”上。
15小時前
來源:通信世界全媒體 包建羽??

通信世界網(wǎng)消息(CWW)隨著“千模大戰(zhàn)”接近尾聲,由大模型掀起的算力競賽也逐漸進入“下半場”,由“建算力”過渡到“用算力”上。不同于大模型的參數(shù)量大、成本高、部署復雜,以“小而美”著稱的小模型為行業(yè)提供了新選擇。

近日,大模型頭部廠商微軟和英偉達紛紛押注小模型,相繼發(fā)布了最新的小型語言模型——Phi-3.5-mini-instruct和Mistral-NeMo-Minitron8B。這兩款模型的主要賣點是實現(xiàn)了計算資源使用和功能表現(xiàn)之間良好的平衡。更有消息稱,在某些方面,它們的性能甚至可以媲美大模型。

其實,不僅國外小模型發(fā)展提速,國內(nèi)眾多廠商也有小模型問世。比如阿里巴巴發(fā)布的Qwen1.5系列,其最小參數(shù)可達到0.5B;面壁智能發(fā)布的MiniCPM系列模型號稱最強端側模型。

顧名思義,小模型即在參數(shù)量、計算資源需求、模型規(guī)模等方面相對較小的人工智能模型。從已有產(chǎn)品不難發(fā)現(xiàn),國內(nèi)外廠商紛紛入局小模型,既是看到了小模型相較于大模型的優(yōu)勢所在,也是積極助推人工智能模型落地的實踐。

在成本與資源利用上,小模型參數(shù)量少,對計算資源的需求較低,訓練和推理成本也更低,這對于資源有限或預算緊張的企業(yè)來說極具吸引力。而且小模型體積小,部署相對簡單,對硬件和存儲的要求不是很高,也無需復雜的分布式計算架構,能夠有效降低部署和維護的難度與成本。

在性能與效率平衡上,小模型的價值更多體現(xiàn)在滿足特定場景需求上,能夠更快地給出結果,實現(xiàn)實時響應。此外,其定制性也更強,企業(yè)可以基于自身業(yè)務數(shù)據(jù)對小模型進行精調優(yōu)化,使其更貼合特定任務和場景。

在應用場景拓展上,一方面,小模型更適應邊緣計算需求,可以本地部署到個人電腦、手機等終端設備上并進行數(shù)據(jù)處理和分析,降低數(shù)據(jù)傳輸?shù)皆贫说某杀竞碗[私風險。另一方面,小模型具備靈活性和低成本等特點,更利于新業(yè)務探索,降低試錯成本,幫助企業(yè)在新領域快速迭代和創(chuàng)新。

小模型的優(yōu)勢有目共睹,行業(yè)逐漸重視其應用與開發(fā),也在很大程度上給了其“反卷”大模型的勇氣。但不可否認的是,小模型參數(shù)量較小以及訓練數(shù)據(jù)有限,在帶來輕便、易部署等一系列優(yōu)點的同時,也暴露了可能存在理解深度與廣度不足、復雜任務處理能力有限、容易產(chǎn)生“偏見”等問題。

既然大模型與小模型各有利弊,行業(yè)應用也應各有所長,筆者認為不能將大模型與小模型視為簡單的競爭關系,“適用為王”的理念更符合兩者的價值所在?!胺淳怼贝竽P停w現(xiàn)了小模型多樣化的行業(yè)需求,小模型自身的局限性也注定了其只能作為大模型的補充,以更好地推動各行業(yè)智能化進程。

為此,筆者認為未來大模型與小模型更趨向于協(xié)同共生。

一是實現(xiàn)協(xié)同合作。大模型作為基礎支撐,將繼續(xù)在通用智能、復雜任務處理、大規(guī)模數(shù)據(jù)理解等方面發(fā)揮重要作用,小模型則在大模型的基礎上,針對不同的行業(yè)、領域、場景和用戶需求進行個性化與精細化處理,支撐更精準、高效的解決方案。

二是促進技術融合。大模型和小模型在訓練和優(yōu)化過程中所采用的方法可以相互借鑒和融合。將大模型訓練中的大規(guī)模數(shù)據(jù)處理技術、算法優(yōu)化技術應用到小模型的訓練中,以提高小模型的性能;同時,小模型的高效訓練和優(yōu)化策略也可為大模型訓練提供參考,以降低大模型訓練成本和資源消耗。

三是共建生態(tài)體系。正如大模型最終還是要滿足用戶需求、走入行業(yè)應用,可以預見的是,未來包括大模型、小模型在內(nèi)的不同規(guī)模和類型的模型將有賴于靈活組合和調度,根據(jù)開發(fā)者和用戶的具體需求,構建最適合的應用解決方案。

*本文刊載于《通信世界》總第951期 

2024年9月10日 第17期

最新文章
1
“向新”發(fā)展賦予激光顯示行業(yè)無限活力,150吋海信激光電視即將量產(chǎn)
2
大宅觀影的“巨幕時代”來臨!120吋海信激光電視星光S1 Max正式發(fā)布
3
全域協(xié)同、全局增長,2024快手雙11商家大會將于9月19日召開
4
快手科技2024年投資者日:以用戶為導向,借助AI賦能實現(xiàn)高質量增長
5
快手可靈AI導演合作計劃開“拍” AIGC應用師首次成規(guī)模入駐電影劇組 
6
小模型“反卷”大模型?適用才是真王道!
7
以10%面積代價實現(xiàn)汽車功能安全,Imagination發(fā)布新款GPU IP
8
產(chǎn)能不足、售價高昂、壽命問題,OLED電視的驚艷正在落幕
9
8月線下電視市場銷售額規(guī)模同比下降2.5%,75英寸占比上漲
10
8月中國家電出口量已公布,情況如何?
11
清潔電器“出?!?/a>
12
對標華為!曝榮耀將量產(chǎn)三折疊屏:技術儲備不是問題
13
iPhone 16不香了!媒體:蘋果手機行情已大不如從前
14
洗衣機小幅反彈,為什么這些品牌率先在“洗凈比”上卷起來?
15
2024上半年,誰是電動兩輪車增長之王?
16
觀察:美的海外家電市場份額近5%,這個水平已經(jīng)不低了
17
天璣夜視儀!vivo X200樣張出爐:10倍變焦下夜景清晰可見
18
競速低空智聯(lián)網(wǎng)賽道,三大運營商策略各不同
19
可實現(xiàn)15年車電同壽,寧德時代發(fā)布天行客車版動力電池
20
小家電市場洞察:單品細分還是功能集成?從品類關系看電熱鍋發(fā)展趨勢
關于我們

微信掃一掃,加關注

商務合作
  • QQ:61149512