日韩一区二区高清_精品捆绑美女sm三区_欧美日韩国产在线看_成人毛片在线观看

您的位置:首頁(yè) >要聞 > 正文

焦點(diǎn)關(guān)注:谷歌推出DiffusionGemma文本擴(kuò)散模型:本地AI推理速度提升4倍

來(lái)源:搜狐網(wǎng)2026-06-12 06:07:15


(相關(guān)資料圖)

IT之家 6 月 11 日消息,谷歌今天(6 月 11 日)發(fā)布公告,宣布推出 DiffusionGemma,是基于文本擴(kuò)散機(jī)制的開(kāi)放 AI 模型,相比較自回歸模型在本地推理速度上提升了 4 倍。

IT之家注:自回歸模型(Autoregressive Model)是當(dāng)前主流的大語(yǔ)言模型架構(gòu)(如 GPT、Gemini),按照從左到右的順序逐個(gè)生成 Tokens。該架構(gòu)在云端批處理場(chǎng)景下效率較高,但在本地推理時(shí)受限于內(nèi)存帶寬,存在計(jì)算資源浪費(fèi)問(wèn)題。

而擴(kuò)散模型(Diffusion Model)通過(guò)從噪聲中逐步去噪的方式生成輸出。與自回歸模型逐個(gè)生成 token 不同,擴(kuò)散模型并行處理所有 token,逐步優(yōu)化整體輸出質(zhì)量,在本地低帶寬計(jì)算環(huán)境下具有顯著的推理速度優(yōu)勢(shì)。

開(kāi)源方面,該模型能力與其他 Gemma 4 模型相當(dāng),但推理效率顯著更高。該模型采用 Apache 2.0 許可證開(kāi)源,用戶可從 Hugging Face 下載模型權(quán)重。

質(zhì)量方面,模型還支持迭代優(yōu)化,能在生成過(guò)程中主動(dòng)糾正錯(cuò)誤,輸出更加穩(wěn)定一致。采樣速度達(dá)到 1479 tokens / 秒,開(kāi)銷僅 0.84 秒,生成效率顯著提升。

性能方面,代碼生成上,LiveCodeBench 達(dá) 30.9%,BigCodeBench 達(dá) 45.4%,HumanEval 達(dá) 89.6%,與 Gemini 2.0 Flash-Lite 互有勝負(fù)。

數(shù)學(xué)能力表現(xiàn)亮眼,AIME 2025 取得 23.3%,超越對(duì)比模型的 20.0%,展現(xiàn)出擴(kuò)散架構(gòu)在推理任務(wù)上的潛力。

不過(guò)模型在部分基準(zhǔn)上仍存短板。科學(xué)推理 GPQA Diamond 僅 40.4%,明顯低于對(duì)比模型的 56.5%;推理能力 BIG-Bench Extra Hard 為 15.0%,同樣落后于 21.0%。

速度方面,英偉達(dá)在官方博文中指出,該模型的擴(kuò)散設(shè)計(jì),能充分發(fā)揮英偉達(dá) GPU 的 Tensor Core 并行計(jì)算能力。

在單塊 H100 GPU 上,DiffusionGemma 達(dá)到每秒 1000 個(gè) token 的生成速度;在 DGX Spark 上為每秒 150 個(gè) token;在 DGX Station 上可達(dá)每秒 2000 個(gè) token,約為同等條件下自回歸模型的 4 倍。

最近更新

主站蜘蛛池模板: 午夜精品久久久久久久男人的天堂| 日韩中文字幕在线不卡| 欧美日韩一区二区三区免费| 亚洲日本一区二区三区在线不卡| 欧洲国产精品| 91精品久久久久| 99久久自偷自偷国产精品不卡| 91精品视频播放| 天天综合中文字幕| 欧美中文在线免费| 国产欧美一区二区三区视频| 国产一区亚洲二区三区| 91精品国产综合久久久久久久久| 热久久精品国产| 国产区精品在线观看| 国产精品99一区| 亚洲a中文字幕| 精品久久蜜桃| 亚洲精品tv久久久久久久久| 色天天综合狠狠色| 欧美精品久久久久久久自慰| 国产精品免费在线播放| 亚洲精品乱码视频| 国产精品初高中精品久久| 欧美亚洲视频一区| 91久久精品www人人做人人爽| 欧美在线视频一区二区| 国产成人精品电影久久久| 日韩一级片免费视频| 国产精品久久久久久免费观看| 日韩视频第二页| 国产精品视频最多的网站| 欧美日本精品在线| 日韩中文字幕三区| 久久精品午夜福利| 色综合久久av| 在线丝袜欧美日韩制服| 国产精品久久久久国产a级| 久久99久久99精品| 久久精品99无色码中文字幕| 欧美一级成年大片在线观看|