🔗 @0xKavehانویدیا همیشه درخشان بوده! اینبار هم در یک حرکت زیبا مدل رو دو قسمت کردند.من هنوز با دیدن…
انتشار: 2026/07/02 12:03 UTC
🔗 @0xKavehانویدیا همیشه درخشان بوده! اینبار هم در یک حرکت زیبا مدل رو دو قسمت کردند.من هنوز با دیدن عدد 98.7٪ قانع نمیشم تا benchmarkها و tradeoffها روشنتر بشن.ولی اگر parallel generation واقعاً جواب بده، شاید یکی از مهمترین تغییرات نسل بعدی مدلها نه در scale، بلکه در معماری inference باشه....➖➖➖➖➖➖➖➖➖➖➖🔗 @NVIDIAAIWe took a 30B model and split it in two to write tokens in parallel instead of one at a time.Introducing Nemotron-Labs-TwoTower: a diffusion language model from NVIDIA Research adapted from Nemotron-3-Nano-30B-A3B. Here’s how it works: one half holds the context, the other writes t...➖➖➖➖➖➖➖➖➖➖➖ 📲 @twittervid_bot



