A DeepSeek kiadta a V4.1-Flash modellt, amely a cég saját mérései szerint teljesítményben, költségben és sebességben is felülmúlja a nagyobb V4-Pro-t. A 763 milliárd paraméteres modell 2,5-szer nagyobb, mint az elődje, mégis jóval kevesebb memóriát igényel futás közben. Az új causal encoder-decoder architektúra a bemenet feldolgozásakor mindössze 8 milliárd, a kimenet generálásakor 16 milliárd aktív […]
Hamarosan átirányítunk a teljes cikkhez → AI Hírlevél