Deepseek lanserar V4.1-Flash, en multimodal MoE-modell med 552 miljarder parametrar men 8 miljarder aktiva för input och 16 miljarder för output.
ANNONS
Bolaget uppger att modellen överträffar V4-Pro i tester och kräver betydligt mindre cachelagring. V4-Pro fasas ut och styrs till V4.1-Flash från 14 september.
De nya, lägre API-priserna gäller från 10 september och uppgår under högtrafik till 0,006 dollar per miljon tokens vid cacheträff, 0,30 dollar för övrig input och 1,20 dollar för output, medan priserna halveras under lågtrafik.