DeepSeek dévoile son modèle V4.1-Flash
Introduction : L’entreprise chinoise affirme que plusieurs évaluations placent ce modèle devant son V4-Pro en matière de performances, de vitesse et de coût… DeepSeek met particulièrement en avant le travail réalisé sur le KV cache, un composant important pour les applications exploitant de longs contextes et les agents IA. Selon l’entreprise, V4.1-Flash nécessite quatre fois moins de mémoire HBM et huit fois moins de stockage SSD pour son cache que la génération précédente. Cette optimisation présente un intérêt économique direct… DeepSeek veut également répercuter ces gains d’efficacité sur ses clients. Les nouveaux tarifs sont entrés en vigueur le 10 septembre, avec une différence entre les périodes de pointe et les périodes creuses. En dehors des heures de pointe, les prix sont réduits de moitié. V4.1-Flash est ainsi facturé entre 0,003 et 0,006 dollar par million de tokens en entrée lorsque le cache est utilisé, contre 0,15 à 0,30 dollar sans cache. La sortie est facturée entre 0,60 et 1,20 dollar par million de tokens selon la période.
https://www.lemondeinformatique.fr/actualites/lire-deepseek-devoile-son-modele-v41-flash-100778.html