DeepSeek lance V4-Flash-Vision-Exp, un modèle multimodal accessible en API et annoncé au niveau d’Opus 4.8 sur les agents. Un signal fort avant l’IPO.
En bref
- DeepSeek lance un modèle multimodal expérimental en API
- La société vise le niveau d’Anthropic sur les agents
- Le timing colle avec ses ambitions d’IPO
DeepSeek accélère sur deux fronts à la fois, la performance IA et la finance. La startup de Hangzhou vient de mettre en ligne V4-Flash-Vision-Exp, une version expérimentale multimodale de son modèle V4 Flash, pendant qu’elle avance vers une IPO en Chine continentale. Vu de l’écosystème, ce n’est pas un détail. Quand un acteur réduit l’écart technique avec les leaders américains tout en préparant sa cotation, on change d’échelle.
Un saut technique qui compte au-delà de la démo
Le nouveau modèle sait traiter des images, des captures d’écran et des prompts visuels, sans abandonner ce qui faisait déjà le cœur de V4 Flash, le texte, le raisonnement et les capacités d’agent. Dit autrement, DeepSeek ne plaque pas une couche vision sur un modèle existant, il cherche à garder un comportement cohérent sur plusieurs modalités.
Et ce modèle n’arrive pas en labo fermé. Il est disponible via l’API de DeepSeek. Pour les développeurs et les intégrateurs, c’est le vrai sujet. Un modèle multimodal agentique utilisable tout de suite, ça pèse bien plus qu’une annonce de principe.
Anthropic reste la cible, mais l’écart se resserre
DeepSeek affirme que V4-Flash-Vision-Exp se situe près d’Opus 4.8, le modèle phare d’Anthropic, sur des benchmarks multimodaux orientés agents. Bon, une revendication éditeur reste une revendication éditeur. Mais même prise avec prudence, elle raconte quelque chose de clair, les développeurs chinois continuent de rogner le retard sur les acteurs américains.
C’est là que la sortie devient importante pour le marché. La bataille ne se joue plus seulement sur le chatbot grand public ou le pur raisonnement texte. Elle glisse vers des systèmes capables de lire une interface, comprendre un visuel, puis enchaîner des actions. Pour les usages pro, c’est un cap nettement plus concret.
Une fenêtre de tir parfaite avant la Bourse
Le calendrier n’a rien d’innocent. Bloomberg indiquait qu’DeepSeek prépare une introduction en Bourse en Chine continentale, avec un dépôt visé en 2026 pour une arrivée potentielle sur le marché en 2027. La société a déjà entamé des discussions avec des cabinets comptables et des banques d’investissement.
En parallèle, elle chercherait aussi des fonds privés supplémentaires avant cette éventuelle cotation. Peu après un tour rapporté à environ 6 milliards d’euros (7 milliards de dollars), DeepSeek discuterait avec des investisseurs pour une nouvelle levée sur la base d’une valorisation pré-money d’au moins 480 milliards de yuans, soit environ 57 milliards d’euros. C’est en hausse par rapport aux quelque 46 milliards d’euros (50 milliards de dollars) de sa première levée externe, à laquelle participait Tencent Holdings.
Bref, le message est double. DeepSeek veut prouver qu’il sait livrer un modèle multimodal crédible, et montrer aux marchés que cette crédibilité peut déjà se monétiser.