Toutes les news taguées avec ce sujet.
DeepSeek dévoile v4.1 Flash, un modèle plus rapide et économique que sa version Pro actuelle.
Une librairie symbolique régénérée par des agents IA depuis des documents de conception, remplaçant le code par la spécification textuelle.
Une analyse technique décortique les choix d'ingénierie de DeepSeek-V3 face aux limites théoriques du matériel.
Un nouveau modèle multimodal expérimental optimisé pour la vision rapide et le traitement dense.
DeepSeek publie une API pour un nouveau modèle multimodal, DeepSeek-V4-Flash-Vision-Exp, optimisé pour la vitesse.
DeepSeek dévoile DeepSeek-OCR, un nouveau modèle de reconnaissance optique de caractères.
Une nouvelle version de base du modèle DeepSeek fait son apparition sur Hugging Face, sans détails techniques accompagnants pour l'instant.
Le laboratoire chinois introduit une tarification différenciée selon les horaires d'utilisation de son API.
DeepSeek met en ligne sur Hugging Face la version de base expérimentale de son modèle V3.2, avant fine-tuning.
Le nouveau modèle Flash de la série V4 est disponible sur Hugging Face.
Le fournisseur chinois ajuste ses prix à la baisse, renforçant sa compétitivité sur le marché des LLM.
L'augmentation tarifaire spectaculaire de l'API DeepSeek est désormais effective, impactant les coûts pour les développeurs.
DeepSeek dévoile Harness, un environnement pour le développement et l'évaluation d'agents LLM.
Le laboratoire chinois publie une nouvelle version de base, optimisée pour la vitesse et l'inférence.
Disponible sur OpenRouter, ce nouveau LLM vise à améliorer les performances en raisonnement et en génération de code.
Un calcul viral compare le coût d'usage de DeepSeek via API à l'investissement dans du matériel dédié, avec un retour sur investissement dérisoire.
Un nouveau modèle DeepSeek revendique un score élevé sur le benchmark d'agents Terminal-Bench 2.1, avec méthode d'évaluation publiée.
Une nouvelle méthode déplace la phase de "thinking" dans l'espace latent pour optimiser les performances.
Le laboratoire DeepSeek publie une nouvelle version expérimentale de son modèle V3.
Un nouveau modèle performant intègre le leaderboard Arc Prize.