Sa “petite” mise à jour fait déjà un remorque

Table des matières

Le Démarrer La Chine vient de donner un autre grand coup à Chatgpt, Gemini et Claude avec une “petite” mise à jour de Deepseek R1. Maintenant, plusieurs chercheurs spéculent qu'au moins une partie des données utilisées provient de Google Gemini.

Dans cette même situation, le Démarrer Chine peu de temps après le lancement de Deepseek R1 fin janvier et Après avoir stupéfait les fondations dans lequel le modèle commercial de Chatgpt avait été maintenu.

La “petite” mise à jour Deepseek R1, qui a pu Approche o3 d'Openai Et même surmonter les Gémeaux dans certaines tâches, a à nouveau un impact sur l'industrie du Genai, étant aussi Open sourcegratuit et sans limites d'utilisation.

Sam Paech, un développeur basé à Melbourne qui est responsable de la création d'évaluations de l'intelligence émotionnelle pour l'IA, a publié ce qu'il déclare que c'est la preuve que le dernier modèle de Deepseek Il a été formé avec les résultats des Gémeaux.

Le chercheur soutient que R1-0528 préfère Mots et expressions similaires à ceux utilisés Gémeaux 2.5 Pro de Google. Ce qui n'est pas une preuve irréfutable, car elle maintient TechCrunch.

Il y en a un autre sous le créateur de pseudonyme, connu pour son outil pour évaluer la liberté d'expression appelée SpeechMap, qui maintient que Les “pensées” que Deepseek génère Ils ont des aspects similaires à ceux des Gémeaux.

Le Démarrer La Chine n'a pas révélé la source Parmi les données avec lesquelles il a formé son modèle mis à jour, il laisse donc de l'espace pour une éventuelle spéculation et revient à la charge avec ces accusations qui se sont déjà produites en janvier de cette année.

Pour le moment, Google n'a rien déclaré, mais OpenAI en janvier a déclaré à Financial Times qu'il avait trouvé des preuves que le Démarrer La Chine aurait utilisé une technique appelé “distillation”qui est basé sur l'extraction de données des modèles des personnes âgées ou plus capables.

Et ici, un aspect fondamental entre en jeu avec lequel tous les principaux modèles d'intelligence ont été formés: Extraction de données Web ou Internet. Le Web ouvert est précisément là où les entreprises IA obtiennent la plupart de leurs données de formation.

Qu'un modèle d'IA ou d'un autre partage des phrases, des sens et des mots similaires est plus que courant. Et pour rien, il aide que ce site Web ouvert soit “contaminé” par celui qui crée des clickbait et des robots qui cherchent à désinformer les fausses données ou les nouvelles.

Aussi, les entreprises d'IA elles-mêmes Ils protègent leurs modèles Face à la distillation, et OpenAI exige déjà que les organisations terminent un processus de vérification de l'identité pour accéder aux modèles les plus avancés.

Deepseek R1, avec sa mise à jour d'il y a quelques jours, s'est démarqué car il raisonne déjà profondément, il atteint Openai O3 en performance, génère des séances allant jusqu'à 60 minutes de réflexion profonde et en 24 heures atteint 500 millions de jetons d'utilisation par les utilisateurs.

Leave a Reply