Commentaires : Avec Mistral Large 4, l'IA française ose défier GPT-6 Astra et publiera ses poids à tous le 27 octobre

Mistral a lancé mardi la préversion publique de Mistral Large 4, un modèle d’IA de 1 000 milliards de paramètres entraîné en Europe. Les poids de ce modèle open-weight seront publiés le 27 octobre.

https://clubic.com//actualite-632875-ave-mistral-large-4-ia-francaise-ose-defier-gpt6astra-et-publiera-son-poids-a-tous-le-27-octobre.html

4 « J'aime »

Hâte de tester ce nouveau modèle !

1 « J'aime »

Dommage qu’il n’a pas pris le nom « Le Chaton Fat » après la moquerie des américains.

1 « J'aime »

De toute façon, pour ce que valent les moqueries des Américains.

Juste comme ça :

Moi aussi ce matin en me levant j’étais anthousiaste et puis ensuite je suis revenu sur terre :upside_down_face:

À voir une fois sorti mais bon :confused: https://artificialanalysis.ai/#intelligence

En cyber il est dans les meilleurs certainement moins de restrictions. Après ok il est pas en tête mais il faut relativiser car il y a 5-6moi c était de ce niveau et encore. Et ensuite il faut faire attention au bench.
Sur un code sonnet 5 c’était catastrophique, sonnet 5.5 il m a rajouté une erreur sur une fonction qui marchait, et voulais rien entendre, même genini flash 3.6 a résolu du premier coup. ChatGPT les hallucinations de la 5.6 abusé.
Alors ok en bench c est devant, mais quand on part sur des codes avec la petite erreurs qui foire tout pas juste un site où la police est pas terrible, ça devient autre chose.
Les hallucinations et l ia qui veut pas admettre l erreur c est un plaies.
Et il faut regarder tous les bench plus loin sur le site pas juste celui ci

1 « J'aime »

Mmm mouais… pas plus tard qu’hier soir j’ai vu une démo de Astra qui explose littéralement Opus 5.5 à TOUS les niveaux. Donc je me demande sur quels critères est réalisé ce classement.

Ce graphique montre le résultat du modèle en test en faisant une sorte de moyenne sur plein de benchmarks sur lequel il n’a probablement jamais été finetunée. C’est comme pour Gemma, il est très bon dans certain domaine, mais nul dans d’autres. Clairement, l’objectif de Mistral ici, c’est la cyber sécurité, il faut donc comparer ce modèle dans ce domaine en priorité. S’il se foire sur du bench Math ou Humanity Last Exam, je pense qu’on s’en fout, il ne va pas être utilisé pour ça de toute façon.

@xryl En efficacité cibersec, Il se fait dépasser par Mimo 2.6 pro et GLM 5.3 flash deux modèles chinois open weight qui ne coutent strictement rien à l’usage. Et GPT-6 Luna est presque gratuit pour ainsi dire sur ces tâches.

@Loposo Pour le code, opus/sonnet 5.5 sont souvent premier du classement donc je vois pas de quoi on parle ici. Et les modèles récents ça fait bien longtemps qu’ils sont capables de faire bien mieux que « changer une police » :face_with_raised_eyebrow: Autant sur le reste je m’en remets aux bench car je suis pas expert en tout autant pour le dev je peux parler je suis fullstack depuis 13 ans et je suis de très très proche les LLM et autres nouveauté du domaine de l’IA. Si tu n’arrives pas à obtenir de bon résultats alors ton harness, tes workflows, ta config sont sans doute à revoir. PS : j’utilise pas Claude donc c’est même pas de la promotion que je fais là.

@PBL : Tu peux aller voir ici si tu le souhaites https://artificialanalysis.ai/ ça reste la ref pour l’aggregation indépendante de bench

--

Alors certes, ce dernier modèles est mieux que le précédent de mistral mais il est présenté ici comme rivalisant avec les plus gros, ce qui est objectivement faux sauf si on prend quelques bench isolés oui. Dans sa globalité, ce modèle est encore loin des autres, même ceux open weight et pour le coût c’est même pas un sujet.

Là ou mistral est sans doute bien meilleur c’est de respecter les règles Européenes, des entrainements très encadrés et une gestion des données personnelles bien meilleure que les concurents. Et qu’on s’y trompe pas, j’aimerais que Mistral face parti des plus grands, voir devienne le numéro 1, car même si j’habite plus en France je reste Français et ça serait une certaine fierté. Mais actuellement, Mistral est surtout moqué partout à travers le monde à cause de ce genre d’annonce loupée qui le présente en énorme révolution alors que les chinois sortent des modèles meilleurs en tout point à chaque matin :expressionless: C’est un peu le problème Français, on se croit meilleur alors qu’on ne regarde pas ce qui se fait ailleurs pour comparer.

S’il se foire sur du bench Math ou Humanity Last Exam, je pense qu’on s’en fout, il ne va pas être utilisé pour ça de toute façon.

Mistral est la version utilisée offfciellement par les universités et les centres de recherche francais (partenariat officel à travers celestia) DOnc merci qu’il sache etre bon pour des exams préparés c’est le minimum syndicales. Et c’est lui qui doit etre utilise pour la recherhce. Il est aà un miiliard de kms d’Astra et Opus dans ces domaines (maths). Les chercheurs francais utilsent une 2cv bridée tandis que les collègues étrangers ont des ferrari.

Mistral 2 mois et 3800 gpu pour faire le modèle, combien de GPU pour claude et Open AI, ou même les chinois?
J’ai aucun compte payant chez aucun des fournisseurs IA, le gratuit me suffit mais il faut remettre les choses a leurs niveau. Mistral a quand même fait un bon, personne et même pas eux ont dit qu’ils avaient le meilleurs. Mais ils ont un modèles ou c’est (pour le moment) pas une administration qui va interdire de le mettre dispos qu’a ses services de renseignement et espionnage. et les chinois pas mieux (j’utilise mais je vais pas les glorifier car derrière c’est du tres gros soft power)