Sûreté de l’IA : Nvidia lance une plateforme pour stopper les agents déviants
Derrière l’effet d’annonce, le géant fabless devra prouver l’efficacité de ses garde-fous.
Découvrez nos derniers articles sur le développement web, le design et les technologies digitales qui façonnent l'avenir
Derrière l’effet d’annonce, le géant fabless devra prouver l’efficacité de ses garde-fous.
Android Bench est un benchmark des LLM du marché proposé par Google. Android Bench 2.0 pousse plus loin avec des tâches plus complexes sur plusieurs. Et là, les résultats peuvent d'effrondrer. Un des défis pour ces modèles n'est plus de générer du code mais mener à mener à son terme des tâches très...
Le géant fabless américain assure vouloir conserver la neutralité et l’ouverture de la plateforme de la société franco-américaine, que ce soit en matière de modèles d’IA, de données, de logiciels et d’accès aux puces concurrentes.
erlang_wasm est une implémentation en Erlang/OPT du runtime WebAssembly. Il n'y a pas de liens avec Wasmtime, Wasmer, wasm3 et WAMR. Le seul code natif est un fichier NIF de 200 lignes. Actuellement, le projet supporte le core WebAssembly 1.0, la mémoire, les types, memory64, SMID, le...
En parallèle du lancement de Claude Fable 5.1 et Mythos 5,1, Anthropic a présenté plusieurs mesures pour renforcer la cybersécurité de ses modèles et empêcher ses concurrents de les exploiter de manière illégitime.
Du fait de sa propension à consommer plus de tokens, Fable 5.1 n’est finalement pas moins cher que Fable 5. En revanche, ses performances en hausse et les contrôles d’audit en font un candidat évident pour les applications des entreprises réglementées.
Anthropic a sorti, mardi, Claude Fable 5.1 et Claude Mythos 5.1, ses nouvelles modèles d'intelligence artificielle. Vendus comme plus performants en codage, moins chers à l'usage et déjà mobilisés pour la recherche scientifique, ils pourraient marquer une nouvelle étape pour l'entreprise américaine.
A l’occasion du salon du jeu vidéo de Cologne, Ralph Fulton, cofondateur du studio Playground Games, commente cette licence emblématique très attendue, dont le « reboot » s’identifie d’avantage à un « conte de fées » qu’à de la fantasy.
Le 8 juillet dernier, Bun, racheté par Anthropic, a annoncé une réécriture totale de Bun avec Claude Fable 5 pour migrer le code en Rust. Jusqu'à présent, l'outil était codé en Zig depuis 2021. Bun a multiplié les bug fix et mises à jour pour stabiliser les fonctions. Pour réussir cette mission,...
Plusieurs services d'Anthropic ont connus des pannes sévères et globales ces derniers jours :- claude.ai- claude console- claude API- claude code-claude CoworkLes premiers problèmes se sont protagés dès le 12 août et Anthropic a réglé les problèmes les uns après les autres :- 12 août : dégradation...
Android Bench publie une évoluation de LLM pour les tâches de développement Android. Dans ce nouveau comparatif, 8 nouveaux modèles apparaissent. Les bases du comparatif :"Android Bench évalue la capacité des LLM à générer du code résolvant un problème en leur soumettant des cas concrets et des...
Avec Opus 5, Anthropic a fine-tuné Claude Opus 4.8 pour le rendre presque aussi performant que Fable 5 tout en étant 35 % moins cher à la tâche, d’après Artificial Analysis. Une mise à jour qui réclame d’adapter les instructions et de faire une croix sur la majorité des tâches liées à la...