Le mixture of experts poussé loin. Le modèle est énorme au repos, minuscule à l'exécution, puisqu'il ne réveille que les spécialistes utiles à chaque requête. C'est la suite directe du numéro précédent : après avoir compressé les modèles, on apprend à n'en allumer qu'un trentième.
Anthropic · 1er septembreLe prix affiché ne bouge pas, mais la lecture de cache chute de 75 %, à 0,25 dollar le million de jetons. Invisible sur l'étiquette, décisif pour tout ce qui relit sans cesse le même contexte, c'est-à-dire les agents.
La fiche technique de Google le dit sans détour : le modèle est bâti sur la 3.7, pas sur une nouvelle base. Le tarif ne bouge pas jusqu'au 31 décembre, puis double au 1er janvier. La cadence tient lieu d'argument.
OpenClawJusqu'ici l'agent était une affaire personnelle, installé sur son poste, nourri de son contexte. La 2.0 en fait une ressource collective. Le glissement est plus grand qu'il n'y paraît : il faut alors décider qui voit quoi, qui peut lui faire faire quoi, et à qui appartient ce qu'il produit.
Le réseau perd des utilisateurs à force de contenu généré et se tourne vers eux pour faire le tri. Aveu intéressant : la plateforme qui a le plus poussé l'écriture assistée demande maintenant qu'on la dénonce.
Une explication utile alors que le mot « ouvert » sert à tout le monde. Publier les poids d'un modèle n'est pas publier de quoi le reconstruire : les données et la recette restent souvent au chaud.
Sous Android 17, l'assistant va chercher les réglages lui-même. Pratique pour tout ce qui est enterré à quatre menus de profondeur, et première fois qu'un assistant touche vraiment au système.
Le modèle produit l'image en direct, plus rapidement que sa propre lecture. La génération cesse d'être une attente pour devenir un flux.