

Une amélioration substantielle de l'intelligence et du comportement par rapport à Composer 2, en particulier sur les tâches agentiques à long terme.
Loading comments…
Récompense
Infos du projet
Mots-clés du produit
Composer 2.5 est une mise à jour majeure de l'assistant de codage IA disponible dans Cursor. Il représente un bond considérable en intelligence et en comportement par rapport à son prédécesseur, Composer 2, avec une force particulière dans les tâches agentiques à long terme. Le modèle est construit sur le même point de contrôle open source que Composer 2 — Kimi K2.5 de Moonshot — mais bénéficie d'un entraînement à plus grande échelle, d'environnements d'apprentissage par renforcement plus complexes et de nouvelles méthodes d'apprentissage qui améliorent à la fois la capacité et la convivialité.
Composer 2.5 introduit une technique d'entraînement novatrice qui fournit un retour localisé à des points spécifiques d'un déploiement. Au lieu de se fier uniquement à un signal de récompense final — qui peut être bruité sur des centaines de milliers de jetons — le modèle reçoit des indices insérés directement dans le contexte où un comportement doit être amélioré. Cela permet à Composer 2.5 d'apprendre de ses erreurs, comme des appels d'outils incorrects ou des explications confuses, sans être pénalisé pour l'ensemble de la trajectoire.
Le modèle est entraîné sur 25 fois plus de tâches synthétiques que Composer 2. Ces tâches sont créées et sélectionnées dynamiquement tout au long de l'entraînement, garantissant que le modèle continue à faire face à des problèmes plus difficiles à mesure que ses capacités de codage s'améliorent. Des approches comme la suppression de fonctionnalités — où l'agent doit supprimer du code tout en maintenant une suite de tests fonctionnelle — ancrent les données synthétiques dans les défis réels des bases de code.
Au-delà des benchmarks de codage bruts, Composer 2.5 a été affiné sur des dimensions comportementales importantes pour une utilisation réelle. Le modèle communique plus clairement, calibre son effort de manière appropriée à la tâche et est généralement plus agréable à utiliser lors de longues sessions.
"Composer 2.5 est meilleur pour le travail soutenu sur des tâches longues, suit des instructions complexes de manière plus fiable et est plus agréable à utiliser."
Cette combinaison d'intelligence soutenue et de finesse comportementale est rare parmi les assistants de codage IA. Alors que de nombreux modèles peuvent gérer des tâches courtes et bien définies, Composer 2.5 excelle dans le type de travail étendu et multi-étapes qui définit le développement logiciel réel. La méthode d'entraînement par retour ciblé signifie qu'il apprend d'erreurs spécifiques plutôt que d'être puni pour des trajectoires entières, ce qui le rend à la fois plus intelligent et plus adaptable en pratique.
Vous êtes un développeur qui travaille régulièrement sur des tâches de codage complexes et longues et qui souhaite un assistant IA qui maintient sa concentration, suit des instructions nuancées et communique clairement tout au long du processus. Si vous avez constaté que d'autres assistants de codage perdent en cohérence sur un travail multi-étapes ou ne parviennent pas à apprendre d'erreurs localisées, Composer 2.5 offre une amélioration significative tant en intelligence qu'en qualité de collaboration.
D'autres outils que vous pourriez envisager
Trois choses n'arrêtaient pas de me gêner avec Claude Code. Changer d'onglet toutes les 30 secondes juste pour vérifier s'il tournait encore. Claude bloqué silencieusement pendant 12 minutes pendant que j'étais dans une autre application. Revenir pour découvrir qu'il avait terminé ou qu'il était bloqué depuis 15 minutes. Alors j'ai construit CodeBreak. Un personnage pixel-art se promène sur votre écran pendant que CC tourne. Il célèbre quand c'est fini, panique quand il a besoin de vous, boude en cas d'erreurs. 7 $, paiement unique. Pas d'abonnement. Toutes les futures mises à jour sont gratuites. C'est pour CC pour l'instant, mais deviendra universel pour tous les outils d'IA.
Qu'est-ce que 1Code ? Une application pour exécuter vos agents Claude Code en parallèle, qui fonctionne sur Mac et sur le Web. Sur Mac — exécutez localement, avec ou sans worktrees. Sur le Web — exécutez dans des sandbox distants avec des aperçus en direct de votre application, y compris sur mobile, afin de pouvoir surveiller les agents depuis n'importe où. Exécuter plusieurs Claude Code en parallèle a considérablement accéléré notre façon de développer des fonctionnalités.
LobeHub est un Chief Agent Operator (CAO) qui construit, exécute et coordonne votre équipe d'agents IA. Décrivez un objectif, et il assemble les bons agents/compétences, exécute des tâches en parallèle dans le cloud, achemine le travail entre les modèles, et ne fait rapport que lorsque des décisions sont nécessaires — via vos canaux existants (Slack/Discord/Telegram/iMessage). Moins de changements d'onglets, plus de résultats.
Les agents d'IA génèrent des interfaces utilisateur lentement, à grands frais, de manière incohérente, et les factures d'inférence explosent en conséquence. Montage résout ce problème : émettez un minuscule schéma d'intention, nous compilons des composants de production côté serveur : 10 fois plus rapide, 50 à 100 fois moins de tokens, indépendant du modèle et du framework. Désormais, un seul appel API M1 génère des visuels interactifs riches, les héberge sous forme d'interfaces utilisateur en direct avec un état persistant, et les adapte à votre marque. Ne laissez pas vos agents réinventer l'interface utilisateur à chaque tour - équipez-les avec Montage !
Créateur
blueprint_b
Alternatives
Loading comments…