Dans l'actualité
Introducing SWE-2: Pushing the Pareto Frontier
Cognition · Publié le · 3 min de lecture · 342 sur Hacker News
En 30 secondes
- Ce qui s'est passé
- Cognition a lancé SWE-2, un modèle de code atteignant 50% sur FrontierCode 1.1 avec 64% de coûts en moins que les concurrents comparables.
- Pourquoi ça compte
- Les ingénieurs construisant ou évaluant des agents IA de codage doivent vérifier si le compromis coût-performance de SWE-2 s'adapte à leurs contraintes de déploiement.
- Vigilance
- Les résultats de benchmark varient fortement selon les tâches; SWE-2 est derrière GPT-6 Astra sur certains et devant sur d'autres, donc la performance réelle dépend de votre domaine.
Les patterns derrière cette actualité
Chacun explique le fonctionnement de la technique, quand elle vaut son coût et où elle casse.
The Agent Architect
Un pattern, un compromis, une panne de production racontée. Un brief hebdomadaire court pour ceux qui construisent des systèmes agentiques.
Un email par semaine, désinscription en un clic. Votre adresse ne sert qu'à envoyer le brief.