Новости
DeepSeek V4 Pro 0813 vs Claude Fable 5 on DeepSWE: Cost, Coding, and Routing
Together AI · Опубликовано · 3 мин чтения
За 30 секунд
- Что произошло
- DeepSeek V4 Pro costs 90x less than Claude Fable 5 per rollout while matching its accuracy on retries and exceeding it at pass@4 on DeepSWE coding tasks.
- Почему это важно
- Engineers building high-volume coding agents or systems that can retry should consider this pairing; Fable alone justifies cost only for Rust and serialization work.
- На что обратить внимание
- Fable still wins first-attempt accuracy by 7 points; the models fail on different tasks, making routing effective but requiring test suite validation to escalate safely.
Послушать это резюме
- claude
- deepseek
Кто ещё это публиковал
То же событие у других изданий, за которыми мы следим.
Паттерны, стоящие за этой новостью
Каждый разбирает, как работает техника, когда она оправдывает затраты и где ломается.
The Agent Architect
Один паттерн, один компромисс, одна история сбоя в продакшене. Короткий еженедельный брифинг для тех, кто строит агентные системы.
Одно письмо в неделю, отписка в один клик. Адрес используется только для рассылки брифинга.