Новости
DeepSeek V4 Pro 0813 vs GPT-5.6 Sol on DeepSWE: Cost, Coding, and Routing
Together AI · Опубликовано · 3 мин чтения
За 30 секунд
- Что произошло
- Together AI benchmarked DeepSeek V4 Pro 0813 versus GPT-5.6 Sol on DeepSWE coding tasks. Pro costs 35x less; Sol wins first attempt; Pro wins with retries.
- Почему это важно
- Engineers choosing models for software engineering tasks need to decide between cost and single-shot accuracy, or whether cascading models makes sense for their workload.
- На что обратить внимание
- Results are specific to DeepSWE benchmark and Together AI's implementation. Sol breaks existing tests in 20% of failures versus Pro's 11%, requiring different guardrails.
Послушать это резюме
- gpt
- deepseek
Кто ещё это публиковал
То же событие у других изданий, за которыми мы следим.
Паттерны, стоящие за этой новостью
Каждый разбирает, как работает техника, когда она оправдывает затраты и где ломается.
The Agent Architect
Один паттерн, один компромисс, одна история сбоя в продакшене. Короткий еженедельный брифинг для тех, кто строит агентные системы.
Одно письмо в неделю, отписка в один клик. Адрес используется только для рассылки брифинга.