DeepSeek V4-Flash в публичной бете формально обогнал V4-Pro на Terminal Bench 2.1

DeepSeek сделал неожиданный ход: облегчённая V4-Flash в публичной бете формально обогнала флагманскую V4-Pro-Preview на ключевых агентских бенчмарках. Это редкий случай, когда младшая модель бьёт старшую не за счёт хитрости, а за счёт лучшего

AI-продуктивность: реальные цифры ближе к 10%, чем к 10x

Если вы читаете новости про AI, вы наверняка встречали обещания в духе «в 10 раз быстрее», «ускоряет разработку на 50%», «экономьте 20 часов в неделю». Реальные цифры из свежих ресерчей гораздо скромнее. Типичная

OpenAI снизил цены на GPT-5.6: Sol остался премиум, Terra дешевле на 20%, Luna рухнула на 80%

30 июля 2026-го OpenAI тихо, без презентаций и ключевых докладов, обновил прайс-лист на API семейства GPT-5.6. Средняя модель линейки — Terra — подешевела на 20%. Младшая — Luna — на 80%. Топовая — Sol — без изменений. На

AI-скандал с Neverness to Everness: что случилось, чем кончилось, и почему это касается не только геймдева

В мае 2026-го вокруг Neverness to Everness — новой urban-fantasy gacha-игры от китайской студии Hotta — разгорелся, пожалуй, самый заметный игровой AI-скандал года. Это не «кто-то шепнул в кулуарах» — студия публично признала, что использовала генеративный

AI-агенты ускорили код — и завалили код-ревью. Что с этим делают в Uber, Cloudflare и HubSpot

Главная инсайдерская рассылка про инженерную индустрию — The Pragmatic Engineer Гергели Ороса — выпустила пост, который звучит как сигнал тревоги. Главный тренд последних шести месяцев в больших компаниях: код-ревью превращается в узкое место разработки. И