LLM

DeepSeek V4-Flash в публичной бете формально обогнал V4-Pro на Terminal Bench 2.1

DeepSeek сделал неожиданный ход: облегчённая V4-Flash в публичной бете формально обогнала флагманскую V4-Pro-Preview на ключевых агентских бенчмарках. Это редкий случай, когда младшая модель бьёт старшую не за счёт хитрости, а за счёт лучшего

AI-продуктивность: реальные цифры ближе к 10%, чем к 10x

Если вы читаете новости про AI, вы наверняка встречали обещания в духе «в 10 раз быстрее», «ускоряет разработку на 50%», «экономьте 20 часов в неделю». Реальные цифры из свежих ресерчей гораздо скромнее. Типичная

OpenAI снизил цены на GPT-5.6: Sol остался премиум, Terra дешевле на 20%, Luna рухнула на 80%

30 июля 2026-го OpenAI тихо, без презентаций и ключевых докладов, обновил прайс-лист на API семейства GPT-5.6. Средняя модель линейки — Terra — подешевела на 20%. Младшая — Luna — на 80%. Топовая — Sol — без изменений. На

AI-агенты ускорили код — и завалили код-ревью. Что с этим делают в Uber, Cloudflare и HubSpot

Главная инсайдерская рассылка про инженерную индустрию — The Pragmatic Engineer Гергели Ороса — выпустила пост, который звучит как сигнал тревоги. Главный тренд последних шести месяцев в больших компаниях: код-ревью превращается в узкое место разработки. И

Qwen пересёк миллиард скачиваний и обогнал Llama — что это значит

В начале июля 2026-го Qwen — семейство open-source моделей от Alibaba — пересекло отметку в один миллиард скачиваний на Hugging Face. И теперь это самое скачиваемое семейство открытых моделей в мире. Meta Llama — впервые за