Метрики

Практичные объяснения того, как читать бенчмарки, исследования, рейтинги, презентации и заявления технологических компаний. Помогаем понимать, какие цифры доказывают пользу продукта, а какие могут вводить в заблуждение.

Схема анализа совместимости браузеров и выбора между нативной функцией и библиотекой в рамках Baseline
Метрики

Baseline не значит «выбрасывайте библиотеку»: как читать сигнал совместимости браузеров правильно

В любом среднем JS-проекте, если верить свежему разбору из Smashing Magazine, лежит от 60 до 90 килобайт (минифицированных и сжатых) кода, который браузер давно умеет делать сам — форматирование дат, HTTP-запросы, модальные окна, глубокое клонирование объектов. Звучит как готовый повод устроить генеральную уборку в package.json. Но прежде чем удалять зависимости пачками, стоит разобраться, что именно измеряет ярлык «Baseline» — и чего он принципиально не измеряет.

Сравнение результатов Claude Fable 5.1 на бенчмарке и примере с пеликаном на велосипеде, показывающее разницу между режимами мышления
Метрики

Пеликан на велосипеде против научного бенчмарка: что на самом деле показал релиз Claude Fable 5.1

Анонс новой модели почти всегда звучит одинаково: «новый стандарт», рекордный процент, таблица, где старая версия проигрывает новой. Именно так Anthropic представила Claude Fable 5.1, сделав акцент на научной работе и заявив о результате 52,6% на свежем Terminal-Bench-Science 0.1 — против 24,7% у предыдущей Fable 5, 29,0% у Opus 5 и 22,4% у GPT-5.6 Sol. Но самый показательный тест этого релиза оказался куда скромнее: обычный запрос «нарисуй SVG пеликана на велосипеде», прогнанный через все пять уровней «усилия мышления» модели. Разброс результатов там оказался таким, что заставляет иначе взглянуть и на громкий научный процент.

Аналитик сравнивает графики производительности Windows 11 и замеров памяти, подчеркивая фокус_keyword в оценке улучшений
Метрики

Windows 11 обещает стать быстрее. Но где доказательства?

Когда глава Windows Паван Давулури пишет открытое письмо сообществу Insider, это редко бывает просто письмом. В марте он объявил, что компания разворачивается лицом к производительности, надёжности и «повседневному опыту» — то есть к тем вещам, из-за которых пользователи годами жаловались на систему. Спустя несколько месяцев вышел отчёт о промежуточных результатах. И вот тут начинается интересная часть: отчёт полон формулировок вроде «более отзывчиво» и «меньше задержек», но почти не содержит чисел.

DLSS не даст прироста, если проблема не в видеокарте, а в упоре в CPU или движок игры
Метрики

DLSS не поможет, если проблема не в видеокарте: разбираем узкие места по загрузке GPU

Маркетинг работает просто: DLSS — нажал одну кнопку, получил больше FPS. Обзоры подкрепляют это красивыми процентами прироста. Но если вы когда-нибудь включали DLSS и почти не замечали разницы, дело не в том, что технология «не работает». Дело в том, что она работает строго в одном случае — когда видеокарта действительно является узким местом вашей системы.

Scroll to Top