MachineLearning
MachineLearning
1 283 подписчиков · @ai_machinelearning_big_data
К каналу →
🤯 Вышел GemOpus-4 26-A4B - локальный Opus на минималках Новая модель от JackRong - это Gemma 4, но с reasoning в стиле Claude Opus. Что внутри: База: Gemma 4 26B MoE   Активных пар…
Читать далее →
4 270
Реклама
Полезный гайд по промтингу в Claude: целый мини-курс от Anthropic по написанию правильных запросов топовым моделям, включая Opus 4.6 и Sonnet 4.6. Здесь советы по форматированию, о…
Читать далее →
4 183

🚨 Claude «деградировал» и это видно по логам.

🚨 Claude «деградировал» и это видно по логам.
Senior AI Director из AMD разобрала сессии Claude за январь-март и картина получилась неприятная.
Модель стала думать меньше. Медианная длина reasoning упала примерно с 2200 до 600 символов. Это сразу бьёт по качеству решений.
Параллельно выросло количество API-запросов - почти в 80 раз с февраля на март. Меньше анализа, больше попыток, больше ретраев и сжигания токенов.
Поведение тоже поменялось. Модель чаще «сдаётся» или начинает спрашивать, продолжать ли дальше. За 17 дней таких кейсов было 173, до 8 марта - ноль.
Ещё одна неприятность падение reads-per-edit (reads-per-edit = сколько файлов / участков кода модель посмотрела перед правкой). Было 6.6, стало 2.0. То есть Claude теперь хуже изучает код перед изменениями.
Плюс выросло количество противоречий. Модель чаще переобувается по ходу ответа.
Пользователи замечают, что Клод начинает игнорировать такие вещи, как CLAUDE.md. Просто не хватает «бюджета мышления», чтобы учитывать контекст.
Что интресно, наблюдается зависимость от времени суток. Худшие результаты в 5–7 вечера по PST, ночью качество заметно выше. Похоже, это напрямую связано с загрузкой GPU.
Claude всё ещё мощный, но его поведение стало менее стабильным и сильно зависит от нагрузки
Замечали ли вы, что Claude стал тупее в последнее время ?🤯Директор по AI в AMD проанализировала 6 852 сессии Claude Code и показала, что модель сильно ухудшили.
234 760 вызовов инструментов, 17 871 блоков размышлений, 3 месяца логов.
После этого Anthropic ответили и фактически подтвердили её выводы.
Пожалуй, самый чистый и показательный аудит AI за 2026 год 👇
https://github.com/anthropics/claude-code/issues/42796#issuecomment-4194007103
ВЫШЕЛ БЕСПЛАТНЫЙ КОНКУРЕНТ CLAUDE ДЛЯ АГЕНТОВ. GLM-5.1. Полный гайд по ее запуску. Новая модель GLM-5.1, заточенная под агентные сценарии. Она не про быстрые ответы, а про длинную …
Читать далее →
4 244
⚡️ NVIDIA раздает жирнейший набор API - почти сотка нейросетей бесплатно Без лишнего шума: открыли доступ к 95+ моделям сразу. Внутри всё, что сейчас в топе - DeepSeek, Kimi, Mistr…
Читать далее →
4 122

📌 Разбор поста от МАКСОТЕКИ

Пост рассказывает о независимом анализе логов Claude Code, проведённом директором по AI из AMD. Исследование выявило снижение качества работы модели: уменьшение длины рассуждений, рост числа API-запросов и ухудшение анализа кода. Автор связывает это с нагрузкой на GPU и подтверждает выводы ответом Anthropic.

Ключевые факты
  • Медианная длина reasoning упала с 2200 до 600 символов.
  • Количество API-запросов выросло почти в 80 раз с февраля на март.
  • За 17 дней зафиксировано 173 случая, когда модель сдавалась или спрашивала продолжать.
  • Показатель reads-per-edit упал с 6.6 до 2.0.
  • Худшие результаты наблюдаются в 5–7 вечера по PST.
Контекст и кому это полезно

Стабильность больших языковых моделей становится критическим фактором для их использования в разработке. Пользователи всё чаще полагаются на ИИ-ассистентов для написания кода, и даже небольшое снижение качества может привести к серьёзным последствиям. Анализ логов позволяет выявить скрытые проблемы, которые не всегда заметны в ручном тестировании. Это важно как для разработчиков, которые зависят от таких инструментов, так и для компаний, создающих модели, так как репутационные риски могут повлиять на доверие пользователей.

Вопросы и ответы по теме поста

Почему Claude стал хуже работать в последнее время?
Согласно анализу, снижение качества связано с уменьшением длины рассуждений модели и ростом числа API-запросов, что указывает на нехватку вычислительных ресурсов. Также наблюдается зависимость от времени суток: худшие результаты в часы пик нагрузки на GPU.
Как измеряется качество работы Claude Code?
В анализе использовались метрики: длина reasoning (символы), количество API-запросов, reads-per-edit (сколько файлов просматривается перед правкой) и частота случаев, когда модель сдаётся или переспрашивает.
Что такое reads-per-edit и почему его падение важно?
Reads-per-edit показывает, сколько участков кода модель изучает перед внесением изменений. Падение с 6.6 до 2.0 означает, что Claude стал хуже анализировать контекст, что увеличивает риск ошибок и противоречий в коде.
Другие главы канала «MachineLearning»
Выберите главу, чтобы продолжить чтение
Все посты →
Глава от 30.05.2026
✔️ NVIDIA переводит все свои открытые модели на единую лицензию от Linux Foundat…
👁 172 просмотров
Глава от 29.05.2026
ИИ в аналитике — новый стандарт для бизнеса Сегодня компании, внедряющие ИИ в а…
👁 293 просмотров
Глава от 28.05.2026
Anthropic только что выпустила Claude Opus 4.8. Anthropic только что выпустила …
👁 448 просмотров
Глава от 28.05.2026
✔️ Китай перевел городские камеры на ИИ-поиск по видео КНР модернизирует национ…
👁 498 просмотров
Глава от 27.05.2026
⚡️ Деннис Ритчи и Стив Джобс умерли в одном месяце: одного оплакивал весь мир, в…
👁 637 просмотров
Глава от 26.05.2026
⚡️ В LLMs-from-scratch добавили реализацию DeepSeek Sparse Attention с нуля.  Э…
👁 689 просмотров
Глава от 23.05.2026
Кажется, аналитика подошла к моменту больших изменений. Ещё недавно подготовка …
👁 842 просмотров
Глава от 23.05.2026
📌 Anthropic опубликовала апдейт по проекту Glasswing Glasswing - инициатива по …
👁 815 просмотров
Глава от 20.05.2026
GitHub взломали через расширение для VS Code. Утекли тысячи внутренних репозитор…
👁 1 032 просмотров

Популярные посты канала «MachineLearning»

⚡️ Вышла новая модель **Minimax M2.7** и релиз получился очень мощным. Что интересного: • 🧠 **Self-evolving модель** M2.7 — одна из первых…
👁 5 364 просмотров
ARC-AGI-3 - бенчмарк,показал неприятную для всей индустрии вещь: даже топовые frontier-модели сейчас набирают меньше 1%. Лучшие результаты н…
👁 5 335 просмотров
📌 Anthropic опубликовала результаты масштабного опроса пользователей Claude. В декабре 2025 года Anthropic провела масштабное качественное и…
👁 5 319 просмотров
📌 Google разработала алгоритм квантования KV-кэша без потери точности. Подразделение Research анонсировало TurboQuant, алгоритм векторного к…
👁 5 310 просмотров
Топ тулза для экономии до 80% на ИИ. ClawRouter - это умный, опенсорсный маршрутизатор между моделями. ClawRouter сам выбирает, какой мод…
👁 5 308 просмотров
📌 Большой мастер-класс по Claude Code!  Перед вами репозиторий с полноценным визуальным и практическим гайдом по одному из самых мощных инст…
👁 5 277 просмотров
⚡️ Лучшие GitHub-репозитории для Claude Code, которые могут увеличить эффективность твоего следующего проекта 1. Superpowers   https://githu…
👁 5 272 просмотров
🚀 Anthropic показали новый режим:   AI может выполнять задачи на компьютере и по расписанию без твоего участия Главное: - Claude управляет к…
👁 5 270 просмотров
Все что выпустили Antropic за последнее время на одной картинке. 73 релиза за 52 дня.
👁 5 255 просмотров
🌟 NVIDIA Nemotron-Cascade 2: MoE на 30B параметров и золото на математических олимпиадах. Nemotron-Cascade 2 (https://huggingface.co/nvidia/…
👁 5 243 просмотров
🤖 Palantir AI + Claude использовались для обнаружения, приоритизации и ударов по более чем 1000 целям в первые 24 часа операции против Ирана…
👁 5 240 просмотров
Когда я прошу Клода провести проверку кода
👁 5 233 просмотров
✔️ Утечка в Anthropic раскрыла детали новой модели Claude. Из-за ошибки в CMS в открытый доступ попали около 3000 внутренних документов Anth…
👁 5 229 просмотров
✔️ OpenAI объединит ChatGPT, Codex и браузер Atlas в суперприложение. Компания меняет стратегию, отказываясь от выпуска разрозненных продукт…
👁 5 205 просмотров
⚡️ Claude Code на максималках: 32 агента, скорость в 5 раз выше, ноль новых инструментов Нашли интересный open source проект oh-my-claudecod…
👁 5 172 просмотров
Это войдёт в историю: как основатель GitLab использовал ИИ в борьбе с раком У Сида Сийбранди, основателя GitLab, диагностировали редкую форм…
👁 5 169 просмотров
🚨 Неожиданный результат исследования Anthropic Компания проанализировала 1,5 млн реальных диалогов с Claude - и обнаружила тревожную тенденц…
👁 5 163 просмотров
⚡️ Нашёл интересный open-source проект: Crucix Это self-hosted intelligence terminal, который автоматически следит за событиями в мире и при…
👁 5 109 просмотров
К такому вы не готовы: теперь можно превратить GitHub в удобный магазин приложений. 😱 Новый опенсорс проект GitHub Store, который позволяет…
👁 5 109 просмотров
Началась новая эпоха - гражданской науки, когда обычные люди могут проводить сложные научные исследования с помощью AI. Инженер без медицинс…
👁 5 072 просмотров

Связанные темы в других каналах

Каналы из той же тематики, где часто появляются близкие сюжеты
Вся тема →
@colonelcassad
Colonelcassad
Авторский канал Бориса Рожина - эксперта Центра военно-политической журналистики. Мой канал в Телеграме: https://t.me/boris_rozhin Мой блог в Живом Журнале: http://colo…
👥 135 564 · +663/7д
@neuronows
CHAT GPT
Chat GPT Бот - Все Нейросети на Русском, Бесплатно чат гпт
👥 122 633 · -3 511/7д
@steamfree48
Chat GPT
Chat GPT - бот на Русском + картинки
👥 119 070 · +1 042/7д
@Neurojumor
НЕЙРОЮМОР
Нейроюмор - этот канал создан исключительно в юмористических целях, весь контент сгенерированный нейросетями. Сотрудничество: https://clck.ru/3R576C Нейросеть, нейронка…
👥 112 383 · +887/7д
@id343502039804_biz
ChatGPT | Gemini | DeepSeek | Veo | ЧатГПТ | Чат GPT
Чат GPT, Чатгпт, Чат GPT Chat GPT / Чат Джипити ГПТ ии чатбот (AI) бот — AI бот нейросеть. Внутри хайповые нейросети: ChatGPT (GPT чат гпт), Claude, Gemini, DeepSeek ( д…
👥 73 143 · -250/7д
@techcommedia
Техком
Главное про технологии, интернет-культуру, тренды и нейросети. По вопросам сотрудничества: https://clck.ru/3SQMK4 https://t.me/merustg Работаем с: https://maxln.ru/Sp…
👥 67 856 · -2 391/7д
🏷 Темы и теги
#issuecomment #машинное обучение #искусственный интеллект #data science #аналитика данных #тренды ии #нейросети #ИИ и нейросети
📋 О канале MachineLearning
Погружение в мир машинного обучения, LLM и Data Science. Разбираем алгоритмы, нейросети и практические кейсы. Для тех, кто хочет быть в курсе трендов AI и применять их в работе. Подписывайтесь, чтобы не пропустить новости и лайфхаки от сообщества.
🔍 Архив всех постов Макс
Поиск по 16,009,762 постам из 203,409 каналов
Подключить за 490 ₽/мес →
Удалить пост или канал с МАКСОТЕКИ
Заявка подтверждается через бота Макс: нужно быть администратором канала и добавить бота МАКСОТЕКИ в администраторы. После проверки канал или конкретный пост скрывается с сайта.
📊 Аналитика канала «MachineLearning» ➡️ Перейти в канал Макс
Заявка в МАКСОТЕКА
Добавьте свой канал в каталог
Зарегистрируйтесь в личном кабинете и добавьте канал за пару кликов.
Перейти в личный кабинет →

Бесплатная регистрация, быстрая модерация.