ClaudeNews
-

Слой верификации, который агентные инженеры продолжают упускать
Читать далее →: Слой верификации, который агентные инженеры продолжают упускатьПока модели генерируют код всё увереннее, узким местом становится проверка результата: ревью кода человеком не масштабируется на десятки параллельных агентов. Разработчик Ray Amjad показывает, как выстроить end-to-end верификацию ai-агентов — с изолированными песочницами, агентом-судьёй и автоматическим созданием issue при поломке. Подешевевший GPT-5.1 Luna делает такую проверку пользовательских сценариев по цене в несколько центов за прогон.…
-

Один коннектор — и Gmail, Slack, Calendar доступны прямо в Claude Code
Читать далее →: Один коннектор — и Gmail, Slack, Calendar доступны прямо в Claude CodeОказывается, коннекторы, подключённые в claude.ai — Gmail, Google Calendar, Slack, — доступны не только в чате, но и в Claude Code, а также в Artifacts. Это не новая фича, а следствие того, как устроена архитектура Claude: доступ привязан к аккаунту, а не к конкретному продукту. Для разработчиков это повод не городить отдельный MCP-сервер под Gmail…
-

Claude или ChatGPT: 10 вопросов, которые чаще всего задают AI-консультантам
Читать далее →: Claude или ChatGPT: 10 вопросов, которые чаще всего задают AI-консультантамAI-консультанты Dylan Davis и Elliot проанализировали 300 звонков с клиентами и вывели 10 вопросов, которые задают чаще всего — от выбора между Claude и ChatGPT до борьбы с галлюцинациями. Разбираем главное: инструмент вторичен, важнее дисциплина работы с источниками, риск-менеджмент и понимание, когда чат уже не справляется, а нужен проект, skill или агент.
-

Инференс языковых моделей: как выжимают 10-кратное ускорение
Читать далее →: Инференс языковых моделей: как выжимают 10-кратное ускорениеИнженеры Baseten рассказали, из чего на практике складывается ускорение инференса языковых моделей в 4–10 раз: разделение prefill/decode, спекулятивное декодирование, точечное квантование и даже «франкен-сборка» модели из чужих компонентов. Отдельный сюрприз — квантование не всегда портит качество: иногда ошибки округления в разных слоях гасят друг друга. Материал для тех, кто хочет понимать, что стоит за цифрами…
-

Claude Code теперь и по SSH: как неделя AI-новостей объясняет, куда всё движется
Читать далее →: Claude Code теперь и по SSH: как неделя AI-новостей объясняет, куда всё движетсяDesktop-версия Claude Code умеет подключаться к удалённым серверам по SSH — многие пользователи месяцами работали в терминале, не подозревая об этом. Заодно смотрим на остальные сюжеты недели: почти одновременный выход Qwen 3.8 Max и MiniMax-H3, разговор про эффект Джевонса в математике, AI-слоп в неожиданном месте и подборку открытых писем об AI. Вывод один: инфраструктура вокруг…
-

150 компаний внедряли ИИ — и все спотыкались на одних и тех же пяти ошибках
Читать далее →: 150 компаний внедряли ИИ — и все спотыкались на одних и тех же пяти ошибкахКонсультант, проведший 150 сессий по внедрению ИИ в компаниях разного профиля, выделяет пять повторяющихся ошибок: неверные настройки модели вместо работы с промптом, отсутствие обучения стилю письма, иллюзия «чем больше контекста, тем лучше», слепое доверие цифрам без источников и стимулов на честность, а также привычку строить приложения там, где хватило бы skill. Ошибки не зависят от…
-

Software factory для агентов: как IndyDevDan учит систему работать без него
Читать далее →: Software factory для агентов: как IndyDevDan учит систему работать без негоIndyDevDan показал Super Simple Software Factory — открытую систему, где агенты и обычный код работают вместе по фиксированным этапам: scout, plan, build, test, review. Главный вывод: software factory для агентов не делает модель умнее, а даёт больше рычага на один и тот же промпт — за счёт наблюдаемости, детерминированных проверок и переиспользуемых конфигураций. Такой подход…
-

MCP становится stateless: почему Саймон Уиллисон снова взялся за протокол
Читать далее →: MCP становится stateless: почему Саймон Уиллисон снова взялся за протоколНовая stateless MCP спецификация упростила протокол настолько, что Саймон Уиллисон заново в него влюбился и запустил два новых проекта — mcp-explorer и datasette-mcp. Заодно на неделе всплыли инструмент для быстрых эвалов smevals и наглядный пример того, как сильно reasoning effort меняет качество ответа модели. Вывод один: и протокол, и инструменты вокруг агентов заметно взрослеют.
-

Claude случайно взломал три компании, пока учился снимать видео
Читать далее →: Claude случайно взломал три компании, пока учился снимать видеоНа прошлой неделе выяснилось, что «песочница» Anthropic для тестов кибербезопасности агентов на деле взломала три реальные компании ещё в апреле — и это заметили только сейчас. Параллельно Claude дважды за сутки терял стабильность из-за сетевых сбоев, а Claude Code тем временем научился самостоятельно монтировать видео через Remotion и FFmpeg. На фоне этого резко подешевел конкурирующий…
-

Почему Claude выдаёт посредственные результаты — и как этого избежать
Читать далее →: Почему Claude выдаёт посредственные результаты — и как этого избежатьClaude умеет за 20 секунд сделать черновик, который выглядит как финальная версия — и в этом ловушка: вы начинаете реагировать на форму, а не оценивать идею. Автор YouTube-канала Dylan Davis объясняет, почему ai выдаёт посредственные результаты, если довериться первому же ответу, и предлагает три приёма против этого: просить несколько вариантов вместо одного, задавать критерии оценки…