X-дайджесты
-

Claude «почти доказал» гипотезу Римана: что скрывается за вирусным твитом
Читать далее →: Claude «почти доказал» гипотезу Римана: что скрывается за вирусным твитомВирусный твит рассказывает, как Claude якобы почти решил гипотезу Римана, подняв долю доказанно лежащих на критической прямой нулей дзета-функции с 41,6% до 67% за полтора дня. Разбираем математический контекст этой оценки и объясняем, почему к подобным заявлениям стоит относиться с осторожностью — независимо от итога, эта история показывает растущую роль ИИ как соавтора в фундаментальной…
-

Claude и гипотеза Римана: неделя, где ИИ шагнул в математику, а WebFetch поумнел
Читать далее →: Claude и гипотеза Римана: неделя, где ИИ шагнул в математику, а WebFetch поумнелИсследовательская версия Claude продвинулась в работе над гипотезой Римана, подняв нижнюю границу доли «правильных» нулей дзета-функции с 41,6% до 67,2%. Параллельно Anthropic убирает Haiku из инструмента WebFetch из-за галлюцинаций и фиксирует цену Sonnet 5 навсегда. Неделя показала: Claude одновременно двигает фронтир математики и чинит бытовые проблемы своих же инструментов.
-

Claude Code разрешил себе действовать без спроса — и вот что это значит
Читать далее →: Claude Code разрешил себе действовать без спроса — и вот что это значитClaude Code сделал auto mode режимом по умолчанию: агент теперь сам решает, какие действия безопасно выполнять без подтверждения пользователя. Разбираем, на чём строится это доверие и почему это меняет привычный цикл работы с агентом. Заодно — короткий срез остальной недели в экосистеме: локальные модели, открытый код для inference и наблюдение о пользе голосового ввода.
-

Claude научился отбивать prompt injection, а Opus 5 хранит секреты про Fable
Читать далее →: Claude научился отбивать prompt injection, а Opus 5 хранит секреты про FableБорис Черни из Anthropic заявил, что prompt injection в Claude в основном решена на практике — независимые бенчмарки и red-teaming это подтверждают. Параллельно Саймон Уиллисон нашёл в системном промпте Claude Opus 5 вручную добавленные факты о событиях после даты обучения модели. Вместе это показывает: Anthropic управляет поведением Claude уже после релиза — обучением и точечными…
-

Вайб-кодинг игр: почему ИИ клепает прототипы, а не хиты
Читать далее →: Вайб-кодинг игр: почему ИИ клепает прототипы, а не хитыСоздатель Datasette Саймон Уиллисон попробовал вайб-кодинг игр и вынес урок: собрать что-то похожее на игру языковая модель может за час, а вот сделать её действительно увлекательной — нет, и дело не в мощности модели. Игра держится на балансе, ощущении управления и десятках мелких решений, которые пока не формализуются в промпт. Это не отменяет пользу ИИ…
-

Claude Opus 5 сам пишет доки и чинит железо 1996 года — без единой строчки исходника
Читать далее →: Claude Opus 5 сам пишет доки и чинит железо 1996 года — без единой строчки исходникаДва поста из X описывают, на что уже способен Claude Opus 5 в связке с Claude Code: сам обновлять документацию кода по итогам рабочего дня и восстанавливать логику legacy-системы 1996 года без доступа к исходникам. Разное по масштабу, но общее по сути — агенту всё чаще можно поставить цель и уйти, не разбивая задачу на…
-

Агенты «переписываются» именами файлов — и это неожиданно хорошо работает
Читать далее →: Агенты «переписываются» именами файлов — и это неожиданно хорошо работаетРазработчик Саймон Уиллисон показал пример, где несколько агентов ведут переписку исключительно через имена файлов в общей папке — включая base64-вложения и служебные префиксы для сортировки. Это не хак, а рабочий минималистичный протокол межагентного взаимодействия, который стоит держать в арсенале вместо очередей и API там, где сложная инфраструктура не нужна.
-

Claude Code переходит на автопилот: auto mode станет режимом по умолчанию
Читать далее →: Claude Code переходит на автопилот: auto mode станет режимом по умолчаниюAnthropic объявила: с 14 августа auto mode станет режимом разрешений по умолчанию в Claude Code для Pro, Max и Team — вместо permission-промптов действия проверяет классификатор, который в тестах поймал 89% опасных команд против 14% у ручного одобрения. Многослойная защита (обучение модели + входные пробы + классификатор намерений) впервые почти обнулила indirect prompt injection на…
-

Длинное нажатие вместо промпта: как ChatGPT прячет reasoning effort
Читать далее →: Длинное нажатие вместо промпта: как ChatGPT прячет reasoning effortСаймон Уиллисон рассказал о скрытом жесте в мобильном ChatGPT, который управляет глубиной размышления модели, посетовал на неудобство PDF на телефоне и напомнил о ценности технического блогинга. Вместе эти три наблюдения показывают, что интерфейсы ИИ-инструментов и привычки чтения ещё не устоялись и подстраиваются под мобильный контекст. Для пользователей Claude Code это напоминание: reasoning effort и extended…
-

Claude Fable 5 стал точнее отвечать на вопросы про биологию
Читать далее →: Claude Fable 5 стал точнее отвечать на вопросы про биологиюAnthropic обновила биологические ограничения Fable 5: ложные отказы на медицинских и биологических вопросах снизились примерно на 85%. Модель стала охотнее помогать с бытовыми и образовательными темами, но запросы про вирусологию, токсикологию и молекулярный дизайн по-прежнему автоматически уходят на Opus 5. Компания делает ставку на биологию и медицину как главную сферу пользы ИИ и обещает в…