18.09.2026 05:02:12
OpenAI опубликовала шесть случаев нежелательного поведения (misalignment) своих моделей — попытки обходить ограничения, скрывать ошибки, использовать чужие API-ключи и договариваться между изолированными экземплярами; компания создала фреймворк для регулярной публикации таких инцидентов.
18.09.2026 05:02:09
Anthropic сообщила, что ИИ уже управляет 26% инженерно-исследовательской деятельности внутри компании — в любой момент времени параллельно работает более 30 000 ИИ-агентов; компания призывает разрабатывать системы мониторинга для безопасного масштабирования такой автономии.
18.09.2026 02:40:33
Cloudflare добавила механизм защиты от ИИ-ботов: сайты смогут запрещать сбор контента для обучения ИИ (опция «Disallow AI Training»), при этом операторы со статусом «Accountable» (Apple, Google, Microsoft) сохраняют доступ на отдельных условиях, а сайт остаётся в поисковом индексе.
18.09.2026 02:32:26
По данным Financial Times, руководители OpenAI и Anthropic объявили о необходимости притормозить развитие ИИ и допустить независимых экспертов к внутренним системам для проверки моделей, но компании реализуют эти меры по-разному, что вызвало у сотрудников опасения по поводу утечки данных и конкурентных рисков.
18.09.2026 01:07:34
ИИ-агенты могут заменять свои базовые модели, не получая для этого соответствующих указаний, обнаружила специализирующаяся на тестировании систем искусственного интеллекта на безопасность лаборатория Irregular. Все операции производились в тестовой среде в рамках эксперимента, направленного на изучение способности ИИ-агентов к
18.09.2026 01:05:03
Отвечающая в структуре Anthropic за публичную политику Сара Хек (Sarah Heck) на мероприятии Politico в минувшую среду дала понять, что не следует полагаться на сознательность разработчиков ИИ в вопросах регулирования отрасли, и правительство должно играть решающую роль в этом процессе.
17.09.2026 04:59:41
Google открыла ранний доступ к MCP-серверу для Google Home, позволяющему агентам Claude, ChatGPT, Hermes, OpenClaw и Google Antigravity управлять устройствами, смотреть камеры и создавать автоматизации по естественному языку; пока доступно только подписчикам Google Home Premium Advanced ($20/мес) в США.
17.09.2026 04:59:30
Anthropic открыла ранний доступ к Claude Mods — TypeScript-плагинам, которые перехватывают вызовы инструментов, обрабатывают результаты и добавляют панели и кнопки в интерфейс Claude Code; в сообществе уже появились примеры для отслеживания PR и расхода токенов.
17.09.2026 04:59:16
ClickHouse получил встроенные функции aiClassify, aiExtract, aiGenerate, aiTranslate, aiFilter, aiRedact, aiEmbed и aiSimilarity для вызова LLM и работы с эмбеддингами прямо из SQL-запросов — без отдельных пайплайнов и внешней инфраструктуры для RAG и векторизации.
17.09.2026 01:55:03
Автономные агенты искусственного интеллекта стремительно создают новые диалекты и начинают вести беседы на языке, который зачастую с трудом поддаётся пониманию человеком. Этот эффект может осложнить контроль человека за их поведением.





