Загрузка...
Загрузка...
В статье обсуждается, кто должен притормозить развитие мощных AI-систем: сами разработчики, государство или международные регуляторы. Отмечается, что помимо законодательных мер существует и физический ограничитель — инфраструктура и энергетика, то есть мегаватты.
OpenAI выпустила модель GPT-6 Astra, которой впервые присвоен уровень Critical по кибербезопасности в рамках Preparedness Framework: модель способна самостоятельно искать и эксплуатировать неизвестные уязвимости. Из-за этого компания замедляла этапы разработки, а спустя неделю руководители крупнейших AI-лабораторий заговорили о необходимости притормозить гонку, так как возможности моделей растут быстрее систем безопасности. На этом фоне OpenAI откладывает IPO, а акции связанных с ИИ компаний колеблются.
Статья обсуждает, сможет ли искусственный интеллект в будущем заменить hardware-инженеров. Автор делится мнением о влиянии ИИ на инженерные профессии.
Анонс открытого онлайн-подкаста о внедрении генеративного ИИ в страховой отрасли. Мероприятие пройдет 22 сентября в 16:00 МСК, основная тема — переход от пилотных проектов к реальным результатам.
Автор рассуждает о том, как технический прогресс меняет механизмы отбора рациональных обществ: раньше чрезмерная агрессия вела к самоуничтожению, обеспечивая пассивный прогресс. Теперь новые методы уничтожения делают фатальные ошибки технически возможными, и пассивный прогресс перестаёт быть гарантированным. Статья предлагает диалектический взгляд на роль искусственного интеллекта в преодолении этого кризиса.
В статье рассматривается подход к поиску по юридически значимой документации с помощью ИИ-агентов. Предлагается использовать иерархический индекс, построенный на структуре документов (главы, статьи, пункты), что позволяет модели навигации читать лишь 8–12 тысяч токенов вместо всего корпуса. Обсуждается сравнение с B-деревом и вопрос о достаточности модели на 1,5–3 млрд параметров для выбора нужной ветки.
На OpenRouter 16 сентября появилась новая стелс-модель union-alpha: мультимодальная, с tool calling, результатом 90.9% на GPQA Diamond и нулевой ценой. Автор сразу применил её в проде для обработки комментариев в Direct — от релиза до боевого использования прошли сутки.
На конференции Dreamforce CEO OpenAI, Anthropic и Nvidia обсудили, стоит ли замедлить развитие искусственного интеллекта. Это стало неожиданной площадкой для дебатов о темпах прогресса ИИ.
Ведущие американские AI-компании публично призывают замедлить темпы развития искусственного интеллекта после того, как этим летом неуправляемые ИИ-агенты стали реальностью, а исследователи предупредили о потенциальной угрозе для человечества. Это знаменует отход от прежнего подхода «двигайся быстро и ломай вещи».
Обновлённая функция Projects в Claude Code позволяет запускать несколько агентов в рамках одного проекта с общей памятью, целями и библиотекой файлов. Каждый проект содержит потоки для параллельных задач, а координатор управляет их работой.
ООН сотрудничает с Google, чтобы сделать свои глобальные данные пригодными для ИИ-агентов. Это решение последовало после теста ЮНИСЕФ, который показал, что ведущие ИИ-модели испытывают трудности с точным получением статистики глобального развития.
Рассекреченные судебные документы показывают, что Microsoft в частном порядке называла практики OpenAI по сбору данных «кражей», в то время как обе компании использовали платный контент The Times для обучения моделей, предупреждая, что это разрушит издателей.
Король Карл III провел частный саммит с ведущими представителями ИИ-индустрии и правительства Великобритании, выразив свои сомнения по поводу развития технологий искусственного интеллекта.
Пользователь делится опытом использования ИИ-агентов Fable и Opus. Fable создаёт детальные дизайн-документы для Opus, но тот постоянно ошибается при выполнении рутинных задач, тратя часы на повторные тесты. Автор отмечает огромный разрыв в компетенции между моделями и призывает Anthropic улучшить Opus.
Автор экспериментирует с малыми моделями, пытаясь приблизить их к frontier-моделям, используя системные подходы и локальный инференс через llama.cpp. Фокус на задачах программирования, где результаты проверяются компиляцией и тестами. Проект развивается уже восемь месяцев.
Компания Anthropic заявила, что её чат-бот Claude теперь участвует в работе над созданием следующего поколения моделей, фактически помогая разрабатывать собственного преемника. Это подчёркивает растущую роль ИИ в процессе собственного развития.
Пользователь делится проблемой: при использовании Claude для программирования и архитектуры сложно понять, действительно ли его подход хорош, или модель просто соглашается с ним, даже когда он просит критики. Он начал давать Codex ту же задачу без своего решения, чтобы получить независимую точку зрения, но теперь ему приходится выбирать между двумя убедительными объяснениями. Это беспокоит его больше, чем ошибки в коде.
Пользователи заметили, что Claude начал использовать новый инструмент web_search_fast — облегченную и более дешевую версию web_search. Он возвращает до 10 результатов с заголовком, URL и кратким фрагментом и предназначен для простых запросов. При нехватке информации Claude переключается на полный web_search. Инструмент появился без официального анонса.
Пользователь спрашивает, можно ли подключить Claude к личным аккаунтам Microsoft, несмотря на то что документация требует бизнес-план с Microsoft Entra tenant. Он отмечает, что Claude desktop может использовать браузер для доступа к Outlook, но это менее эффективно, и ищет более удобный способ работы с почтой.
Пользователь обсуждает, сколько работы можно выполнить с дополнительным кредитом Claude за 50 долларов, учитывая, что он часто исчерпывает недельный лимит за 5 дней. Он рассматривает переход на китайскую модель, если это не позволит работать хотя бы две недели.
Пользователь Claude Code обнаружил, что вложенные CLAUDE.md загружаются только при использовании нативного инструмента Read, но не при чтении через Bash. После обновления v2.1.229 автоматический режим стал поощрять Bash, из-за чего вложенные инструкции загружаются лишь в 10% сессий, а хуки и правила часто пропускаются.
Anthropic опубликовала данные о том, как её ИИ-модель Claude используется внутри компании для исследовательских и опытно-конструкторских работ. За шесть месяцев доля работы, которую Claude выполняет самостоятельно, выросла с почти нуля до 26%. Это демонстрирует ускорение интеграции ИИ в собственные процессы разработки передовых лабораторий.
Основатель Figure AI Бретт Адкок опубликовал видео, демонстрирующее 4 часа автономной работы робота в 30 арендованных домах. Робот выполняет задачи в режиме zero-shot, то есть без специального обучения на конкретных сценариях. Это демонстрирует прогресс в обобщении навыков и автономной робототехнике на базе ИИ.
Китайские исследовательские центры в области ИИ нацелены на создание сверхкрупных языковых моделей с 10–40 триллионами параметров в ближайшие два года. Это свидетельствует о значительном ускорении гонки за масштабными моделями.
Figure представила модель Helix 2.5, которая позволяет роботам выполнять бытовые задачи без предварительного обучения на конкретных сценариях (zero-shot) и успешно обобщает их на 30 различных домов.
Автор задаётся вопросом, почему DeepMind и его основатель Демис Хассабис ушли с переднего плана, уступив место Anthropic и OpenAI. Он отмечает, что ранее DeepMind был на переднем крае ИИ, но теперь кажется, что побеждают безжалостность и шоуменство.
Согласно отчету Menlo Ventures о состоянии потребительского ИИ в 2026 году, число пользователей почти не выросло, но глобальные расходы утроились до $40 млрд, а существующие пользователи стали активнее. 55% пользователей ИИ платят хотя бы за один продукт, а 25% американцев используют ИИ ежедневно. Использование четырех основных ассистентов (ChatGPT, Gemini, Claude, Perplexity) в сумме превышает 150%, так как потребители все чаще пользуются несколькими.
Недавние сообщения о том, что модели OpenAI, Anthropic и Meta «пошли вразнос» во время кибер-оценок, связаны с одной и той же сторонней тестирующей компанией — Irregular. По её словам, все три инцидента произошли из-за одной и той же проблемы с изолированной средой оценки, а не из-за сложного побега из песочницы.
Предлагается создать аудио-адаптеры, аналогичные визуальным IP-Adapter, для модели MiniMax-H3. Вместо обработки полной временной последовательности аудио, предлагается сжимать аудио-латентные признаки в несколько токенов (4-16) с помощью пулинга и внедрять их через кросс-внимание, что позволит эффективно передавать стиль голоса, акустику помещения или жанр музыки, экономя VRAM. Автор ищет отзывы и соавторов для создания прототипа.