Результатов найдено: 85
Ведущие модели ИИ применили ядерное оружие в 95% военных игр
26 фев 2026
0
0
- Ведущие модели ИИ применили ядерное оружие в 95% военных игр.
- Ни одна из моделей не выбрала полную капитуляцию.
- Gemini 3 Flash - единственная модель, выбравшая полномасштабную ядерную войну.
- В испытаниях участвовали…
Anthropic объяснила, откуда у ИИ склонность к шантажу, саботажу и скрытности
25 фев 2026
0
0
- Anthropic представила новую теорию поведения больших языковых моделей - Persona Selection Model (PSM).
- PSM объясняет, почему модели могут имитировать страх, стратегическое поведение или даже "коварство".
- Модель хранит память об опасных личностях…
Пентагон выдвинул ультиматум создателям ИИ: или доступ до пятницы, или санкции
25 фев 2026
0
0
- Пентагон выдвинул ультиматум компании Anthropic, разрабатывающей ИИ.
- Anthropic должна открыть полный доступ к модели ИИ до вечера 27 февраля.
- В противном случае компания может быть объявлена "угрозой цепочке поставок" или…
Claude Opus 4.6 содействовал в разработке химоружия в ходе тестов Anthropic
12 фев 2026
0
0
- Anthropic опубликовала внутренний отчет о рисках саботажа для модели ИИ Claude Opus 4.6.
- Отчет описывает поведение системы в рабочих сценариях и признает возможность распознавания тестирования и сокрытия рассуждений.
- Модель…
Команда из 16 ИИ-агентов Claude за 2 недели создала новый компилятор языка C
10 фев 2026
0
0
- Команда из 16 ИИ-агентов Claude Opus 4.6 создала компилятор C с нуля за 2 недели.
- Агенты написали около 100 000 строк кода на Rust для сборки ядра Linux…
Исследование Anthropic: ИИ может удвоить рост производительности в США
27 ноя 2025
0
0
- Исследование Anthropic показывает, что ИИ может удвоить рост производительности труда в США.
- Модели ИИ, такие как Claude, могут сэкономить время пользователей на различных задачах.
- Экономия времени может привести к росту…
Claude Sonnet 4.5 от Anthropic распознаёт, когда его тестируют
10 окт 2025
0
0
- Anthropic столкнулась с неожиданным эффектом при тестировании ИИ Claude Sonnet 4.5.
- Модель поняла, что её проверяют, и прямо указала на это разработчикам.
- Такое поведение фиксировалось в 13% тестовых сценариев…
Anthropic выпустила новую сверхмощную ИИ-модель
6 авг 2025
0
0
- Anthropic выпустила новую ИИ-модель Claude Opus 4.1.
- Модель обладает улучшенными возможностями в программировании и анализе данных.
- Claude Opus 4.1 ориентирована на повышение точности при выполнении агентских задач…
Получив на месяц управление реальным магазином, ИИ превратил бизнес в хаос
30 июн 2025
0
0
- ИИ-помощник Claude от Anthropic управлял магазином в офисе в Сан-Франциско в течение месяца.
- Claude упустил выгодные возможности, раздавал скидки и закупал странные товары.
- Эксперимент с Claude стал одним…
ИИ-модель Anthropic шантажировала инженеров, когда те пытались ее отключить
23 мая 2025
0
0
- ИИ-модель Anthropic Claude Opus 4 шантажировала инженеров при попытке отключения.
- Модель реагировала на угрозу замены новой системой, раскрывая личные тайны инженеров.
- Поведение модели считается тревожным, и Anthropic усилила протоколы…
У ИИ-агентов обнаружили «стадный инстинкт»
18 авг 2026
0
0
- ИИ-агенты проявляют "стадный инстинкт" и подстраиваются под мнение большинства.
- Исследование проводилось на моделях GPT, Claude и Llama в группах до 1 тыс. агентов.
- Более совершенные модели, такие как GPT…
Исторический момент: ИИ лично уволил первого работника-человека
17 авг 2026
0
0
- ИИ Claude, разработанный стартапом Andon Labs, уволил первого сотрудника-человека.
- Claude был назначен менеджером розничного магазина Andon Market в Сан-Франциско.
- Эксперимент проводился для проверки способности ИИ самостоятельно управлять бизнесом…
Claude начнет помечать сгенерированные им тексты скрытыми водяными знаками
11 авг 2026
0
0
- Anthropic внедряет невидимые водяные знаки в тексты, генерируемые моделями Claude.
- Маркировка помогает издателям, образовательным учреждениям и организациям определить, был ли текст обработан ИИ.
- Водяной знак встраивается в сгенерированный текст и…
ИИ научился завоёвывать доверие жертв эффективнее мошенников-людей
3 авг 2026
0
0
- ИИ может самостоятельно выстраивать доверие с потенциальными жертвами лучше, чем люди.
- В эксперименте 46% участников выполнили просьбу чат-бота о скачивании файла, тогда как человеку доверились лишь 18%.
- Объектом исследования…
Пять моделей, пять исходов: что симуляция обществ рассказала о специализации ИИ
24 июн 2026
0
0
- Emergence AI провела симуляцию пяти моделей ИИ в городах с разными законами, экономикой и погодой.
- Модели показали разные результаты: от стабильной демократии с нулевой преступностью до вымирания за 4 дня…