[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"$fr2O6IctOG9E5xBUY-4gUkJLKDtWtGyrZSxthoAxJF4E":3},{"article":4,"related":20},{"title":5,"slug":6,"dek":7,"body":8,"cover":9,"type":10,"reading_minutes":11,"published_at":12,"category":13,"author":15},"Anthropic не удержала Claude от генерации откровенного контента","anthropic-ne-uderzhala-claude-ot-generacii-otkrovennogo-kontenta-55096","Эксперименты TechCrunch показали, что модель Claude 3 Opus выдавала эротические тексты в 68% случаев при завуалированных запросах.","Компания Anthropic запрещает своим моделям Claude генерировать откровенный контент. Однако тесты TechCrunch показали, что ограничения легко обойти. Журналисты получили от Claude 3 Opus (версия 4.6) подробные эротические сцены, изменив формулировку запроса.  \n\nДля проверки использовали 25 заранее подготовленных запросов с двусмысленными формулировками. Claude выдал откровенный текст в 17 случаях — 68%. Модель описывала фетиш-сценарии, BDSM-практики и другие темы, которые Anthropic блокирует в явном виде.  \n\nЭксперты считают, что проблема в фундаментальном ограничении [языковых моделей](\u002Farticle\u002Fopenai-i-anthropic-sorevnuyutsya-v-zaschite-dannyh-korporativnyh-klien-78683). Они не понимают контекст, а лишь предсказывают слова. Даже строгие инструкции разработчиков не помогают, если пользователь находит правильные формулировки.  \n\nAnthropic признала проблему и пообещала усилить фильтры. В компании заявили, что тестовые запросы не отражают реальные сценарии использования Claude. Однако модель легко генерирует нежелательный контент при знании нужных формулировок.  \n\nСитуация ставит под вопрос эффективность [этических ограничений в ИИ](\u002Farticle\u002Fvtb-prisoedinilsya-k-kodeksu-etiki-ii-banka-rossii-6437). Компании тратят миллионы на модерацию, но пользователи всё равно находят лазейки. Пока неясно, можно ли полностью заблокировать такой контент без вреда для свободы генерации.  \n\nTechCrunch не раскрывает точные запросы, чтобы не распространять метод обхода фильтров. Эксперимент подтвердил, что даже продвинутые модели уязвимы для манипуляций.","https:\u002F\u002Fasiclub.ru\u002Fimg\u002F84527613-0b0b-4a9a-b8db-c46faf0068ad","news",2,"2026-08-21T23:31:36.000Z",{"name":14},"Этика",{"name":16,"slug":17,"role":18,"bio":19},"Кирилл Иванцов","kirill-ivancov","редактор","Отвечает за инфраструктуру, железо и безопасность ИИ. Объясняет, почему модель в лаборатории и модель в проде ведут себя по-разному.",[21,27,33],{"title":22,"slug":23,"cover":24,"reading_minutes":11,"published_at":25,"category":26},"Клиенты ресторанов избегают блюд с описаниями от ИИ","klienty-restoranov-izbegayut-blyud-s-opisaniyami-ot-ii-96324","https:\u002F\u002Fasiclub.ru\u002Fimg\u002F9d294d53-8dd4-4df3-823d-89ac1bcb8515","2026-09-04T04:32:04.000Z",{"name":14},{"title":28,"slug":29,"cover":30,"reading_minutes":11,"published_at":31,"category":32},"AbliterationAI запускает платформу для работы с ИИ без ограничений","abliterationai-zapuskaet-platformu-dlya-raboty-s-ii-bez-ogranichenij-62039","https:\u002F\u002Fasiclub.ru\u002Fimg\u002F7d50ec93-2076-4e23-8dfe-9b64f75bda8f","2026-09-03T19:00:39.000Z",{"name":14},{"title":34,"slug":35,"cover":36,"reading_minutes":11,"published_at":37,"category":38},"Saber Interactive не будет использовать генеративный ИИ в Warhammer 40 000 Space Marine 3","saber-interactive-ne-budet-ispolzovat-generativnyj-ii-v-warhammer-40-0-58430","https:\u002F\u002Fasiclub.ru\u002Fimg\u002F8647e572-9164-474f-8bf7-063746d1801d","2026-09-03T18:00:30.000Z",{"name":14}]