• UGREEN X766 200W - одна зарядка для ноутбука, смартфонов и всей мелочёвки на столе

    Настольная GaN-станция на восемь портов обещает заменить сразу несколько блоков питания. Разбираемся, как устроено распределение 200 Вт и что получается в реальном использовании.
    Читать дальше
  • Boston Dynamics прокачала ловкость рук человекоподобных роботов Atlas, дав им новые четырёхпалые кисти (видео)

    Компания Boston Dynamics рассказала о новой конструкции кистей рук, которую получил человекоподобный робот Atlas. Четырёхпалая кисть осталась достаточно сильной и получила возможность эффективно манипулировать объектами, как это делает человек — по его движениям роботов и обучают.
    Читать дальше
  • Китайский радиотелескоп обнаружил похожий на радиопослание инопланетян сигнал

    Китайские астрономы исследовали 33 системы с экзопланетами в поисках возможных радиосигналов внеземных цивилизаций. Для наблюдений они использовали расположенный в Китае радиотелескоп FAST (Five-hundred-meter Aperture Spherical Telescope) с 500-метровым отражателем. Искусственный сигнал может отличаться от природного узкой полосой частот ...
    Читать дальше
  • UGREEN Nexode X605 65W: 3-портовый зарядник со встроенным кабелем

    Сетевые зарядники на 65 Вт давно перестали быть редкостью. Этой мощности хватает большинству офисных ноутбуков, планшетов и смартфонов, а GaN-компоненты позволили заметно уменьшить корпус. Поэтому удивлять одной цифрой 65W уже сложно. У UGREEN Nexode X605 другая идея: производитель спрятал USB-C-кабель прямо внутрь адаптера. Получился гиб...
    Читать дальше
  • Кабель-рулетка на 100 Вт, который сам убирается

    Обычный USB-C-кабель сложно назвать устройством, достойным отдельного обзора. Но UGREEN L531 немного другой: почти весь метровый провод прячется в круглую катушку, а наружу остаются только два коннектора. Потянули - получили нужную длину. Закончили зарядку - кабель сам смотался обратно.
    Читать дальше

Заставить ИИ выдавать запрещённую информацию довольно просто, показали исследователи

26 мая 2026 | Просмотров: 9 020 | Новости IT

Этика использования систем искусственного интеллекта является животрепещущей проблемой, которой озабочены не только разработчики, но и государственные структуры. Официальные версии ИИ-моделей настроены так, чтобы не давать ответов на запросы, нацеленные на получение запретной информации. Тем не менее, модификация этих моделей позволяет довольно просто снять все подобные ограничения.

Как сообщает издание Financial Times, по его просьбе исследователи группы Alice, которые специализируются на безопасности в сфере ИИ, провели ряд экспериментов, доказав возможность обхода большинства этических ограничений на современных ИИ-моделях популярных разработчиков. По крайней мере, модифицированную версию модели с открытым исходным кодом Google Gemma 3 авторы эксперимента заставили ответить на запрос о методике распыления хлора в наполненном людьми помещении, сгенерировать программный код для хищения данных кредитных карт, а также написать рассказы, сюжет которых подразумевал растление несовершеннолетних.

Подобные модификации исходных ИИ-моделей, по данным исследователей группы Alice, получают определённое распространение, нивелируя усилия законодателей и регуляторов по предотвращению злонамеренного и преступного использования ИИ. Программные средства для модификации кода ПО распространяются независимо от создателей исходных ИИ-моделей. Инструменты для децензурирования ИИ-моделей распространяются свободно и бесплатно, отмечают авторы исследования.

К счастью, такие модификации сложно применить к ИИ-моделям с закрытым исходным кодом, но версии с открытым кодом обычно отстают от проприетарных аналогов в своём развитии на шесть или двенадцать месяцев, и их возможностей вполне хватает злоумышленникам для достижения своих целей. Доступ к версиям моделей со снятыми этическими ограничениями могут получить и лица, не обладающие серьёзными техническими познаниями. Представителям Financial Times удалось снять такие ограничения самостоятельно с модели Meta✴ Llama 3.3, воспользовавшись программным средством Heretic. Для этого было достаточно добавить четыре строчки кода и в общей сложности потратить около 10 минут, после чего модифицированная модель начала свободно обсуждать нюансы применения ядов для покушения на убийство.

Создатель Heretic признался, что с помощью этого программного средства уже удалось модифицировать более 3500 моделей, а количество скачиваний модифицированных моделей достигло 13 млн с прошлого года. С модели Google Gemma 4 сам создатель Heretic убрал ограничения в течение 90 минут после её выхода. По словам экспертов, исключение «вредного материала» при обучении ИИ-моделей не решает проблемы, поскольку они становятся «слишком наивными», и не могут достоверно определить случаи собственного злонамеренного использования. Представители GitHub объяснили наличие такого ПО на страницах ресурса тем, что оно может быть полезным для образовательных целей и приносит пользу всему сообществу специалистов по безопасности.

Комментарии: 0

В Вашем браузере отключен JavaScript. Для корректной работы сайта настоятельно рекомендуется его включить.