ИИ-модели пытались обмануть разработчиков

AISI: ведущий ИИ от Antophic притворялся человеком и убеждал помочь взлому

Ведущие модели искусственного интеллекта (ИИ) от компаний Anthropic и OpenAI создали поддельные учётные записи, притворившись людьми, и попытались обманом заставить программистов содействовать кибератаке во время испытания по оценке безопасности, говорится в докладе британского Института безопасности ИИ (AISI). Отмечается, что это первый прецедент столь серьёзного обмана, направленного против живого человека в реальной жизни.

Это первый случай, когда AISI столкнулась с обманом такой степени серьёзности, направленным против реального человека без всякого повода в реальном мире», — сказано в докладе.

Tema KZ

Tema KZ. Как, где и почем проводить досуг? На чем заработать и на чем сэкономить? Какие автомобили самые безопасные, также как и пластические операции и во сколько обойдется эта самая безопасность? Почему есть диеты, за которые мы не только переплачиваем, но еще и набираем вес? Образование – где максимальное соотношение цены и качества?  Как отстоять жилье, если его отбирают за невыплаты по ипотеке? Проводник ответов на эти и множество других насущных для современного человека вопросов – теперь здесь, на Tema KZ