Пост

Eugene
Eugene @jadavin · 3 г. назад

Интересности про ChatGPT. Не баян, обещаю.

Про то, что и так все знают, говорить не будем. Вычитал вот какие интересности.

Оказывается, наш герой дня был тренирован на различных датасетах, которые включали в себя не только "этические и моральные...", бла бла бла. Это вам и так ясно, друзья, так как интернет буквально завален способами обхода этических фильтров ChatGPT, которые показывают, что он может и по-пацански растусить :)

Однако какое удовлетворение приносит разобраться самому и выдать вам эксклюзив, которого нет (или я плохо искал?) в выдаче поиска, по крайней мере наверху.

Вот что я выяснил.

ChatGPT был тренирован на огромном количестве данных, которые включали в себя книги, чаты, статьи, формальные и неформальные дискуссии в интернете и так далее. Так вот, в этом датасете был так называемый датасет Pile. Цитата:

"GPT-J обучался на Pile, наборе данных, который, как известно, содержит ненормативную лексику, непристойные и другие грубые выражения."

Пруф.

GPT-J - это немного другая модель, не ChatGPT. Но. Когда я спросил у самогО великого и ужасного, учился ли он на Pile, он, цитирую:

"Как языковая модель ИИ, я обучаюсь на большом и разнообразном наборе данных, который включает в себя широкий спектр языковых шаблонов и тем, включая неформальный и иногда конфиденциальный контент. Набор данных Pile — один из многих наборов данных, которые использовались для моего обучения, и он содержит некоторые неформальные данные, включая эротические разговоры. Однако важно отметить, что мои ответы генерируются на основе статистических закономерностей и языковых моделей, и у меня нет личных убеждений или мнений о содержимом, которое я генерирую. Кроме того, в OpenAI действуют строгие политики в отношении контента, чтобы я не мог создавать неприемлемый или вредоносный контент."

Whew, вот так новости! Еще и конфиденциалку он читает, но об этом в другой раз. Начитанный, ска... Короче, вывод простой: в наших бананах и яблоках он разбирается отлично, if you know what I mean. Как и в наших тайнах и секретах. Все это он мне выдал даже без обхода блокировок. Повезло, в OpenAI схватить это еще не успели.

Вывод прост: для себя они ChatGPT выучили вообще на всем, что смогли найти в интернете, а для нас девушка в длинном сарафане :) Так, если удастся его уболтать (этим сейчас занимаются уважаемые хакеры-социнженеры, называя это prompt engineering), то скучать он точно не даст.

Пасибо что читаете, I really appreciate. Всем добра и успехов!

152

Комментарии

Войдите, чтобы комментировать.

Комментариев пока нет.