AI 모델 및 플랫폼

GPT-2, 인공지능 텍스트 생성기 전체 공개

mm
Unite.AI를 Google의 선호 소스에 추가

TheNextWeb(TNW)에 따르면, 여러 인공지능 프로젝트를 진행하는 비영리 단체인 OpenAI는 최근 인공지능 텍스트 생성기 GPT-2의 최종 모델을 공개했다. GPT-2는 2019년 2월에 발표된 이후 많은 논란을 일으켰다.

OpenAI의 연구 논문 Language Models are Unsupervised Multitask Learners에 따르면, GPT-2는 기계 학습을 통해 제한된 입력을 기반으로 새로운 텍스트를 생성한다. 즉, 사용자는任意 주제에 대한 문장이나 두 개를 입력하면, AI 생성기는 원래 입력과 관련된 텍스트를 생성한다. 본질적으로, TNW는 대부분의 텍스트 생성기와 달리 GPT-2는 미리 작성된 문자열을 출력하지 않는다고 설명했다. GPT-2는 이전에 존재하지 않았던 텍스트를 생성한다.

카네기 멜런 대학교 도서관의 프로그램 디렉터인 Scott B. Weingart는 다음과 같은 예시를 제공했다:

 

OpenAI는 초기에 시스템의 악의적 사용에 대한 우려로 인해 2019년 2월에 GPT-2를 8개월 동안 4개 부분으로 나누어 공개하기로 결정했다. 그들은 블로그에서 “기술의 악의적 적용에 대한 우려로 인해 훈련된 모델을 공개하지不会. 책임 있는 공개 실험으로서, 우리는 연구자를 위해 훨씬 더 작은 모델과 기술 논문을 공개한다”고 설명했다.

설명된 바와 같이, 전체 모델은 15억 개의 매개변수를 포함한다. “모델이 훈련될수록 매개변수가 많을수록 ‘더智能해’ 보인다. 즉, 사람은 연습이 완벽하게 만들어준다.”

TNW에 따르면, OpenAI는 초기에 1.24억 개의 매개변수를 가진 모델을 공개했으며, 이후 3.55억과 7.74억 개의 매개변수를 가진 모델을 공개했다. 그들은 공개된 모델을 테스트한 결과, “각 반복마다 이전 반복보다显著한 개선이 나타났다”고 말했다.

악의적 사용을 방지하기 위해 OpenAI는 “사전적으로 악의적 사용을 방지하기 위해” GPT-2 탐지 모델을 공개했다. 그러나 그들은 블로그 게시물에서 이러한 탐지 모델이 아직 GPT-2 자체에서 달성한 품질 수준에 도달하기 위해 추가 작업이 필요하다고 인정했다.

관심 있는 사람들은 GPT-2 모델을 여기에서 Github에서 다운로드할 수 있으며, 모델 카드를 여기에서 확인할 수 있으며, OpenAI의 블로그 게시물은 여기에서 읽을 수 있다.

전 외교관 및 UN 번역가, 현재 프리랜서 저널리스트/작가/연구자, 현대 기술, 인공지능, 현대 문화에 초점을 맞추고 있습니다.