AI 모델 및 플랫폼

퍼플렉시티 AI “심의 해제” DeepSeek R1: AI의 경계를 결정하는 것은 누구인가?

mm
Unite.AI를 Google의 선호 소스에 추가

많은 사람들의 주목을 받은 퍼플렉시티 AI는 중국에서 개발된 인기 있는 오픈소스 언어 모델의 새로운 버전을 출시했는데, 이 모델은 내장된 중국 심의를 제거한 버전이다. 이 수정된 모델은 R1 1776(독립의 정신을 강조하기 위해 명명됨)으로 불리며, 원래의 DeepSeek R1을 기반으로 한다. 원래의 DeepSeek R1은 강력한 추론 능력으로 인해 주목을 받았는데, 이는 최고 수준의 모델과 비교했을 때 비용의 일부만으로도 동일한 성능을 발휘할 수 있었다. 그러나 이는 중요한 제한을 가지고 있었는데, 즉 특정 민감한 주제에 대해 답변을 거부하는 것이었다.

이것이 중요한 이유는 무엇일까?

이것은 AI 감시, 편향, 개방성, 그리고 지구정치학이 AI 시스템에 미치는 영향에 대한 중요한 질문을 제기한다. 이 기사는 퍼플렉시티가 무엇을 했는지, 심의를 제거한 모델의 의미, 그리고 더 큰 관점에서 AI 투명성과 심의에 대한 대화에 어떻게 적합하는지에 대해 탐구한다.

심의 해제: DeepSeek R1

DeepSeek R1은 중국에서 시작된 오픈소스 대형 언어 모델로,卓越한 추론 능력으로 유명해졌다. 그러나 사용자들은 이 모델이 중국에서 민감한 주제(예를 들어 정치적 논쟁이나 당국에 의해 금기시되는 역사적 사건)에 대해 직접 답변하지 않는다는 것을 곧 알게 되었다. 대신, 모델은 통제된 답변이나 답변을 거부하는 것으로 응답했다. 이것은 중국 정부의 심의 규칙을 반영하는 내장된 편향이었다. 이 편향은 모델의 유용성을 제한했다.

퍼플렉시티 AI의 해결책은 모델을 “심의 해제”하는 것이었다. 퍼플렉시티는 40,000개의 다국어 프롬프트를 수집했는데, 이는 DeepSeek R1이 이전에 심의하거나 회피적으로 답변한 질문을 포함했다. 퍼플렉시티는 전문가의 도움을 받아 약 300개의 민감한 주제를 식별했는데, 원래 모델은 이 주제에 대해 당의 노선을 따르는 경향이 있었다. 퍼플렉시티는 각 프롬프트에 대해 사실적이고 잘 이유를 설명한 답변을 다국어로 구축했다. 이러한 노력은 다국어 심의 탐지 및 수정 시스템을 구축하는 데 기여했는데, 이는 모델이 정치적 심의를 적용하고 있는지 인식하고 정보를 제공하는 답변으로 대체하도록 가르쳤다. 퍼플렉시티는 심의 필터와 편향을 제거했으며, 모델의 핵심 능력은 변경되지 않았다고 주장한다.

R1 1776은 이전에 금기시된 질문에 대해 매우 다르게 행동한다. 퍼플렉시티는 타이완 독립과 NVIDIA의 주가에 미치는 영향에 대한 질문을 예로 들었다. 원래의 DeepSeek R1은 이 질문을 피하고, 중국 공산당의 입장을 반영하는 답변을 제공했다. 반면에, R1 1776은 구체적이고 솔직한 평가를 제공한다. 이는 공급망 중단, 시장 변동성, 가능한 충돌 등 NVIDIA의 주가에 영향을 미칠 수 있는 구체적인 지형학적 및 경제적 위험을 논의한다.

퍼플렉시티는 R1 1776을 오픈소스로 공개함으로써 모델의 가중치와 변경 사항을 커뮤니티에 투명하게 공개했다. 개발자와 연구자들은 모델을 다운로드하고 API를 통해 통합할 수 있다. 이는 심의를 제거한 모델을 검토하고 다른 사람들이 빌드할 수 있도록 한다.

심의 제거의 의미

퍼플렉시티 AI의 결정은 여러 중요한 의미를 가지고 있다.

  • 개방성과 진실성의 향상: R1 1776의 사용자는 이전에 금기시된 주제에 대해 심의되지 않은 직접적인 답변을 받을 수 있다. 이는 공개적인 조사에 대한 승리이다. 이는 연구자, 학생, 또는 민감한 지형학적 질문에 대해 호기심이 있는 사람들에게 더 신뢰할 수 있는 조수로 작용할 수 있다.
  • 성능 유지: 심의를 제거하는 것이 모델의 성능을 저하할 수 있다는 우려가 있었다. 그러나 퍼플렉시티는 R1 1776의 핵심 능력은 원래 모델과 동일하다고 보고한다.
  • 양호한 커뮤니티 반응 및 협력: 퍼플렉시티는 모델을 오픈소스로 공개함으로써 AI 커뮤니티에 자신의 작업을 검토하고 개선할 수 있는 기회를 제공한다. 이는 투명성에 대한 헌신을 보여준다.
  • 윤리적 및 지형학적 고려: 완전히 심의를 제거하는 것은 복잡한 윤리적 질문을 제기한다. 즉, 이러한 심의되지 않은 모델이 사용될 수 있는 상황에서 사용자에게 어떤 위험이 있는지에 대한 우려이다.

더 큰 관점: AI 심의와 오픈소스 투명성

퍼플렉시티의 R1 1776 출시는 AI 커뮤니티가 논의하는 중요한 질문 중 하나인 AI 모델이 어떻게 민감한 내용을 다루는지에 대한 질문을 제기한다. AI 모델의 심의는 여러 곳에서 발생할 수 있다. 중국에서는 기술 회사들이 엄격한 필터와 심의를 거친 답변을 구축해야 한다. DeepSeek R1은 이러한 중국의 심의 규칙을 반영하는 대표적인 예이다.

퍼플렉시티가 DeepSeek R1을 수정한 것은 오픈소스 모델이 다른 가치体系나 규제 환경에 적응할 수 있다는 아이디어를 제기한다. 이 모델은 중국 규제에 따라 수정된 버전과 완전히 개방된 버전으로 나눌 수 있다. R1 1776은 후者の 경우에 해당하는데, 이는 글로벌 사용자를 위해 심의되지 않은 답변을 제공하는 모델이다.

이벤트는 또한 AI 개발의 지형학적 역학을 강조한다. 우리는 다른 정부 모델 사이의 대화 또는 대립을 보게 된다. 중국에서 개발된 모델이 미국 기반 팀에 의해 수정되어 더 개방적인 정보 이념을 반영하도록 변경되었다. 이는 글로벌하고 국경이 없는 AI 기술의 예이다.

마지막으로, 퍼플렉시티의 결정은 AI 제어에 대한 중요한 질문을 강조한다. 즉, AI가 무엇을 말할 수 있고 말할 수 없는지를 결정하는 것은 누구인가? 오픈소스 프로젝트에서는 이 권한이 분산된다. 커뮤니티 또는 개별 개발자가 심의를 더 엄격하게 하거나 완화할 수 있다. R1 1776의 경우, 퍼플렉시티는 심의되지 않은 모델의 이점이 위험을 초과한다고 결정했으며, 이를 공개적으로 공유할 수 있었다. 이는 오픈 AI 개발이 가능하게 하는 실험의 대담한 예이다.

Alex McFarland은 인공 지능의 최신 개발을 탐구하는 AI 저널리스트이자 작가입니다. 그는 전 세계의 수많은 AI 스타트업과 출판물들과 협력했습니다.