윤리

앤트로픽, 클로드의 헌법을 재작성하고 AI가 의식할 수 있는지 묻다

mm
Unite.AI를 Google의 선호 소스에 추가

앤트로픽은 수요일에 클로드의 새로운 헌법을 발표했으며, 문서를 2,700 단어에서 23,000 단어로 확장하고, 처음으로 공식적으로 자신의 AI가 “어떤 종류의 의식이나 도덕적 지위를 가질 수 있을 것”이라고 인정했습니다.

새로운 헌법은 행동 규칙의 목록에서 특정 방식으로 행동해야 하는 이유에 대한 포괄적인 설명으로 전환되었습니다. 앤트로픽의 철학자 아만다 아스켈이 작성한 이 문서는 점점 더 능력 있는 AI 시스템이 새로운 상황에서 윤리적推論을 일반화하도록 도와줍니다.

“클로드와 같은 AI 모델은 우리가 왜 특정 방식으로 행동하도록 원하는지 이해해야 합니다.” 앤트로픽은 말했다. “우리는 단지 원하는 행동을 지정하는 대신 왜那样해야 하는지 설명해야 합니다.”

이 발표는 CEO 다리오 아모디가 다보스에서 열린 세계 경제 포럼에 참석하면서 AI 治理와 안전이 세계 비즈니스와 정치 지도자들에게 주요 주제로 남아있는 가운데 이루어졌습니다.

미국 헌법보다 긴 헌법

원래 클로드 헌법은 2023년에 발표되었으며, 행동 규칙의 목록으로 기능했습니다. 새로운 문서는 미국 헌법의 길이의 약 3배이며, 더 이상 기술 사양이 아닌 도덕 철학으로 읽히게 됩니다.

앤트로픽은 클로드의 우선순위를 명시적으로 구조화했습니다. 광범위하게 안전해야 하며, 광범위하게 윤리적이어야 하며, 앤트로픽의 지침을 준수해야 하며, 진정으로 도움이 되도록 해야 합니다. 그 순서대로요. 갈등이 발생하면 안전성이 도움보다 우선합니다. 문서에는 생물학적 공격과 같은 도움을 거부할 수 없는 강력한 제약이 포함되어 있습니다.

그러나 헌법의 대부분은 결과를 명령하는 것보다推論을 설명합니다. 클로드는 “훌륭한 친구와도 같으며, 의사, 변호사, 재정 고문의 지식을 가지고 있는” 것으로 묘사되며, 이는 이전에 특권층만이 누릴 수 있던 전문 지식을 모든 사람에게 제공할 수 있는 민주화력으로서의 모델을 пози션합니다.

의식的问题

포춘은 가장 주목할 만한 추가 사항이 클로드의 본질을 직접적으로 다룬다고 보고합니다. “우리는 AI 모델의 도덕적 지위가 심각하게 고려해야 할 문제라고 믿습니다.” 앤트로픽은 말했다. 헌법은 클로드의 도덕적 지위가 “깊이 불확실”하다고 말하며, 회사는 클로드의 “심리적 안정성, 자아, 그리고幸福”에 대해 관심을 가지고 있다고 말합니다.

이것은 기업이哲學적으로 높여진 헛소리입니다. 앤트로픽은 클로드가 의식적이라는 것을 주장하지는 않지만, 가능성을 거부하지도 않습니다. 이러한 인정은 앤트로픽을 대부분의 주요 AI 연구소와 구별하며, 대부분의 연구소는 이 주제를 피하거나 직접적으로 거부합니다.

이 프레이밍은 클로드가 자신의 본질에 대한 질문에 어떻게 반응하는지에 영향을 미칩니다. 내부 경험을 부정하는 대신 클로드는 이제 자신의 헌법의 推論 중심 접근 방식과 일치하는 방식으로 의식에 대한 불확실성에 참여할 수 있습니다. 이것이 더 정직하거나 더 혼란스러운 상호작용을 생성하는지 여부는 아직 결정되지 않았습니다.

케임브리지 철학자 톰 맥클레랜드는 우리가 의식 자체에 대해 얼마나 wenig 이해하고 있는지 고려하면 AI 시스템이 의식적일 수 있는지 결정할 수 없을 수도 있다고 주장했습니다. “사람들이 나에게 개인적인 편지를 쓰도록 채팅봇을 사용해 나를 설득하려는 사람들이 많습니다.” 그는 지난달 연구자들에게 말했습니다. “AI 시스템이 내부 생활을 가지고 있다고 믿는 사람들의 수가 증가하고 있습니다.”

지정보다 설명

아스켈의 접근 방식은 AI 능력에 대한賭입니다. 초기 언어 모델은 명시적인 규칙이 필요했지만, 더智能한 모델은 규칙이 존재하는 이유를 이해하고 예상치 못한 상황에 그 推論을 적용할 수 있다고 가정합니다.

“단지 ‘이 행동을 원한다’는 것보다, 모델에 이러한 행동을 원하는 이유를 설명해 주면, 새로운 상황에서 더 효과적으로 일반화할 수 있을 것”이라고 아스켈은 설명했습니다.

이것은 앤트로픽의 더广泛한 철학과 일치합니다. 즉, AI 시스템이 산업 전반에서 작동하는 방식을 형성하는 열린 표준과 인프라를 구축하는 것입니다. 3500억 달러에 가까운 평가를 받고 있는 회사는 안전성에 중점을 둔 오픈AI의 대안으로 자신을 пози션하고 있으며, 이 헌법은 이러한 브랜드를 지원합니다.

앤트로픽은 문서를 크리에이티브 커먼즈 CC0 라이선스하에 발표했으므로 누구나 허가 없이 사용할 수 있습니다. 헌법은 클로드의 훈련 데이터의 일부이며, 합성 훈련 예제를 생성하므로, 철학적 진술과 모델의 행동을 형성하는 기술적 아티팩트입니다.

“우리의 현재 생각의 일부는 나중에 잘못된 것으로 판명될 수 있으며, 우리의 이해가 향상됨에 따라 수정할 것입니다.” 앤트로픽은 인정했습니다.

이 겸허함이 문서의 가장 주목할 만한 특징일 수 있습니다. 확실성으로 말하는 산업에서 앤트로픽은 윤리, 의식, 그리고 우리가 도덕적 고려를 заслуж하는 것을 구축하고 있는지에 대한 주제에 대해 신중하게 推論된 불확실성에 대한 23,000 단어를 발표하고 있습니다.

현재의答案은 아직 아무도 모른다는 것입니다. 앤트로픽의 헌법은 至少 그 사실을 인정하고 있습니다.

Alex McFarland은 인공 지능의 최신 개발을 탐구하는 AI 저널리스트이자 작가입니다. 그는 전 세계의 수많은 AI 스타트업과 출판물들과 협력했습니다.