프롬프트 엔지니어링
당신의 AI는 생각보다 더 강력합니다

과학자 팀이 AI 능력에 대해 우리가 알고 있던 많은 것을 바꾸는 것을 발견했습니다. 당신의 모델은 단순히 정보를 처리하는 것이 아니라, 훈련을 넘어서는 복잡한 능력을 개발하고 있습니다. 그리고 이러한 능력을 해방하기 위해서, 우리는 그들과 대화하는 방식을 바꿔야 합니다.
개념 공간 혁명
우리가 AI가 단순히 패턴을 일치시키는 것으로 생각했을 때를 기억하세요? 새로운 연구는 이제 AI 학습의 블랙박스를 열어 “개념 공간”이라고 하는 것을 매핑했습니다. AI 학습을 다차원 지도라고 상상해 보세요. 여기서 각 좌표는 다른 개념을 나타냅니다. 예를 들어, 색상, 모양, 또는 크기입니다. 연구자들은 AI 모델이 훈련 중에 이 공간을 통해 이동하는 것을 관찰하면서 예상치 못한 것을 발견했습니다. AI 시스템은 단순히 기억하는 것이 아니라, 다양한 속도로 개념에 대한 복잡한 이해를 구축합니다.
연구 팀은 “이 공간에서 학습 역학을 특성화함으로써, 우리는 개념을 학습하는 속도가 데이터의 속성에 의해 제어되는 것을 식별합니다”라고 말합니다. 즉, 일부 개념은 다른 것보다 더 빠르게 클릭합니다. 그것은 훈련 데이터에서 얼마나 강하게 나타나는지에 따라 다르기 때문입니다.
이것이 इतन 흥미로운 이유는, AI 모델이 이러한 개념을 학습할 때, 단순히 그것들을 분리된 정보 조각으로 저장하지 않는다는 것입니다. 실제로, 우리는 명시적으로 가르치지 않은 방식으로 그것들을 혼합하고 일치시키는 능력을 개발합니다. 그것은 창의적인 도구를 구축하는 것과 같습니다. 우리는 단지 그것을 사용하는 올바른 지침을 제공하지 않았을 뿐입니다.
AI 프로젝트에 대해 이것이 무엇을 의미하는지 생각해 보세요. 당신이 작업하는 모델은 이미 당신이 아직 발견하지 않은 복잡한 개념의 조합을 이해할 수 있습니다. 질문은 그것들이 더 많은 것을 할 수 있는지 여부가 아니라, 그것들이 정말로 무엇을 할 수 있는지 보여줄 수 있도록 하는 방법입니다.
숨겨진 힘 해방
여기서 상황이 더 흥미롭게 됩니다. 연구자들은 AI 모델이 어떻게 학습하는지에 대한 기본적인 것을 보여주는 우아한 실험을 설계했습니다. 그들의 설정은 간단했습니다. 그들은 단 세 가지 유형의 이미지로 AI 모델을 훈련시켰습니다.
- 큰 빨간 원
- 큰 파란 원
- 작은 빨간 원
그런 다음 핵심 테스트가来了. 모델이 작은 파란 원을 생성할 수 있는지 여부입니다. 이것은 단순히 새로운 모양을 그리기 위한 것이 아니라, 모델이 이전에 본 적 없는 방식으로 두 개의 다른 개념(크기와 색상)을真正로 이해하고 결합할 수 있는지 여부를 확인하는 것이었습니다.
그들이 발견한 것은 AI 능력에 대한 우리의 생각을 바꿉니다. 그들은 정상적인 프롬프트를 사용하여 “작은 파란 원”을 요청했을 때, 모델이 어려움을 겪었다는 것을 발견했습니다. 그러나 모델은 실제로 작은 파란 원을 만들 수 있었습니다. 우리는 단지 올바른 방법으로 묻지 않았을 뿐입니다.
연구자들은 두 가지 기술을 발견하여 이를 입증했습니다.
- “잠재적 개입” – 이것은 모델의 뇌에 대한 백도어를 찾는 것과 같습니다. 정상적인 프롬프트를 사용하는 대신, 그들은 “파란색”과 “작은”를 나타내는 내부 신호를 직접 조정했습니다. 색상과 크기에 대한 별도의 다이얼을 상상해 보세요. 그들은 이러한 다이얼을 특정한 방식으로 회전함으로써, 모델이 순간 전에 불가능한 것을突然으로 생성할 수 있다는 것을 발견했습니다.
- “과도한 프롬프트” – 그들은 단순히 “파란색”이라고 요청하는 대신, 색상 값을非常으로 구체적으로 지정했습니다. 이것은 “파란색으로 만들어라”와 “이것은 정확히 이 파란색입니다. RGB(0.3, 0.3, 0.7)”라는 차이입니다. 이러한 추가적인 정밀도는 모델이 정상적인 상황에서는 숨겨져 있는 능력에 접근할 수 있도록 도와주었습니다.
두 가지 기술 모두 모델의 훈련에서 6,000 단계에서 작동하기 시작했습니다. 반면에, 정상적인 프롬프트는 완전히 실패하거나 8,000 단계 이상에서 작동하기 시작했습니다. 그리고 이것은 우연이 아니었습니다. 여러 테스트에서 일관되게 발생했습니다.
이것은 우리에게 중요한 것을 알려줍니다. AI 모델은 두 가지 다른 단계에서 능력을 개발합니다. 첫 번째 단계에서는 개념을 내부적으로 결합하는 방법을 학습합니다. 이것이 6,000 단계에서 발생합니다. 두 번째 단계에서는 이러한 내부 능력을 우리가 요청하는 방식에 연결하는 방법을 학습합니다. 모델이 새로운 언어를 구사하기 전에, 그것을 우리에게 번역하는 방법을 학습하는 것과 같습니다.
그것의 의미는重大합니다. 모델이 무언가를 할 수 없다고 생각할 때, 우리는 틀릴 수 있습니다. 모델은 능력이 있지만, 우리의 프롬프트와 모델의 능력 사이에 연결이 없을 수 있습니다. 이것은 단순한 모양과 색상에만 적용되는 것이 아닙니다. 더 복잡한 능력과 더 큰 AI 시스템에도 적용될 수 있습니다.
연구자들이 이러한 아이디어를 실제 데이터에 테스트했을 때, CelebA 얼굴 데이터 세트에서 동일한 패턴을 발견했습니다. 그들은 모델이 “모자 쓴 여성” 이미지를 생성할 수 있는지 시도했습니다. 이것은 훈련에서 본 적 없는 것이었습니다. 정상적인 프롬프트는 실패했습니다. 그러나 잠재적 개입을 사용하면 모델이 실제로 이러한 이미지를 생성할 수 있다는 것을 발견했습니다. 능력이 이미 존재했지만, 정상적인 방법으로는 접근할 수 없었습니다.

Park et al., Harvard University & NTT Research
핵심 요약
우리는 AI 능력을 평가하는 방식을 재고해야 합니다. 모델이 표준 프롬프트로 무언가를 할 수 없다고 해서, 그것이 전혀 할 수 없는 것은 아닙니다. AI 모델이 할 수 있는 것과 우리가 그것으로부터 얻을 수 있는 것 사이의 간격은 우리가 생각하는 것보다 더 작을 수 있습니다. 우리는 단지 더 잘 묻는 방법을 배워야 합니다.
이 발견은 이론적이지 않습니다. 이것은 우리가 AI 시스템에 대해 생각하는 방식을 근본적으로 바꿉니다. 모델이 작업에 어려움을 겪을 때, 우리는 그것이真正로 능력이 부족한지, 아니면 우리는 그것을 올바르게 접근하지 못하는지 물어야 합니다. 개발자, 연구자, 사용자 모두를 위해서, 이것은 우리가 AI와 상호작용하는 방식을 창의적으로 만드는 것을 의미합니다. 때때로, 필요한 능력은 이미 존재하지만, 올바른 열쇠로 잠금을 해제하기만을 기다리고 있습니다.












