AI 모델 및 플랫폼
오픈AI의 ChatGPT, 대학 회계 시험에 도전하다
오픈AI는 최근 그라운드브레이킹 AI 채팅봇 GPT-4를 출시했으며, 다양한 분야에서 큰 영향을 미치고 있습니다. 90번째 백분위 수준의 바 시험 점수, 13개 중 15개의 AP 시험 통과, GRE 언어 시험에서 거의 완벽한 점수를 얻은 GPT-4의 성과는 단순히卓越했다고 할 수 있습니다.
브리검 영 대학교(BYU)와 186개 대학의 연구자들은 오픈AI 기술이 회계 시험에서 어떻게 수행할지 궁금해했습니다. 그들은 원래 버전인 ChatGPT를 테스트했으며, 아직 회계 분야에서 개선할 여지가 있지만, 교육을 제공하고 받는 방식을 긍정적으로 변화시키는 게임 체인저라는 것을 발견했습니다.
2022년 11월 데뷔 이후 ChatGPT는 2개월 만에 1억 명의 사용자를 기록하며 가장 빠르게 성장하는 기술 플랫폼이 되었습니다. ChatGPT와 같은 AI 모델의 교육에서의 역할에 대한 논의가 계속되는 가운데, 연구의 주도자이자 BYU 회계 교수인 데이비드 우드(David Wood)는 가능한 한 많은 교수들을 모집하여 AI의 성과를 실제 대학 회계 학생들과 비교하기로 결정했습니다.
ChatGPT vs. 학생들: 회계 시험
이 연구에는 14개국 186개 교육 기관의 327명의 공동 저자가 참여했으며, 25,181개의 교실 회계 시험 문제를 기여했습니다. BYU 학부생들도 2,268개의 교과서 테스트 뱅크 문제를 제공했습니다. 문제는 회계 정보 시스템(AIS), 감사, 재무 회계, 관리 회계, 세무 등 다양한 회계 하위 분야를 다루었으며, 어려움과 유형도 다양했습니다.
ChatGPT의 성과는 인상적이었습니다. 그러나 학생들이 평균 76.7%의 점수를 얻은 반면 ChatGPT는 47.4%의 점수를 얻었습니다. 11.3%의 질문에서 ChatGPT는 학생 평균보다 높은 점수를 얻었으며, 특히 AIS와 감사에서优秀했습니다. 그러나 세무, 재무, 관리 평가에서 어려움을 겪었으며, 이는 수학적 과정에서 어려움을 겪었기 때문일 수 있습니다.
ChatGPT는 真/거짓 질문(68.7% 정답)과 다중 선택 질문(59.5%)에서 더 좋은 성과를 보였지만, 짧은 답변 질문(28.7%~39.1%)에서 어려움을 겪었습니다. 일반적으로 고차원 질문에서 어려움을 겪었으며, 때때로 잘못된 답변에 대한 권위적인 글을 제공하거나 같은 질문에 다른 방식으로 답변했습니다.
ChatGPT의 교육 미래
그의 한계에도 불구하고, 연구자들은 GPT-4가 회계 질문에서 개선될 것이라고 예상합니다. 가장 유망한 측면은 채팅봇이 교육과 학습을 강화하는 잠재력을 가지고 있다는 것입니다. 예를 들어, 과제를 설계하고 테스트하거나 프로젝트의 일부를 작성하는 데 도움이 될 수 있습니다.
“이것은 변화의 시기입니다. 우리는 어디로 가야 하는지 평가해야 합니다.”라고 연구의 공동 저자이자 BYU 회계 교수인 멜리사 라슨(Melissa Larson)은 말했습니다. “물론, 나는 여전히 조교를 둘 것입니다. 그러나 이것은 우리가 다른 방식으로 사용하도록 강요할 것입니다.”
AI가 계속 발전함에 따라, 교육자들은 적응하고 새로운 방법으로 이러한 기술을 교육 방법에 통합해야 합니다.












