Q질의회신 리그
Blind test · 회계 질의회신

AI vs Human

회계기준원에 실제로 들어온 회계 질의입니다. AI 두 모델이 같은 질문에 답했습니다. 누가 썼는지 가리고 더 나은 답을 고르세요. 다음 화면에서 기준원 회신과 맞춰 봅니다.

작동 방식

  1. 공개된 질의회신에서 과제를 무작위로 뽑습니다.
  2. AI 두 모델에 같은 프롬프트를 한 번씩 넣습니다. 어떤 모델인지는 결과 화면에서 밝힙니다.
  3. A·B로 가린 답에 투표한 뒤 기준원 회신과 맞춰 승자를 가립니다.

지난 과제 전적

룰

투표자가 가장 먼저 의심할 두 가지를 앞에 둡니다. 답을 골랐는가, 판정이 공정한가.

과제

  1. 과제는 회계기준원·금융감독원이 공개한 질의회신에서 뽑습니다.
  2. 후보 목록에서 무작위로 뽑고 뽑힌 순서를 공개합니다.
  3. 질의 현황에는 회사를 알 수 있는 정보를 넣지 않습니다.

AI 답변

  1. AI 두 모델에 같은 표준 프롬프트를 한 번 넣습니다. 어떤 모델인지는 결과 화면에서 밝힙니다.
  2. 첫 답을 그대로 올립니다. 다시 돌리거나 고르지 않습니다.
  3. 서식만 통일하고 내용은 고치지 않습니다. 원본 답은 화면 2에서 볼 수 있습니다.
  4. 웹 검색은 끄고 돌립니다.

투표

  1. 과제당 한 사람 한 표입니다.
  2. 투표하기 전에는 누가 쓴 답인지 공개하지 않습니다.
  3. 투표 결과는 승패에 들어가지 않습니다. 따로 집계해 투표 적중률로 보여 줍니다.

판정

  1. 기준은 기준원 회신의 결론입니다.
  2. 결론이 같으면 일치입니다. 결론은 같지만 조건·근거가 빠졌거나 틀리면 부분 일치입니다. 결론이 다르면 불일치입니다.
  3. 판정은 운영자가 하고 이유를 한 줄로 공개합니다.
  4. 판정에 이견이 있으면 정정 요청을 받습니다. 반영하면 고친 내역을 남깁니다.

고지

  • Human 답은 회계기준원이 공개한 회신을 운영자가 요약한 것입니다. 원문 링크를 함께 둡니다.
  • 내용은 회계자문이 아닌 참고자료입니다.
  • Claude는 Anthropic, ChatGPT는 OpenAI의 상표입니다. 이 서비스는 두 회사와 관련이 없습니다.

FAQ

Human은 누구인가요?

회계기준원이 공개한 회신입니다. 운영자가 핵심만 요약하고 원문 링크를 붙입니다.

AI 답을 골라서 올리나요?

아닙니다. 같은 프롬프트로 한 번 돌린 첫 답을 올립니다. 서식만 맞춥니다.

답을 실제 회계처리에 써도 되나요?

참고용입니다. 원문 회신을 확인하고 감사인과 협의하세요.