Blind test · 회계 질의회신
AI vs Human
회계기준원에 실제로 들어온 회계 질의입니다. AI 두 모델이 같은 질문에 답했습니다. 누가 썼는지 가리고 더 나은 답을 고르세요. 다음 화면에서 기준원 회신과 맞춰 봅니다.
작동 방식
- 공개된 질의회신에서 과제를 무작위로 뽑습니다.
- AI 두 모델에 같은 프롬프트를 한 번씩 넣습니다. 어떤 모델인지는 결과 화면에서 밝힙니다.
- A·B로 가린 답에 투표한 뒤 기준원 회신과 맞춰 승자를 가립니다.
지난 과제 전적
룰
투표자가 가장 먼저 의심할 두 가지를 앞에 둡니다. 답을 골랐는가, 판정이 공정한가.
과제
- 과제는 회계기준원·금융감독원이 공개한 질의회신에서 뽑습니다.
- 후보 목록에서 무작위로 뽑고 뽑힌 순서를 공개합니다.
- 질의 현황에는 회사를 알 수 있는 정보를 넣지 않습니다.
AI 답변
- AI 두 모델에 같은 표준 프롬프트를 한 번 넣습니다. 어떤 모델인지는 결과 화면에서 밝힙니다.
- 첫 답을 그대로 올립니다. 다시 돌리거나 고르지 않습니다.
- 서식만 통일하고 내용은 고치지 않습니다. 원본 답은 화면 2에서 볼 수 있습니다.
- 웹 검색은 끄고 돌립니다.
투표
- 과제당 한 사람 한 표입니다.
- 투표하기 전에는 누가 쓴 답인지 공개하지 않습니다.
- 투표 결과는 승패에 들어가지 않습니다. 따로 집계해 투표 적중률로 보여 줍니다.
판정
- 기준은 기준원 회신의 결론입니다.
- 결론이 같으면 일치입니다. 결론은 같지만 조건·근거가 빠졌거나 틀리면 부분 일치입니다. 결론이 다르면 불일치입니다.
- 판정은 운영자가 하고 이유를 한 줄로 공개합니다.
- 판정에 이견이 있으면 정정 요청을 받습니다. 반영하면 고친 내역을 남깁니다.
고지
- Human 답은 회계기준원이 공개한 회신을 운영자가 요약한 것입니다. 원문 링크를 함께 둡니다.
- 내용은 회계자문이 아닌 참고자료입니다.
- Claude는 Anthropic, ChatGPT는 OpenAI의 상표입니다. 이 서비스는 두 회사와 관련이 없습니다.
FAQ
Human은 누구인가요?
회계기준원이 공개한 회신입니다. 운영자가 핵심만 요약하고 원문 링크를 붙입니다.
AI 답을 골라서 올리나요?
아닙니다. 같은 프롬프트로 한 번 돌린 첫 답을 올립니다. 서식만 맞춥니다.
답을 실제 회계처리에 써도 되나요?
참고용입니다. 원문 회신을 확인하고 감사인과 협의하세요.