AI가 짜준 엑셀 수식, 그대로 쓰기 전에 확인할 것
엑셀 함수·수식을 AI에 맡겨 짜는 일이 늘었습니다. 문법이 맞으면 그대로 실행되어 오류가 눈에 띄지 않습니다. 실제로 측정한 두 연구와, 붙여넣기 전 확인할 점을 정리합니다.
병원 행정 업무에는 매달 반복되는 집계·조회표 작업이 있습니다. 부서별 실적, 조건에 맞는 건수 세기, 여러 시트를 연결한 조회표 같은 것들입니다. 함수를 하나하나 짜는 대신 AI에게 “이런 조건으로 세는 수식을 만들어 줘”라고 물어보는 경우가 늘었습니다. 몇 초 만에 수식이 나오고, 그대로 복사해 붙이면 셀에 숫자가 뜹니다.
문제는 그 수식이 값을 틀리게 계산해도 아무 경고 없이 실행된다는 점입니다. 이 글은 AI가 표를 직접 계산할 때 정확도가 떨어지는 문제(이전 글에서 다룬 내용)와는 결이 다릅니다. 이번에는 AI가 계산을 대신하는 게 아니라 ‘계산하는 방법’인 수식 자체를 짜 주고, 사람이 그걸 그대로 실제 업무용 시트에 옮기는 경우를 다룹니다.
수식은 문법만 맞으면 조용히 실행됩니다
문장은 어색하면 눈에 걸립니다. 그런데 수식은 다릅니다. 조회 범위가 한 칸 어긋나거나, 조건 비교 기준이 살짝 다르거나, 상대참조로 짜야 할 자리에 절대참조가 들어가도 엑셀은 오류 없이 결과를 내놓습니다. 결과가 틀린 숫자일 뿐입니다. 자연스러운 문장은 의심하기 쉽지만, 그럴듯하게 앉아 있는 숫자 하나는 그냥 넘어가기 쉽습니다.
연구도 같은 격차를 보여줍니다
2024년 NeurIPS 학회에 스포트라이트 논문으로 뽑힌 SpreadsheetBench는 온라인 엑셀 포럼에 실제로 올라온 질문 912건을 모아 AI에 수식을 짜게 시킨 벤치마크입니다. 연구진은 여러 최신 언어모델을 한 번에 답하게 하거나 여러 차례 고쳐 가며 답하게 하는 두 방식으로 시험했는데, 두 방식 모두에서 “최신 모델과 사람(엑셀 전문가) 성능 사이에 뚜렷한 격차”가 있었다고 밝혔습니다(Ma 외, NeurIPS 2024).
더 이른 실험도 있습니다. 2023년 카디프메트로폴리탄대학교 연구자가 챗GPT에 자연어로 문제를 주고 수식을 만들게 한 실험에서는, 조건이 단순하고 정보가 충분할 때는 올바른 수식을 근거와 함께 만들어냈습니다. 그런데 정보가 부족하거나 문제가 복잡해지자 정확도와 추론 능력이 함께 무너졌고, 이 과정에서 “거짓 진술과 환각까지 나타났다”고 정리했습니다(Thorne, EuSpRIG 2023).
실무에서 확인할 것
정답을 아는 작은 표로 먼저 검증합니다. 실제 자료 대신 답을 이미 아는 몇 줄짜리 표를 만들어 수식을 걸어 보고, 나온 값이 손으로 계산한 값과 같은지 확인한 뒤에 실제 시트에 옮깁니다.
수식의 원리를 말로 설명해 달라고 요청합니다. “이 수식이 어떤 조건을 어떻게 비교하는지 한 줄로 설명해 줘”라고 물으면, 논리가 이상한 부분이 말로 드러날 때가 많습니다.
경계값을 따로 확인합니다. 빈칸, 0, 날짜가 딱 걸치는 경우처럼 애매한 값을 몇 개 넣어 수식이 그때도 맞게 동작하는지 봅니다.
다른 행·열로 복사했을 때도 맞는지 봅니다. 상대참조와 절대참조를 착각하면 복사한 순간부터 범위가 틀어집니다.
환자를 식별할 수 있는 실제 데이터는 AI에 붙여넣지 않습니다. 수식만 필요하다면 가상의 표로 질문을 만들어 물어봅니다. 표를 통째로 맡겨 계산 자체를 시킬 때의 정확도 문제는 AI에게 표를 주고 합계를 시킬 때에서 다뤘습니다.
핵심 요약
- 엑셀 수식은 문법이 맞으면 값이 틀려도 오류 없이 실행됩니다. 문장과 달리 틀린 결과가 눈에 잘 띄지 않습니다.
- 온라인 엑셀 포럼의 실제 질문 912건으로 만든 SpreadsheetBench(NeurIPS 2024)는 최신 AI 모델과 사람(엑셀 전문가) 성능 사이에 뚜렷한 격차가 있다고 밝혔습니다.
- 2023년 실험에서는 챗GPT가 단순한 문제는 잘 풀었지만, 정보가 부족하거나 복잡해지면 정확도가 무너지고 거짓 진술·환각까지 나타났습니다.
- 실무에서는 정답을 아는 작은 표로 먼저 검증하고, 수식 원리를 말로 설명받고, 경계값과 참조 방식(상대·절대)을 확인한 뒤 실제 시트에 옮기시기 바랍니다. 실제 데이터는 붙여넣지 않습니다.
출처: Ma et al., “SpreadsheetBench: Towards Challenging Real World Spreadsheet Manipulation”, NeurIPS 2024 (Spotlight) · Thorne, “Experimenting with ChatGPT for Spreadsheet Formula Generation: Evidence of Risk in AI Generated Spreadsheets”, EuSpRIG 2023
본 사이트의 콘텐츠는 일반적인 정보 제공과 연구·교육 목적이며, 특정 환자에 대한 의학적 진단이나 조언을 대신하지 않습니다.