인허가 정보, 인구 통계, 상권 자료 같은 공공 데이터는 대부분 무료로 열려 있습니다. 그래서 이걸로 분석 서비스를 만들 수 있냐는 문의를 종종 받습니다. 만들 수 있습니다. 다만 자료를 그대로 믿고 쓰면 대개 틀립니다.
자료마다 갱신 주기가 다릅니다. 어떤 건 매달, 어떤 건 분기, 어떤 건 일 년에 한 번입니다. 이걸 섞어서 하나의 결론을 내면 서로 다른 시점의 이야기가 합쳐집니다. 작년 인구에 이번 달 점포 수를 나누면 나오는 숫자는 아무 의미가 없습니다.
그래서 화면에는 계산 결과만 보여주지 않고 그 자료가 언제 기준인지를 같이 적습니다. 사용자가 판단할 때 필요한 정보라서 그렇습니다.
같은 업종이라도 자료마다 분류가 다릅니다. 인허가 자료의 업종과 통계 자료의 업종이 일대일로 맞지 않는 경우가 흔합니다. 면적도 신고 면적과 실제 영업 면적이 다를 수 있습니다.
이런 걸 무시하고 합치면 그럴듯한 숫자가 나오는데, 그 숫자가 무엇을 센 건지 설명할 수 없게 됩니다. 설명할 수 없는 숫자는 쓸 수 없습니다.
분석 서비스에서 중요한 건 결론을 내주는 게 아니라, 그 결론의 근거를 볼 수 있게 하는 것입니다.
공공 데이터에는 누락이 있습니다. 폐업 신고가 늦게 들어오거나, 아예 등록되지 않은 곳도 있습니다. 그래서 "이 반경에 같은 업종 19곳"이라는 숫자는 정확한 값이 아니라 확인된 값입니다.
저희는 이걸 화면에 그대로 적습니다. 인허가 기준 영업 중 점포 수이고, 언제 수집한 자료이며, 개인 매장이 포함되는지까지 표시합니다. 숫자만 크게 보여주는 것보다 신뢰를 얻는 방법입니다.
요즘은 이런 자료를 정리해서 AI에게 해석을 맡기는 경우가 많습니다. 유용합니다. 다만 점수를 매기게 하거나 단정적인 결론을 내게 하면 곤란합니다. 근거 없이 그럴듯한 문장이 나오고, 사용자는 그걸 사실로 받아들입니다.
저희는 AI에게 방향만 제시하게 하고 수치는 그 옆에 그대로 펼쳐 둡니다. 해석은 사용자가 하도록 두는 편이 정직하고, 결과적으로 더 오래 쓰이는 서비스가 됩니다.