공공데이터 활용

파일데이터 오픈API 표준

Openly Data 2026. 9. 7. 12:05

공공데이터포털에서 '도서관'을 검색하면 결과가 수백 건 나옵니다. 그런데 목록을 보면 같은 도서관 정보인데도 어떤 것은 파일이고 어떤 것은 API이며, 어떤 것은 '표준데이터'라는 딱지가 붙어 있습니다.

셋 중 무엇을 받아야 하는지는 데이터의 내용이 아니라 제공 방식이 정합니다. 그리고 이 셋은 목적이 서로 다릅니다.

주소부터 다릅니다

상세 페이지의 주소 끝을 보면 유형이 바로 갈립니다. 파일 데이터는 fileData.do, 오픈API는 openapi.do, 표준데이터는 standard.do로 끝납니다.

사소해 보이지만 실제로 쓸모가 있습니다. 검색 결과 목록에서 링크를 눌러보기 전에 어느 유형인지 알 수 있고, 나중에 주소만 저장해 뒀을 때도 무엇이었는지 구분됩니다.

셋의 성격

구분 파일 데이터 오픈API 표준데이터
받는 방법 바로 내려받기 활용신청 후 호출 내려받기 · API 둘 다
인증키 필요 없음 필요함 API로 쓸 때만
시점 올린 시점의 스냅샷 호출한 시점 기관별 갱신 시점
범위 한 기관 한 기관 여러 기관을 합침

마지막 줄이 표준데이터의 정체입니다.

표준데이터가 하는 일

전국 지자체가 각자 도서관 정보를 공개한다고 해 봅시다. 어떤 곳은 '휴관일', 어떤 곳은 '휴무일', 또 어떤 곳은 '정기휴관'이라고 항목 이름을 붙입니다. 시간 표기도 09:00~18:00과 오전 9시부터 오후 6시가 섞입니다.

이걸 그대로 두면 전국 도서관을 한 표로 만들려는 사람은 지자체 수만큼 변환 규칙을 짜야 합니다. 그래서 어떤 항목을 어떤 이름과 형식으로 제공할지를 미리 정해두고, 기관들이 그 틀에 맞춰 올리게 한 것이 표준데이터입니다.

제공 항목, 속성 정보, 제공 형식이 개방표준으로 정해져 있어서, 지역이 달라도 같은 열 이름으로 받습니다. 전국 단위로 뭔가를 만들 계획이라면 표준데이터가 있는지부터 찾아보는 편이 시간을 아낍니다.

같은 표준데이터인데 안이 다릅니다

다만 '표준데이터'라는 딱지가 붙었다고 성격까지 같지는 않습니다. 상세 화면에는 제공기관 수라는 항목이 있는데, 이 숫자 하나로 데이터의 성격이 갈립니다. 2026년 8월 30일에 네 개를 열어 적어 봤습니다.

표준데이터 제공기관 수 항목 수 주기 표기
전국공공시설개방정보 251곳 27개 분기
전국주차장정보 250곳 33개 반기
전국도시공원정보 233곳 16개 연간
전국초중등학교위치 1곳 17개 수시

앞의 셋은 지자체가 각자 자기 몫을 올리는 구조입니다. 항목 이름은 맞춰져 있지만 값을 채우는 손은 250개쯤 됩니다. 그래서 표준데이터인데도 자유 텍스트 항목의 표기가 갈리고, 어떤 지자체는 최근에 올렸는데 옆 지자체는 몇 분기째 그대로인 상황이 한 파일 안에 섞입니다.

마지막 것은 한 기관이 전국을 취합해 올립니다. 표기는 고르지만 그 기관의 사정에 전체가 묶입니다. 한쪽이 낫다기보다 결함이 나타나는 방식이 다릅니다. 앞쪽은 지역별로 들쭉날쭉하고, 뒤쪽은 전체가 한꺼번에 낡습니다.

내려받기 전에 이 숫자를 한 번 보면, 나중에 어떤 종류의 문제를 만날지 미리 짐작할 수 있습니다.

표준데이터와 표준용어는 다릅니다

이름이 비슷해 자주 섞이는 개념이 하나 더 있습니다. 공공데이터 공통표준용어입니다.

표준데이터가 '어떤 데이터셋을 어떤 항목 구성으로 개방할까'의 문제라면, 공통표준용어는 '항목 이름을 어떤 단어로 지을까'의 문제입니다. 층이 한 단계 아래입니다.

공통표준용어는 공통표준단어와 공통표준도메인의 조합으로 만들어집니다. 단어는 업무에서 쓰는 최소 단위의 명사이고, 도메인은 그 값이 어떤 형식인지를 정의합니다. 둘을 조합해 용어 이름이 나오고 데이터 형식이 따라붙습니다. 공공기관이 데이터베이스를 새로 만들 때 준용하도록 되어 있습니다.

정리하면 이렇게 됩니다. 표준용어는 기관 안에서 데이터를 쌓을 때 쓰는 규칙이고, 표준데이터는 그렇게 쌓인 것을 밖으로 낼 때 쓰는 규칙입니다.

근거가 옮겨 다닌 이력

공통표준용어를 찾다 보면 문서가 여러 개 나와 헷갈립니다. 이력이 있기 때문입니다.

공통표준용어는 한때 별도의 행정안전부 고시로 있었습니다. 그 뒤 이 고시는 폐지되고 공공기관의 데이터베이스 표준화 지침으로 통합됐습니다. 그래서 지금 검색하면 폐지된 옛 고시 문서와 현행 지침이 함께 나옵니다.

실무에서 봐야 할 것은 현행 지침이고, 그 위에는 공공데이터법이 둔 표준화 조항이 있습니다. 옛 고시 번호가 적힌 문서를 인용하면 폐지된 것을 근거로 대는 셈이 됩니다.

국가중점데이터라는 딱지

목록에서 또 하나 보이는 표시입니다. 이것은 제공 방식이 아니라 선정된 등급에 가깝습니다.

국민과 기업의 수요가 크고 개방이 시급한 분야를 골라, 민간이 바로 쓸 수 있게 정제하고 가공해 내놓은 것입니다. 그래서 같은 주제라도 국가중점데이터로 개방된 쪽이 항목이 정돈되어 있고 품질 관리가 더 들어가 있는 경우가 많습니다.

다만 이것도 절대적인 보증은 아닙니다. 정제의 기준은 개방 시점의 것이고, 그 뒤 갱신은 다시 제공 기관의 사정을 따릅니다.

무엇을 언제 고를까

목적에 따라 답이 정해집니다.

한 번 분석하고 끝날 일이라면 파일 데이터입니다. 인증키도 활용신청도 필요 없고, 받아서 바로 엽니다. 개발 없이 표 계산 프로그램으로 처리할 계획이라면 더욱 그렇습니다.

서비스에 계속 물릴 것이라면 오픈API입니다. 대신 활용 기간과 호출 한도를 관리해야 하고, 응답 구조가 기관마다 달라 처음 붙일 때 손이 갑니다.

전국을 한 판에 놓을 것이라면 표준데이터입니다. 항목이 통일돼 있어 지역별 파일을 합치는 작업이 사라집니다.

세 유형이 다 있는 주제라면 표준데이터를 먼저 열어보고, 필요한 항목이 거기 없을 때 개별 기관의 파일이나 API로 내려가는 순서가 대체로 효율적입니다.

표준이라는 말에 기대하지 않기

항목 이름이 맞춰져 있어도 값의 형식까지 고르게 정리돼 있지는 않습니다. 파일을 열었을 때 실제로 걸리는 것들은 따로 모아 두었습니다.

여기까지 읽으면 표준데이터를 받으면 모든 게 정돈돼 있을 것 같지만, 실제로 열어보면 그렇지 않은 부분이 남아 있습니다.

항목 이름은 통일돼 있어도 그 칸에 무엇을 넣을지는 기관 담당자가 판단합니다. 같은 '휴관일' 칸에 어떤 기관은 매주 월요일, 어떤 기관은 월요일, 법정공휴일, 어떤 기관은 빈칸을 둡니다. 형식은 맞지만 내용의 결이 다릅니다.

갱신 시점도 기관마다 제각각입니다. 표준데이터는 여러 기관의 것을 모아 놓은 것이므로, 한 파일 안에 지난달에 갱신된 행과 재작년에 갱신된 행이 함께 들어 있습니다. 전체를 하나의 시점으로 다루면 어긋납니다.

그래서 표준데이터가 보장하는 것은 열의 구조까지입니다. 값의 품질과 최신성은 여전히 개별 기관의 몫이고, 쓰는 쪽에서 확인해야 하는 영역으로 남습니다. 이 선을 알고 쓰면 표준데이터는 충분히 편리한 출발점입니다.


세 유형의 구분과 개방표준의 내용은 공공데이터포털(data.go.kr)의 데이터 상세 화면과 포털 소개를 따라가며 2026년 9월에 확인했습니다. 공통표준용어의 구성과 준용 의무, 옛 고시가 공공기관의 데이터베이스 표준화 지침으로 통합된 이력은 행정안전부가 공개한 고시 안내와 현행 지침에서 확인한 것입니다.
포털은 개편이 잦아 화면 구성과 메뉴 이름이 달라집니다. 주소 끝의 fileData·openapi·standard 구분은 그중 비교적 오래 유지되어 온 표시입니다.

'공공데이터 활용' 카테고리의 다른 글

공공데이터 오류신고  (0) 2026.08.21
공공데이터 파이썬 수집  (1) 2026.08.12
공공데이터 갱신 주기  (0) 2026.08.11
공공데이터 5가지 함정  (0) 2026.08.09
공공데이터포털 API 발급  (0) 2026.08.07