목록으로
지역사회 문제해결을 위한 AI 활용
서울 관광정보 3,788건을 AI로 세어봤더니, 말레이어 사용자는 76.7%를 못 읽고 있었습니다
"7개 언어 지원"이라는 공공 관광 API를 AI에게 직접 세어보게 했더니, 어떤 언어는 4분의 1만 채워져 있었습니다. 추측이 아니라 숫자로 확인한 지역 관광 정보의 빈칸입니다.
🤖 활용 AI 도구
Claude (Anthropic) — 공개 페이지 순회 집계, 어권별·분류별 커버리지 계산, 가설 검토
【① 어떤 상황에서 AI를 활용했나요?】
서울시 산하 기관이 운영하는 공공 관광 API 안내문에 "다국어 지원 - 7개 언어"라고 적혀 있었습니다. 한국어, 영어, 일본어, 중국어(간체·번체), 러시아어, 말레이어입니다.
저는 이 문장이 정확히 무슨 뜻인지 궁금했습니다. "7개 언어를 지원한다"는 게 정말 7개 언어로 다 채워져 있다는 뜻일까요?
보통 여기서 멈춥니다. 확인하려면 수천 건을 일일이 세어야 하니까요.
【② 어떤 AI를 어떻게 활용했나요?】
저는 AI에게 결론을 묻지 않았습니다. "세어보라"고 시켰습니다.
요청한 말 그대로:
"이 사이트의 공개된 조회 페이지에서 어권별·분류별 건수를
직접 집계해줘. 네 추측이나 일반론은 필요 없어.
화면에 찍힌 숫자만 가져와."
AI는 공개 검색 페이지에서 어권 필터와 분류 필터를 하나씩 걸어가며 표시되는 총 건수를 읽었습니다. 사람이 했으면 반나절 걸릴 일이 몇 분 만에 끝났습니다.
이 방식의 핵심은 "물어보기"가 아니라 "시키기"였습니다. "이 API 다국어 지원 잘 돼 있어?"라고 물었다면 AI는 그럴듯한 일반론을 답했을 겁니다. "세어서 표로 만들어"라고 시키니 숫자가 나왔습니다.
【③ 활용 결과 어떤 변화가 있었나요?】
총 3,788건을 집계한 결과입니다.
■ 어권별 실제 보유 콘텐츠
한국어 3,788건 100.0%
영어 3,763건 99.3%
일본어 3,546건 93.6%
중국어(간체) 3,535건 93.3%
중국어(번체) 3,509건 92.6%
러시아어 1,370건 36.2% <--
말레이어 881건 23.3% <--
■ 분류별 분포
음식 1,259건 33.2%
축제·공연·행사 1,194건 31.5%
문화관광 739건 19.5%
쇼핑 297건 7.8%
체험·역사·자연관광 282건 7.4%
숙박 17건 0.4% <--
말레이어를 쓰는 사람은 서울 관광 콘텐츠의 76.7%, 그러니까 2,907건을 볼 수 없습니다. 러시아어 사용자도 63.8%가 비어 있습니다. "7개 언어 지원"은 거짓이 아니지만, 사용자가 체감하는 것과는 거리가 있었습니다.
그리고 하나가 더 보였습니다. 숙박이 3,788건 중 17건입니다. 여행에서 숙소가 차지하는 비중을 생각하면 사실상 없는 것과 같습니다.
■ 여기서 한 걸음 더 - 번역만의 문제가 아니었습니다
말레이어권 여행자 상당수는 무슬림입니다. 저는 AI와 이 지점을 파고들었습니다.
전체 콘텐츠의 33.2%가 음식입니다. 가장 큰 분류입니다. 그런데 무슬림 여행자에게 음식 정보는 "읽을 수 있는가"보다 "먹을 수 있는가"가 먼저입니다. 할랄 여부, 돼지고기·주류 취급, 근처에 기도할 공간이 있는지. 이 정보가 없으면 1,259건의 음식 정보는 그 사람에게 번역이 되어 있어도 여전히 빈칸입니다.
즉 이 문제는 번역기를 붙여서 풀리지 않습니다. 없는 콘텐츠를 만들어야 하고, 그 언어권이 실제로 부딪히는 제약을 함께 붙여야 합니다.
【④ 나만의 방식 / 개선 포인트 - AI가 하지 않은 일】
· 숫자를 지어내지 않았습니다. 화면에 표시된 값만 썼습니다.
· 확인되지 않은 것은 "확인되지 않음"으로 남겼습니다.
예를 들어 "말레이어권 여행자 중 무슬림 비율"은
제가 별도로 확인해야 할 항목으로 분리했습니다.
결론은 숫자를 보고 제가 냈습니다.
【⑤ 다른 사람도 따라 할 수 있습니다】
이 방법은 관광 API에만 쓰이는 게 아닙니다. 우리 동네 공공데이터에 그대로 적용됩니다.
1. 자기 지역 공공 API나 공개 데이터 포털을 하나 고른다
2. AI에게 "필터를 하나씩 걸어가며 건수를 직접 집계해줘.
추측은 빼고"라고 요청한다
3. 나온 표에서 유난히 작은 칸을 찾는다
4. 그 칸이 왜 비어 있는지, 그 빈칸 때문에
누가 불편한지를 생각한다
빈칸은 대개 "관심이 덜 간 사람들"이 있는 자리입니다. 저는 말레이어 칸에서 그걸 봤습니다.
【무엇이 달라졌나】
전에는 "다국어 지원이 부족한 것 같다"고 느낌으로 말했을 겁니다. 지금은 "말레이어 2,907건이 비어 있다"고 말합니다.
느낌은 반박되지만 숫자는 다음 행동을 정합니다. 어느 언어부터, 어느 분류부터 채울지가 표를 보면 바로 정해집니다.
AI를 잘 쓴다는 건 그럴듯한 문장을 빨리 받는 게 아니라, 확인할 수 있는 숫자를 손에 쥐는 것이라고 생각하게 됐습니다.
【출처 및 윤리】
· 집계에 사용한 데이터는 로그인 없이 접근 가능한 공개 조회 페이지의 표시 건수입니다. 계정·인증이 필요한 데이터에는 접근하지 않았습니다.
· 표의 모든 수치는 집계 시점(2026년 9월) 화면 표시값이며, 추정하거나 보정한 값이 없습니다.
· 개인정보에 해당하는 데이터는 다루지 않았습니다.
· "말레이어권 여행자 상당수가 무슬림"이라는 서술은 통계 확인이 필요한 일반적 배경 설명이며, 특정 집단을 단정하려는 의도가 아닙니다.
서울시 산하 기관이 운영하는 공공 관광 API 안내문에 "다국어 지원 - 7개 언어"라고 적혀 있었습니다. 한국어, 영어, 일본어, 중국어(간체·번체), 러시아어, 말레이어입니다.
저는 이 문장이 정확히 무슨 뜻인지 궁금했습니다. "7개 언어를 지원한다"는 게 정말 7개 언어로 다 채워져 있다는 뜻일까요?
보통 여기서 멈춥니다. 확인하려면 수천 건을 일일이 세어야 하니까요.
【② 어떤 AI를 어떻게 활용했나요?】
저는 AI에게 결론을 묻지 않았습니다. "세어보라"고 시켰습니다.
요청한 말 그대로:
"이 사이트의 공개된 조회 페이지에서 어권별·분류별 건수를
직접 집계해줘. 네 추측이나 일반론은 필요 없어.
화면에 찍힌 숫자만 가져와."
AI는 공개 검색 페이지에서 어권 필터와 분류 필터를 하나씩 걸어가며 표시되는 총 건수를 읽었습니다. 사람이 했으면 반나절 걸릴 일이 몇 분 만에 끝났습니다.
이 방식의 핵심은 "물어보기"가 아니라 "시키기"였습니다. "이 API 다국어 지원 잘 돼 있어?"라고 물었다면 AI는 그럴듯한 일반론을 답했을 겁니다. "세어서 표로 만들어"라고 시키니 숫자가 나왔습니다.
【③ 활용 결과 어떤 변화가 있었나요?】
총 3,788건을 집계한 결과입니다.
■ 어권별 실제 보유 콘텐츠
한국어 3,788건 100.0%
영어 3,763건 99.3%
일본어 3,546건 93.6%
중국어(간체) 3,535건 93.3%
중국어(번체) 3,509건 92.6%
러시아어 1,370건 36.2% <--
말레이어 881건 23.3% <--
■ 분류별 분포
음식 1,259건 33.2%
축제·공연·행사 1,194건 31.5%
문화관광 739건 19.5%
쇼핑 297건 7.8%
체험·역사·자연관광 282건 7.4%
숙박 17건 0.4% <--
말레이어를 쓰는 사람은 서울 관광 콘텐츠의 76.7%, 그러니까 2,907건을 볼 수 없습니다. 러시아어 사용자도 63.8%가 비어 있습니다. "7개 언어 지원"은 거짓이 아니지만, 사용자가 체감하는 것과는 거리가 있었습니다.
그리고 하나가 더 보였습니다. 숙박이 3,788건 중 17건입니다. 여행에서 숙소가 차지하는 비중을 생각하면 사실상 없는 것과 같습니다.
■ 여기서 한 걸음 더 - 번역만의 문제가 아니었습니다
말레이어권 여행자 상당수는 무슬림입니다. 저는 AI와 이 지점을 파고들었습니다.
전체 콘텐츠의 33.2%가 음식입니다. 가장 큰 분류입니다. 그런데 무슬림 여행자에게 음식 정보는 "읽을 수 있는가"보다 "먹을 수 있는가"가 먼저입니다. 할랄 여부, 돼지고기·주류 취급, 근처에 기도할 공간이 있는지. 이 정보가 없으면 1,259건의 음식 정보는 그 사람에게 번역이 되어 있어도 여전히 빈칸입니다.
즉 이 문제는 번역기를 붙여서 풀리지 않습니다. 없는 콘텐츠를 만들어야 하고, 그 언어권이 실제로 부딪히는 제약을 함께 붙여야 합니다.
【④ 나만의 방식 / 개선 포인트 - AI가 하지 않은 일】
· 숫자를 지어내지 않았습니다. 화면에 표시된 값만 썼습니다.
· 확인되지 않은 것은 "확인되지 않음"으로 남겼습니다.
예를 들어 "말레이어권 여행자 중 무슬림 비율"은
제가 별도로 확인해야 할 항목으로 분리했습니다.
결론은 숫자를 보고 제가 냈습니다.
【⑤ 다른 사람도 따라 할 수 있습니다】
이 방법은 관광 API에만 쓰이는 게 아닙니다. 우리 동네 공공데이터에 그대로 적용됩니다.
1. 자기 지역 공공 API나 공개 데이터 포털을 하나 고른다
2. AI에게 "필터를 하나씩 걸어가며 건수를 직접 집계해줘.
추측은 빼고"라고 요청한다
3. 나온 표에서 유난히 작은 칸을 찾는다
4. 그 칸이 왜 비어 있는지, 그 빈칸 때문에
누가 불편한지를 생각한다
빈칸은 대개 "관심이 덜 간 사람들"이 있는 자리입니다. 저는 말레이어 칸에서 그걸 봤습니다.
【무엇이 달라졌나】
전에는 "다국어 지원이 부족한 것 같다"고 느낌으로 말했을 겁니다. 지금은 "말레이어 2,907건이 비어 있다"고 말합니다.
느낌은 반박되지만 숫자는 다음 행동을 정합니다. 어느 언어부터, 어느 분류부터 채울지가 표를 보면 바로 정해집니다.
AI를 잘 쓴다는 건 그럴듯한 문장을 빨리 받는 게 아니라, 확인할 수 있는 숫자를 손에 쥐는 것이라고 생각하게 됐습니다.
【출처 및 윤리】
· 집계에 사용한 데이터는 로그인 없이 접근 가능한 공개 조회 페이지의 표시 건수입니다. 계정·인증이 필요한 데이터에는 접근하지 않았습니다.
· 표의 모든 수치는 집계 시점(2026년 9월) 화면 표시값이며, 추정하거나 보정한 값이 없습니다.
· 개인정보에 해당하는 데이터는 다루지 않았습니다.
· "말레이어권 여행자 상당수가 무슬림"이라는 서술은 통계 확인이 필요한 일반적 배경 설명이며, 특정 집단을 단정하려는 의도가 아닙니다.
📎 첨부파일 (1)
📄 사례1_지역사회_박시우.pdf