홈 · 데이터 수집 안내

데이터 수집 안내

nunchi.biz 가 어떤 자료를 어디에서 어떤 절차로 가져오는지, 어떤 법적 요건을 따르는지, 무엇을 저장하고 무엇을 저장하지 않는지 한 페이지에 정리했어요. 2026-09-24 에 운영 중인 코드 기준이에요.

한눈에 보기

질문답
언제 수집하나요이용하시는 분이 주소나 키워드를 넣고 단추를 누르신 그 순간에만 요청해요. 지켜보기 브리핑을 받기로 정하신 사이트는 정하신 주기에 맞춰 같은 절차로 확인해요. seed 가 스스로 사이트 목록을 만들어 돌지 않아요.
무엇을 읽나요로그인 없이 누구나 열 수 있는 공개 페이지, 공개 API, 공공데이터포털 자료만 읽어요. 로그인 · 결제 · 회원 화면과 입력 양식은 읽지 않아요.
어떻게 읽나요이름을 밝힌 봇 BizSpringSeedBot/1.0 이 HTTP GET 요청만 보내요. robots.txt 를 먼저 확인하고, 막혀 있으면 읽지 않아요. 사이트가 접속을 거부하면(401 · 403 · 429 등) 더 요청하지 않고 멈추며, 거부를 우회하지 않아요.
무엇을 남기나요판정 결과와 수치(있고 없음 · 건수 · 검색량)만 남겨요. 페이지 본문 · 기사 원문 · 이미지는 저장하지 않아요.
개인정보는요지켜보기를 등록하신 분의 이메일과 동의 기록만 받아요. 이용 기록에는 이메일 · 로그인 토큰 · 인증 코드를 넣지 않아요.

수집 방법 다섯 가지

자료를 얻는 방식에 따라 원가와 따라야 할 조건이 달라서, 방식별로 다섯 등급으로 구분해요. 원천별 갱신 주기는 자료 원천에서 확인하실 수 있어요.

등급방식원천쓰는 화면따르는 조건
A공공데이터 API공공데이터포털(조달청 나라장터 · 한국관광공사 TourAPI · 한국환경공단 에어코리아 · 기상청 단기예보 · 소상공인시장진흥공단 상가정보), 서울 열린데이터광장 추정매출, 국토교통부 브이월드(사업장 주소 → 좌표)지금 어때?(시장 동향 표본) · 공공데이터 스캔 · 지역 상권 스캔 · 지켜보기 브리핑(새 입찰공고 · 반경 안 같은 업종 새 등재)각 기관의 이용 조건과 공공누리 출처 표시. 화면마다 출처를 표시해요.
B자격이 필요한 검색 API네이버 검색 API(뉴스 · 블로그 · 카페 · 지식iN), 네이버 검색광고 API(월 검색량 · 연관 검색어), 네이버 데이터랩(검색어 추세), 네이버 자동완성지금 어때? · 콘텐츠 시드비즈스프링이 발급받은 자격으로 약관 범위 안에서 부르고, 기사 원문은 저장 · 재배포하지 않아요. 기사는 제목과 원문 링크만 표시해요.
C공개 페이지 읽기이용하시는 분이 넣은 사이트와 고른 경쟁사 사이트의 공개 페이지지금 어때?(1차 분석 · 사이트 상태 12항목 · 첫 화면 메시지)robots.txt 준수, 이름 공개, 요청 간격과 상한, 원문 미보관. 아래 절차를 따라요.
DAI 웹 검색 관측Perplexity(sonar) · Gemini(구글 검색) · Claude 웹 검색(대체용)지금 어때?(AI 요약 · 경쟁사 후보 · 브랜드 표기 확인 · 대표 검색어 추천 · 메시지 비교) · 콘텐츠 시드AI 서비스에 브랜드와 시장을 물어 답과 인용 출처를 확인해요. seed 가 읽지 못하는 페이지를 AI 에 대신 가져오게 하지 않아요.
E수집하지 않음계약으로 제외된 곳(무신사 · 29CM · 크림 · ZARA), 서버에서 시도하지 않는 곳(스마트스토어 · 쿠팡), 거부 의사를 밝힌 곳(엔카), 삭제를 요청하신 도메인—요청하지 않고 우회하지 않아요.

무엇을 읽나요

기능읽는 대상상한결과로 남는 것
① 내 사이트 1차 분석robots.txt · 첫 화면 · 사이트맵 · 메뉴에 있는 회사소개/서비스 페이지하위 페이지 2장, 한 번에 22초소개 문장 · 주요 메뉴 · 푸터 사업자 정보 · 연결 채널 · 업종 판정 · 대표 키워드(화면 표시용)
사이트 상태 12항목robots.txt · 첫 화면 · 사이트맵 앞 20장 · 없는 주소 응답 · 측정 태그 컨테이너 · 같은 호스트의 스크립트 묶음페이지 20장, 태그 컨테이너 2개, 스크립트 6개 · 3MB항목별 있고 없음과 근거(측정 방법)
② 경쟁사 추정네이버 검색(비교 검색 · 함께 찾는 말 · 업종 검색) · AI 웹 검색 · 후보 공식 사이트 첫 화면AI 추정 하루 100회후보 이름 · 근거 종류 · 근거 강도
③ 경쟁사 사이트 변화 · 첫 화면 메시지 비교우리와 경쟁사 사이트의 첫 화면, 첫 화면에 연결된 이벤트 목록 한 장, 날짜가 붙은 소식 · 블로그 목록 한 장(같은 사이트이고 robots.txt 가 허용할 때만)사이트당 첫 화면 한 장과 하위 페이지 최대 3장, AI 비교 하루 100회제목 · 버튼 문구 · 배너 · 제안 · 신뢰 근거 문장 · 상단 메뉴 이름(16개까지) · 최근 글 제목과 날짜(8개까지)와 회사 상호
검색 · 언급 · 추세 · 뉴스네이버 검색 API · 검색광고 API · 데이터랩브랜드마다 한글 · 영문 두 표기검색량 · 문서 수 · 추세 수치, 기사 제목과 링크(국내 언론사 기사)
공공데이터 스캔공공데이터포털 공개 API요청 한 번에 목록 최대 100건저장하지 않음(화면 표시만)
지역 상권 스캔소상공인시장진흥공단 상가정보 · 서울 열린데이터 추정매출반경 2km 이내저장하지 않음(화면 표시만)
콘텐츠 시드네이버 검색 · 데이터랩 · AI 웹 검색같은 키워드는 6시간 재사용채널별 작성 지시서(내려받기는 브라우저에서만)

사이트를 읽는 절차

공개 페이지를 읽을 때(등급 C)는 모든 기능이 같은 공통 규칙(api/_lib/http.js)을 거쳐요.

1. robots.txt 를 먼저 확인해요

BizSpringSeedBot 이나 전체 봇(*)에 대해 루트가 막혀 있으면 그 사이트는 한 장도 읽지 않고 중단하고, 그 사실을 화면에 안내해요. 하위 페이지는 경로마다 허용 여부를 다시 확인해요.

2. 이름을 밝히고 GET 만 보내요

BizSpringSeedBot/1.0 (+https://nunchi.biz/bot) 이름으로 요청해요. 브라우저인 척하지 않고, 양식 제출 · 로그인 · 결제 요청을 보내지 않아요.

3. 간격과 상한을 따라요

기능마다 한 사이트의 페이지를 한 장씩 차례로 읽고, 페이지 사이에 1초 이상 간격을 유지해요. 응답을 10초 넘게 기다리지 않고, 기능마다 정한 장수와 시간 예산을 넘기지 않아요.

4. 같은 도메인 안에서만 따라가요

리다이렉트는 3회까지, 같은 등록 도메인 안에서만 따라가요. 바깥 도메인으로 넘어가면 멈춰요.

5. 거부하면 멈춰요

403 · 429 응답이나 봇 확인 화면을 받으면 더 요청하지 않고 「읽지 못했어요」로 안내해요. 주소나 이름을 바꿔 다시 시도하지 않아요.

6. 계산 뒤 원문을 버려요

판정과 수치만 계산하고, 페이지 본문은 요청이 끝나면 버려요. 서버 응답 캐시는 CDN 에서 10분(사이트 상태) · 1시간(첫 화면 메시지) 동안만 유지돼요.

AI 사용과 원가 상한

용도AI 서비스상한 · 재사용
브랜드 · 시장 AI 요약Perplexity 웹 검색같은 키워드 6시간 재사용. 보조 표기와 경쟁사는 AI 요약 없이 조회해요
경쟁사 후보 찾기Perplexity · Gemini 3.8 Flash(구글 검색) 교차. Gemini 가 실패하면 Claude하루 100회, 같은 대상 24시간 재사용, 구글 검색 최대 5회
첫 화면 메시지 비교Gemini 3.8 Flash(실패하면 Claude, 그다음 Perplexity)하루 100회, 같은 입력 24시간 재사용
브랜드 한글 · 영문 표기 확인Perplexity 웹 검색하루 300회, 도메인별로 저장해 다시 묻지 않아요
대표 검색어 추천(사이트에 적힌 키워드가 없을 때)Gemini(검색 없음, 사이트에서 읽은 글자만 근거) · 네이버 검색광고 월간 검색량 확인하루 300회, 도메인별로 30일 저장해 다시 묻지 않아요
콘텐츠 시드 작성 지시서Perplexity같은 키워드 · 채널 묶음 6시간 재사용
기사 문맥 확인(이름이 들어간 기사가 그 회사를 실제로 다룬 기사인지)Gemini(검색 없음, 기사 제목 · 발췌만 근거)하루 600회, 같은 회사 · 같은 기사 판정은 14일 재사용해요. 판정을 받지 못하면 제목에 이름이 있는 기사만 표시해요

AI 에는 이용하시는 분이 넣은 브랜드 이름 · 도메인 · 키워드와 공개 페이지에서 읽은 글자만 보내요. 이메일이나 계정 정보는 보내지 않아요. AI 가 답한 내용에는 출처를 함께 표시하고, 확인되지 않은 수치는 화면에 쓰지 않아요.

아래는 관련 법령과 약관이 요구하는 내용과 seed 가 운영에서 따르는 방식이에요. 법률 자문이 아니며, 법무 검토 결과에 따라 갱신해요.

근거요구하는 것seed 의 대응
개인정보 보호법필요한 최소 정보만 수집, 목적과 항목을 알리고 동의 받기, 목적 외 이용 금지, 요청 시 파기지켜보기 등록 때만 이메일을 받아요. 동의는 개인정보 수집 · 이용(필수)과 마케팅 정보 수신(선택) 두 가지이고, 계정에 동의 여부 · 시각 · 판(version)을 저장해요. 처리 내용은 개인정보 처리방침에 있어요. 「내 지켜보기」에서 설정과 동의를 직접 지우실 수 있어요. 이용 기록에는 이메일을 넣지 않아요.
정보통신망 이용촉진 및 정보보호 등에 관한 법률접근 권한 없는 정보통신망 침입 금지, 영리 목적 광고성 정보 전송 시 사전 동의로그인 · 회원 전용 화면을 읽지 않고, 차단 의사(robots.txt · 403)를 우회하지 않아요. 브리핑 메일은 등록하신 분께만 보내는 정보성 메일이고 광고를 싣지 않아요. 마케팅 메일은 마케팅 정보 수신에 동의하신 분께만 따로 보내요.
저작권법저작물의 복제 · 배포 · 전송 제한페이지 본문과 기사 원문을 저장하거나 다시 내보내지 않아요. 기사는 제목과 원문 링크만 표시하고, 언론사 이름을 함께 표시해요.
부정경쟁방지 및 영업비밀보호에 관한 법률타인이 상당한 투자로 만든 성과 · 데이터의 무단 사용 금지상품 · 가격 목록을 대량으로 수집하지 않아요. 계약으로 제외된 채널과 쇼핑 플랫폼은 서버에서 요청하지 않아요(등급 E).
공공데이터의 제공 및 이용 활성화에 관한 법률 · 공공누리이용 조건 준수, 출처 표시공공데이터포털이 정한 통로로 받고, 화면마다 제공 기관을 출처로 표시해요. 원천별 공공누리 유형은 확인 중이며, 확인하기 전까지 「제한 없음」으로 안내하지 않아요.
전자상거래 등에서의 소비자보호에 관한 법률사업자는 상호 · 대표자 · 사업자등록번호 등을 사이트에 표시이 표시 정보는 사이트를 이해하기 위해 화면에만 보여 드리고, 대표자 이름은 이용 기록에 저장하지 않아요. 회사 상호는 뉴스 검색어로만 써요.
robots.txt 표준(RFC 9309)사이트 운영자의 수집 허용 범위 표시모든 공개 페이지 요청 전에 확인하고 따라요. 차단 방법은 봇 안내에 있어요.
각 API 이용 약관네이버 개발자센터 · 네이버 검색광고 · 공공데이터포털 · Perplexity · Anthropic 이 정한 호출 한도와 이용 범위발급받은 자격으로 한도 안에서만 부르고, 받은 원문을 재배포하지 않아요. 한도를 넘으면 빈 결과가 아니라 사유를 안내해요.

안전장치

장치내용
무료 한도무료 살펴보기는 사이트(도메인)마다 한 달 10회예요. 하위 주소는 합쳐서 계산해요.
경쟁사 첫 화면 매일 확인지켜보기를 등록하신 사이트의 경쟁사 첫 화면과 지켜볼 페이지를 하루 한 번 읽어요(robots.txt 를 따르고, 자동 수집을 허용하지 않는 사이트는 읽지 않아요). 최근 30일 안에 보지 못한 판촉 · 이벤트 문구, 첫 화면 제목 변화, 새 메뉴, 새 글이 있는 날만 짧은 메일로 안내해 드리고, 이 확인은 이번 달 살펴보기 횟수를 쓰지 않아요. 「내 지켜보기」에서 끄실 수 있어요.
브리핑 발송 규칙같은 사이트의 정기 브리핑은 하루 한 번만 보내요. 「달라진 것이 있을 때만」을 고르시면 달라진 것이 없을 때 보내지 않고, 4주 동안 달라진 것이 없으면 한 번 안내해 드려요.
웹훅 주소 검사알림 웹훅은 Google Chat · Slack 주소만 받아요. JSON 웹훅(Growth)은 https 이면서 인터넷에서 닿는 주소만 받고, 다른 주소로 넘기는 응답(리다이렉트)은 따라가지 않아요. JSON 본문에는 계정별 서명(X-Seed-Signature)을 붙여요.
웹훅 · 채팅에 보내는 값기사 제목 · 첫 화면 문구 같은 수집 원문은 보내지 않고 건수 · 주소 · 판정 문장만 보내요.
콘텐츠런처 초안연결하신 워크스페이스의 멤버인지 보낼 때마다 다시 확인해요. 새로 늘고 있는 검색어가 있을 때 초안 한 건만 만들고 발행은 하지 않아요.
계정당 사이트 수무료 계정은 지켜볼 사이트를 3개까지 등록하실 수 있어요(Growth 30개). 한도를 넘은 사이트에는 브리핑을 보내지 않아요. 요금 안내
AI 원가 상한기능별 하루 상한과 재사용 시간을 엔진에서 적용해요(위 표). 상한에 닿으면 AI 없이 검색 근거만 표시해요.
재분석 방지브리핑 메일의 링크로 들어오시면 분석을 다시 돌리지 않고 마지막 브리핑 값을 표시해요.
자격 증명 보호API 키는 서버 환경 변수에만 있고 화면 코드에 없어요. 이용 기록에 로그인 토큰 · 인증 코드 · 비밀번호 · 키 값이 들어오면 [redacted] 로 바꿔 저장해요.
관리 화면 접근회사 메일(bizspring.co.kr · entrench.co.kr · bawee.net)로 받은 인증 코드로만 로그인해요. 코드는 10분 유효, 한 시간에 5회까지, 5회 틀리면 잠겨요. 코드는 해시로만 저장해요.
제외 목록삭제를 요청하신 도메인과 거부를 되풀이한 도메인은 이후 요청하지 않아요.
검색 색인 제외내 지켜보기 · 관리 화면 · 이전 판 보관 화면은 검색 색인에서 제외(noindex)해요.

저장하는 것 · 저장하지 않는 것

어디에무엇을언제까지
이용하시는 브라우저테마 선택, 로그인 상태, 로그인하러 다녀오는 동안의 설정(1시간), 방문 번호(탭을 닫으면 사라짐)브라우저에서 지우실 때까지
로그인 계정(공유 로그인 풀)이메일, 지켜보는 사이트별 주제 · 주기 · 형식 · 「달라진 것이 있을 때만」 선택, 지역 업종의 사업장 주소, 브리핑 웹훅 주소, 연결한 콘텐츠런처 워크스페이스, 동의 두 가지의 여부 · 시각 · 판「설정과 동의 지우기」 또는 삭제 요청 때까지
이용 기록(질의 원장)입력한 주소 · 브랜드 · 키워드, 진행한 단계, 경쟁사 후보와 선택, 호출한 기능, AI 사용량과 비용보관 기간은 운영 정책으로 정해 이 페이지에 안내할 예정이에요. 그 전이라도 요청하시면 지워요
비공개 저장소로그인하신 분의 「지금 어때?」 결과(사이트마다 최근 3회, 다시 보기용), 도메인별 이번 달 사용 횟수, 마지막 브리핑 수치, 마지막 발송 날짜(중복 발송 방지), 사업장 주소의 좌표, 브랜드 표기 확인 결과, 대표 검색어 추천 결과, 경쟁사 첫 화면에서 최근 30일 동안 본 판촉 · 제목 · 메뉴 이름 · 글 제목(매일 확인의 비교 기준), 공유 링크 요약(이메일 제외, 30일), 관리자 인증 코드 해시사용 횟수는 매달 처음부터 다시 계산해요. 「지금 어때?」 결과는 새 결과가 저장되면 가장 오래된 것부터 지워 세 번까지만 남겨요. 기사 판정은 14일 뒤 지워요
저장하지 않는 것
페이지 본문 · 기사 원문 · 이미지 · 첨부 파일, 로그인하지 않은 분의 입력값 가운데 이메일, 공공데이터 스캔 · 지역 상권 스캔 결과는 저장하지 않아요. 로그인하지 않으면 지켜보기 설정과 「지금 어때?」 결과도 저장하지 않아요.

삭제 요청과 문의

사이트 운영자께서는 robots.txt 로 차단하시거나 기록 삭제를 요청하실 수 있어요. 지켜보기를 등록하신 분은 내 지켜보기에서 설정과 동의를 직접 지우실 수 있어요. 그 밖의 문의는 privacy@bizspring.co.kr 로 보내 주세요. 운영자는 BizSpring Inc.(주식회사 비즈스프링)예요.

무엇을 어떻게 확인하는지는 측정 방법에, 원천별 갱신 주기는 자료 원천에, 봇 이름과 차단 방법은 봇 안내에 있어요.