PDF·HWP AI 질문하기 (문서 챗봇)

브라우저 안에서만 처리됩니다. 입력한 내용과 선택한 파일은 서버로 전송되지 않습니다. 익명 방문 통계만 집계합니다.

1 · 문서

파일을 여기에 끌어다 놓거나 클릭해서 선택하세요.

선택한 파일은 브라우저 안에서만 처리됩니다.

PDF(글자가 든 것) · HWP·HWPX · TXT·MD, 최대 10개 · 모두 합쳐 100만 자.

2 · AI 모델

이 브라우저에서 모델을 돌릴 수 있는지 확인하는 중…

3 · 질문

사용법

  1. PDF·HWP·HWPX·TXT·MD 문서를 끌어다 놓거나 클릭해서 고릅니다(키보드로는 Tab 으로 상자에 가서 Enter). 한 번에 10개, 모두 합쳐 100만 자까지 넣을 수 있고, 넣는 즉시 "문서 N개 · M쪽 · 약 K자 색인됨" 이 나옵니다. 글자가 없는 스캔본 쪽이 있으면 따로 알려 드립니다.
  2. AI 모델 크기를 고릅니다. 처음 한 번은 모델 파일(0.6B 약 352 MB, 1.7B 약 985 MB, 4B 약 2.3 GB)을 받고, 다음부터는 이 브라우저에 저장된 것을 씁니다. "모델 받기" 를 누르기 전에는 아무것도 받지 않으며, 받는 중에는 진행률과 취소 버튼이 보입니다.
  3. 질문 칸에 한국어로 묻고 "질문하기" 를 누릅니다(Enter 도 됩니다). 답은 한 글자씩 흘러나오고, 도중에 "멈춤" 으로 끊을 수 있습니다. 문서에 쓰인 낱말로 물을수록 근거를 잘 찾습니다.
  4. 답 아래의 근거 조각 [1]~[5] 를 눌러 원문을 펼쳐 확인합니다. 답 속의 [2] 같은 번호를 누르면 그 조각이 열립니다. 답이 근거와 다르면 근거가 맞습니다 — AI 가 잘못 읽은 것입니다.
  5. 이어서 물으면 앞선 대화(최대 3번)를 함께 보내 "그건 언제까지야?" 같은 질문도 알아듣게 합니다. 다른 문서를 물을 때는 "대화 지우기" 를 누르세요. 저장된 모델은 "이 브라우저에 저장된 모델" 에서 지울 수 있습니다.

자주 묻는 질문

문서가 서버로 올라가나요?

올라가지 않습니다. 문서를 읽고, 알맞은 조각을 찾고, AI 가 답을 쓰는 것이 모두 이 브라우저 안에서 일어납니다. 대신 브라우저가 받아 오는 것이 있습니다. 문서를 읽는 프로그램(PDF 는 pdf.js, HWP·HWPX 는 한/글 해석기 약 9.5 MB)과 AI 를 돌리는 프로그램(약 6 MB)은 이 사이트에서, AI 모델 파일(0.6B 약 352 MB ~ 4B 약 2.3 GB)은 microlab 서버(models.microlab.dev)에서 처음 쓸 때 받습니다. 모델은 이 브라우저의 저장소에 두고 다음부터는 저장된 것을 씁니다. 무엇을 받을 때도 문서나 질문은 함께 보내지 않습니다. 문서를 서버로 올려야 하는 다른 문서 AI 서비스와 다른 점이 이것입니다.

답이 틀릴 수 있나요? 왜 그런가요?

틀릴 수 있습니다. 이유는 두 가지입니다. 첫째, AI 는 문서 전체를 읽지 않습니다. 질문과 낱말이 많이 겹치는 조각 5개(약 500자씩)만 골라 읽고 답하므로, 답이 그 5개 밖에 있으면 모릅니다. 둘째, 브라우저에서 돌리는 작은 모델(Qwen3 0.6B~4B)은 큰 서버용 AI 보다 문장을 잘못 읽거나 숫자를 옮겨 적다 틀리는 일이 잦습니다 — 특히 0.6B 는 빠르지만 부정확할 수 있습니다. 그래서 답에는 항상 근거 조각을 파일명·쪽과 함께 붙입니다. 금액·날짜·기한처럼 중요한 내용은 반드시 근거 조각의 원문으로 확인하세요.

문서에 있는 내용인데 "문서에서 찾지 못했습니다" 라고 합니다.

가장 흔한 원인은 질문과 문서가 다른 낱말을 쓴 경우입니다. 이 도구는 뜻이 아니라 글자(두 글자씩 겹친 조각)가 겹치는 정도로 근거를 찾습니다. 만들면서 공문서로 두 번 시험했습니다. 공문서 8개·28문항에서는 문서의 말을 그대로 쓰거나 조금 바꾼 질문 20개의 근거가 상위 5개 안에 들었지만, 말을 크게 바꾼 질문 8개 중 3개는 못 찾았습니다 — "집 살 때 내는 세금" 은 문서의 "주택 취득세율" 을, "월급 받는 사람 건보료" 는 "직장가입자 건강보험료율" 을, "P2P 회사가 문을 닫으면" 은 "온투업자 폐업" 을 찾지 못했습니다. 다른 공문서 7개로 따로 만든 22문항에서는 19개를 찾았습니다. 시험한 문서에서의 결과일 뿐 다른 문서에서도 그렇다는 보장은 아닙니다. 답이 없다고 나오면 문서에 쓰였을 법한 낱말(법령·공문서 용어)로 바꿔 물어보세요. 근거 조각 목록에서 "가장 가까운 조각" 을 열어 보면 어떤 말로 쓰였는지 힌트가 됩니다.

문서 전체를 요약하거나 두 문서를 비교할 수 있나요?

잘 안 됩니다. 이 도구의 한계입니다. AI 가 한 번에 읽는 양이 약 2,500 토큰(한글 약 2,500자)으로 정해져 있어서 문서 전체를 읽고 요약할 수 없습니다. "요약해 줘" 라고 물으면 요약이라는 낱말과 겹치는 조각 몇 개만 읽고 답합니다. 비교도 두 문서의 조각이 함께 뽑힐 때만 됩니다. 이 도구는 "신청 기간은 언제까지인가요?" 처럼 문서 안의 특정 내용을 찾는 질문에 맞습니다.

어떤 브라우저·기기에서 되나요?

AI 모델은 그래픽 처리 장치(GPU)를 쓰는 WebGPU 로 돌아서, WebGPU 가 켜진 데스크톱 크롬·엣지 최신판이 필요합니다. WebGPU 가 없는 브라우저에서는 모델 받기 버튼을 보여 주지 않고, 질문하면 답 대신 관련 있는 원문 조각만 찾아 보여 드립니다(검색은 GPU 없이도 됩니다). 그래픽 메모리가 적은 노트북에서는 4B 가 올라가지 않거나 도중에 GPU 연결이 끊길 수 있습니다 — 그러면 "더 작은 모델로 다시 시도" 를 누르세요. 휴대폰은 저장 공간·메모리가 모자라 권하지 않습니다.

모델 크기는 무엇을 고르면 되나요?

1.7B(약 985 MB)가 기본이고 권장입니다. 0.6B(약 352 MB)는 받는 양이 적고 빠르지만 한국어 답이 부정확하거나 규칙(근거 번호 달기, 없으면 없다고 하기)을 덜 지킬 수 있습니다. 4B(약 2.3 GB)는 더 정확하지만 받는 데 오래 걸리고 그래픽 메모리가 넉넉해야 합니다. 기기 메모리가 4 GB 이하로 보이면 0.6B 를 먼저 권해 드립니다. 16비트 GPU 연산을 지원하지 않는 그래픽 장치에는 같은 모델의 32비트용 파일을 받습니다(크기는 거의 같습니다).

스캔한 PDF, 배포용·암호 HWP 도 되나요?

스캔한 종이로 만든 PDF 는 글자 정보가 없어 질문할 수 없습니다 — 그런 쪽이 있으면 알려 드리고 "스캔 PDF 텍스트 추출(OCR)" 로 안내합니다. OCR 로 뽑은 글을 .txt 로 저장해 넣으면 질문할 수 있습니다. 한/글의 배포용 문서 중 작성자가 복사를 막아 둔 문서는 "HWP 텍스트 추출" 과 같은 판단으로 글자를 꺼내지 않습니다. 열람 암호가 걸린 PDF·HWP 는 이 도구에서 암호를 풀지 않습니다(PDF 는 "PDF 암호 해제" 로 안내합니다).

표가 많은 문서도 되나요?

HWP·HWPX 의 표는 "HWP 텍스트 추출" 과 같은 방식으로 한 행을 한 줄로, 칸은 탭으로 나눠 읽으므로 행 단위로 근거가 잡힙니다. PDF 의 표에는 칸 정보가 없어서 보이는 줄 순서대로 이어 읽습니다 — 단이 둘인 PDF 나 복잡한 표는 옆 칸의 글이 섞여 AI 가 숫자를 엉뚱한 항목에 붙일 수 있습니다. 그런 답은 근거 조각의 원문과 대조하세요.

받은 모델은 어디에 저장되고, 어떻게 지우나요?

이 브라우저의 사이트 저장소(Cache Storage)에 저장됩니다. 다음 방문부터는 다시 받지 않고 몇 초~수십 초 안에 불러옵니다. 도구의 "이 브라우저에 저장된 모델" 목록에서 지우기를 누르면 지워집니다. 받다가 끊겼거나 취소한 경우 이미 받은 부분은 남아 있어 다시 받으면 이어서 받습니다. 저장 공간이 모자라다는 오류가 나면 저장된 다른 모델을 지우거나 디스크 공간을 비운 뒤 다시 받으세요.