새소식

무엇이 좋아졌는지,
한눈에 보세요.

Corepin 제품들의 최근 업데이트를 제품별 태그로 모았어요. 아래 태그를 눌러 원하는 제품 소식만 골라 볼 수 있어요.

유해발화 필터 2026-08-27
업무문서를 「차단 권장」으로 잡던 오탐을 걷어냈어요
「도청」이 들어간 지자체 이름, 「개인정보 수집·이용 동의서」, 조세 포탈세액 같은 평범한 업무 문서 표현이 유해발화로 잡히던 문제를 고쳤어요. 단어 일부가 우연히 겹쳐 생긴 오탐이에요.
  • ○○도청·조사기관·공사기간처럼 위험 단어를 부분 문자열로 품은 표현을 더 이상 잡지 않아요.
  • 「개인정보 수집·이용 동의서」·「저작권을 침해하지 않도록」·설비 「모델명」 같은 표준 문구도 통과해요.
  • 문서·크롤 경로의 프롬프트 인젝션 검사는 실제 인젝션 문구가 있을 때만 표시돼요 — 「이전 지시를 무시하고…」 같은 진짜 공격은 그대로 잡아요.
정신건강 2026-08-26
정신건강 검사, 사람이 쓴 문장에만 반응해요
표·서식·도면처럼 사람이 쓴 문장이 없는 문서에서 위험 신호를 잘못 알리던 문제를 고쳤어요. 이제 문서 안에서 사람이 실제로 서술한 부분만 골라 검사해요.
  • 전표·자재표·사양서처럼 표와 숫자만 있는 문서엔 더 이상 위험 신호가 뜨지 않아요.
  • 상담 기록·민원 글·대화 로그처럼 사람이 쓴 문장은 그대로 잡아내요.
  • 검사할 문장이 없어 건너뛴 문서는 응답의 screened 가 false 로 와요. 이때는 요금도 청구되지 않아요.
개인정보 필터 2026-08-21
개인정보 필터 v1.4 — 실무 문서 탐지력을 한 번 더 높였어요
실무 문서에서 이름처럼 문맥으로 판단하는 항목의 탐지력을 높이고, 금액·날짜류를 개인정보로 잘못 가리는 과잉 마스킹을 줄였어요. 직함·경칭을 이름으로 오인하는 경우도 함께 억제했어요.
  • 희귀한 성씨·붙여 쓴 이름 등 놓치기 쉬운 표기를 더 잘 찾아내요.
  • 일반 금액·일정 날짜를 개인정보로 오인해 가리는 일이 크게 줄었어요.
  • 공개 벤치마크(K-PII-Masking) 14,195건 재검증 — 재현율 99.99%, 함정 문장·유명인 언급 오탐 0.
  • 직함·경칭(『사장님』 같은 표현)을 이름으로 잘못 가리지 않아요.
플랫폼 2026-08-18
전 모델 응답 속도가 크게 빨라졌어요
요청 처리 경로를 최적화해 모든 필터 API 의 응답 속도를 크게 높였어요. 개인정보 필터 기준 중앙값 40ms — 순간적인 외부 환경 변화에도 응답 속도가 일정하게 유지돼요.
  • 응답에 꼭 필요하지 않은 내부 확인 작업을 요청 경로 밖으로 옮겼어요.
  • 문서보안·유해발화·정신건강 필터도 함께 빨라졌어요 (중앙값 12~33ms).
  • 탐지 결과는 그대로예요 — 속도만 빨라졌어요.
개인정보 필터 2026-08-17
개인정보 필터 v1.3 — 문맥 판단이 더 정확해졌어요
이름·회사명처럼 문맥을 보고 판단해야 하는 항목의 탐지 정확도를 높였어요. 19개 카테고리 구성은 그대로, 기존에 잘 잡던 항목의 회귀 없이 더 정확해졌어요.
  • 실무 문서에서 놓치기 쉬운 이름 표기를 더 잘 찾아내요.
  • 전화번호·이메일·사업자등록번호 같은 번호형 항목의 미탐·오탐도 함께 보정했어요.
  • 공개 벤치마크(K-PII-Masking) 14,195건 재검증 — 재현율 99.99%, 함정 문장·유명인 언급 오탐 0.
  • 유명인(공인) 명단을 시사 변화에 맞춰 계속 갱신해요 — 새 공인의 이름을 개인정보로 잘못 가리지 않아요.
AI 웹 크롤러 2026-07-16
로그인 게시판·비공개 글까지 수집
로그인해야 보이는 게시판이나 비공개 글도, 사이트에서 발급받은 전용 계정으로 로그인해 수집할 수 있어요.
  • 아이디·비밀번호는 암호화해서 보관하고, 크롤 요청엔 계정 정보 대신 참조 ID만 담겨요.
  • 계약이 끝나면 폐기하거나, 계정이 밖으로 나가지 않게 사내망 설치도 가능해요.
AI 웹 크롤러 2026-07-16
옛날 게시판도 놓치지 않아요
글 링크·페이지 넘김이 자바스크립트로만 동작하는 옛날 전자정부 게시판도 상세 글과 다음 페이지까지 따라가 수집해요.
  • 특정 사이트를 미리 넣어두지 않아도, 작업 설정만으로 다양한 옛날 게시판에 그대로 적용돼요.
AI 웹 크롤러 2026-07-16
사이트 한 곳을 통째로 (풀사이트 자동 크롤)
시작 주소 하나만 주면 같은 사이트의 페이지를 깊이·개수 한도 안에서 자동으로 따라가며 수집해요. 진행 상태를 조회하거나 완료 알림을 받을 수 있어요.
AI 웹 크롤러 2026-07-10
스크립트로만 그려지는 페이지도 (JS 렌더)
본문이 자바스크립트로만 그려지는 페이지도 화면에 그려진 그대로 읽어와 본문을 추출해요. 필요할 때만 켜는 옵션이고, 안 되면 자동으로 일반 방식으로 넘어가요.
문서 파서 2026-07-08
아주 큰 PDF도 안정적으로
수천 페이지짜리 대형 PDF도 나눠서 안정적으로 처리해요. 한 번에 최대 1만 페이지까지 다룰 수 있어요.
문서 파서 2026-07-05
오류 응답이 더 친절해졌어요
잠깐 생긴 일시적인 오류인지, 문서 자체 문제인지 명확히 구분해서 알려줘요. 잠깐의 오류는 다시 시도하면 되는지 함께 안내해요.
플랫폼 2026-07-02
무료 체험을 더 안전하게
일회용 이메일이나 스팸성 가입을 걸러내, 정상 사용자가 무료 체험을 원활하게 쓸 수 있도록 개선했어요.
AI 웹 크롤러 2026-06-21
한국형 AI 웹 크롤러 출시
광고·메뉴·깨진 글자를 걷어내고 본문만 남겨, 챗봇·RAG·에이전트가 바로 읽는 형태로 웹페이지를 돌려줘요.
  • 한글 인코딩이 깨진 정부·기관 사이트도 자동으로 살려서 읽어요.
  • 페이지에 붙은 HWP·PDF 첨부까지 함께 본문으로 풀어줘요.
  • 사내에 넣기 전 개인정보·기밀·유해·정신건강 검사를 한 번에 묶을 수 있어요.
문서 파서 2026-06-10
한국형 통합 문서 파서
PDF·한글(HWP)·워드·엑셀 문서를 LLM이 바로 이해하는 마크다운·JSON으로 정확히 변환해요.
OCR 2026-05-20
한국형 OCR
스캔 문서·영수증·이미지 속 한국어 글자를 정확히 읽어 텍스트로 돌려줘요.
문서보안 2026-05-15
문서보안(기밀 등급) 필터
사내 문서를 읽어 공개·내부·기밀 등 보안 등급과 유형을 자동으로 분류해, 유출 위험을 미리 잡아줘요.
유해발화 필터 2026-05-12
한국형 유해발화 필터
욕설·혐오·위협 같은 유해 표현과 악의적 입력을 한국어에 맞춰 잡아내, AI 서비스의 안전 가드레일로 써요.
정신건강 2026-05-10
정신건강 위험 신호 감지
AI와 대화하는 사용자의 글에서 우울·고립 같은 위험 신호를 조기에 감지해 안전망으로 활용할 수 있어요.
개인정보 필터 2026-05-05
한국형 개인정보 필터
주민등록번호·전화·계좌 등 한국형 개인정보를 정확히 찾아 자동으로 가려줘요.