← AI 신뢰·프라이버시 연구로 돌아가기
Research Evidence · AI Trust

KoreaLog

연구 데모 · 자동 사실 판정 아님

화면의 최신성 표시를 실제 저장된 수집 시각에 연결하고, 주장→출처→수집 시각을 따라갈 수 있게 만든 공개 합성 증거입니다.

공개 provenance 샘플

1 · 주장합성 공개 샘플: 강풍주의보 발효
3 · 실제 저장 수집 시각

이 문장은 제품 경계를 검증하기 위한 합성 샘플입니다. 링크는 공개 출처 진입점 예시이며, 특정 기사를 인용하거나 기상 사실을 주장하지 않습니다. 편집 시각과 수집 시각은 별도로 표시됩니다.

공개 위협 모델

위협신뢰 경계통제·회귀
기사 본문의 프롬프트·역할 주입수집 콘텐츠는 모두 비신뢰 입력분류 전 탐지·격리, 격리 항목은 주장 생성 금지
출처 라벨·호스트 불일치수집기가 전달한 라벨도 비신뢰정규화한 공개 HTTP(S) 호스트와 비교해 미검증 처리
내부·로컬 URL과 링크 오염출처 링크 렌더링 경계사설/루프백/사용자정보/비 HTTP(S)·비표준 명시 포트는 거부하고 기본 :80/:443은 포트 없는 URL로 정규화
중복·변경 콘텐츠가 근거를 덮어씀원문 증거 저장소최초 Claim 본문·digest는 고정하고, 동일 URL 후속 관측은 수집 시각과 두 predecessor digest를 가진 v1→v2→v3 append-only 체인으로 분리
새로고침 주기가 최신성으로 오인됨API→화면 시각 경계최근 성공 ingest의 저장 시각만 노출, 편집 시각과 분리
검증 범위와 주장하지 않는 것
  • 회귀는 주입 격리, URL 안전성, provenance 직렬화와 관측 체인의 수정·중간 삭제·순서 변경·replay 탐지를 검증합니다.
  • 동일 URL의 최초 Claim은 바꾸지 않고 후속 관측을 append-only로 보존합니다. 다만 외부 checkpoint가 없으면 유효한 suffix 삭제나 전체 rollback은 로컬 hash chain만으로 탐지할 수 없습니다.
  • seed 3824 고정 합성 corpus의 주입 격리 결과는 해당 표본에만 한정되며, source-independence gate가 STOP이므로 사실 판정이나 보안 일반 보장으로 확대하지 않습니다.
  • 자동 신뢰도·교차지지 점수는 검토 보조 신호이며 사실 판정이 아닙니다.
  • 고객 데이터, 운영 성과, 법률·규제 적합성을 주장하지 않습니다.