프로세서 목록

이 페이지에는 Document AI에서 제공하는 모든 프로세서에 관한 자세한 정보가 포함되어 있습니다. 솔루션 유형별로 모든 프로세서 목록을 볼 수 있습니다.

모든 Document AI 프로세서는 데이터 처리 및 보안 약관을 준수합니다.

자세한 내용은 프로세서 버전 관리 문서를 참고하세요. 전체 제품 할당량 및 한도 외에 특정 프로세서 한도도 적용됩니다.

텍스트 디지털화

Enterprise Document OCR (광학 문자 인식)

설명

다양한 유형의 문서에서 텍스트를 식별하고 추출합니다.

이 프로세서를 사용하면 200개가 넘는 언어로 된 문서에서 필기 텍스트를 포함한 텍스트를 식별하고 추출할 수 있습니다. 또한 프로세서는 머신러닝을 사용하여 콘텐츠의 가독성을 기반으로 문서의 품질을 평가합니다.

카테고리 디지털화
함수 OCR, 품질 분석
출시 단계 정식 버전
액세스 상태 공개
API 입력 OCR_PROCESSOR
지원되는 언어
전체 언어 목록
언어 이름 BCP 47 태그 스크립트 필기 입력 지원
아프리칸스어 af Latn
알바니아어 sq Latn
아랍어 ar Arab
아르메니아어 hy Armn
벨라루스어 be Cyrl
벵골어 bn Beng
뱅골어 bn Beng
불가리아어 bg Cyrl
카탈로니아어 ca Latn
중국어 zh Hani
크로아티아어 hr Latn
체코 cs Latn
덴마크어 da Latn
네덜란드어 nl Latn
영어 en Latn
에스토니아어 et Latn
필리핀어 fil Latn
핀란드어 fi Latn
프랑스어 fr Latn
독일어 de Latn
그리스어 el Grek
구자라트어 gu Gujr
히브리어 iw Hebr
힌디어 hi Deva
헝가리어 hu Latn
아이슬란드어 is Latn
인도네시아어 id Latn
이탈리아어 it Latn
일본어 ja Jpan
칸나다어 kn Knda
크메르어 km Khmr
한국어 ko Kore
라오어 lo Laoo
라트비아어 lv Latn
리투아니아어 lt Latn
마케도니아어 mk Cyrl
말레이어 ms Latn
말라얄람어 ml Mlym
마라타어 mr Deva
네팔어 ne Deva
노르웨이어 no Latn
페르시아어 fa Arab
폴란드어 pl Latn
포르투갈어 (포르투갈 및 브라질) pt Latn
펀자브어 pa Guru
루마니아어 ro Latn
러시아어 ru Cyrl
세르비아어 sr Cyrl
슬로바키아어 sk Latn
슬로베니아어 sl Latn
스페인어 es Latn
스웨덴어 sv Latn
타갈로그어 tl Latn
타밀어 ta Taml
텔루구어 te Telu
태국어 th Thai
터키어 tr Latn
우크라이나어 uk Cyrl
베트남어 vi Latn
이디시어 yi Hebr
프로세서 버전
버전 ID 배포 채널 출시 버전 성숙도 설명
pretrained-ocr-v1.2-2022-11-10 정식 GA 고정된 모델 버전 1.0: 최대 18개월 동안 컨테이너 이미지에 고정된 버전 스냅샷의 모델 파일, 구성, 바이너리입니다.
pretrained-ocr-v2.0-2023-06-02 정식 GA 문서 사용 사례에 특화된 프로덕션 지원 모델입니다. 모든 OCR 부가기능에 대한 액세스가 포함됩니다.
pretrained-ocr-v2.1-2024-08-07 정식 GA v2.1의 주요 개선사항은 인쇄된 텍스트 인식 개선, 더 정확한 체크박스 감지, 더 정확한 읽기 순서입니다.
pretrained-ocr-v2.1.1-2025-01-31 출시 후보 공개 프리뷰 v2.1.1은 v2.1과 유사하며 US, EU, asia-southeast1를 제외한 모든 지역에서 사용할 수 있습니다.

자세한 내용은 프로세서 버전 관리를 참고하세요.

할당량 및 한도
최대 페이지 수 (온라인/동기 요청): 15
최대 페이지 수 (일괄/오프라인/비동기 요청): 500
최대 페이지 수 (이미지 없는 모드 온라인/동기 요청): 30
Uptraining
샘플 입력 파일 새 창에서 열기
샘플 출력 새 창에서 열기
지원되는 지역
  • asia-south1
  • asia-southeast1
  • australia-southeast1
  • eu
  • europe-west2
  • europe-west3
  • northamerica-northeast1
  • us
추가 정보 Enterprise Document OCR

문서에서 항목을 추출합니다.

학습에 사용할 라벨이 지정된 데이터 세트와 라벨이 지정되지 않은 데이터 세트의 샘플은 샘플 데이터 세트를 참고하세요.

맞춤 추출기

설명

생성형 AI 또는 커스텀 모델을 사용하여 문서에서 필드를 추출하고, 모델을 미세 조정하여 문서에서 데이터를 정확하게 추출합니다.

카테고리 추출
함수 OCR, 항목 추출
출시 단계 정식 버전
액세스 상태 공개
API 입력 CUSTOM_EXTRACTION_PROCESSOR
참고
  • 추출에 생성형 AI를 사용하는 경우 다음을 충족해야 합니다.

    • 영어만 공식적으로 지원됩니다.
    • 제공 지역은 US, EU, northamerica-northeast1, asia-southeast1입니다.

지원되는 언어
전체 언어 목록
언어 이름 BCP 47 태그 스크립트 필기 입력 지원
아프리칸스어 af Latn
아랍어 ar Arab
아제르바이잔어 az Latn
아제르바이잔어 (키릴 문자) az-Cyrl Cyrl
벨라루스어 be Cyrl
불가리아어 bg Cyrl
보스니아어 bs Latn
카탈로니아어 ca Latn
세부아노어 ceb Latn
체코 cs Latn
웨일즈어 cy Latn
덴마크어 da Latn
독일어 de Latn
그리스어 el Grek
영어 en Latn
에스페란토어 eo Latn
스페인어 es Latn
에스토니아어 et Latn
바스크어 eu Latn
페르시아어 fa Arab
핀란드어 fi Latn
필리핀어 fil Latn
프랑스어 fr Latn
아일랜드어 ga Latn
갈리시아어 gl Latn
힌디어 hi Deva
크로아티아어 hr Latn
아이티 크리올어 ht Latn
헝가리어 hu Latn
인도네시아어 id Latn
아이슬란드어 is Latn
이탈리아어 it Latn
히브리어 iw Hebr
일본어 ja Jpan
자바어 jv Latn
카자흐어 kk Cyrl
한국어 ko Kore
키르기스어 ky Cyrl
라틴어 la Latn
리투아니아어 lt Latn
라트비아어 lv Latn
마케도니아어 mk Cyrl
몽골어 mn Cyrl
마라타어 mr Deva
말레이어 ms Latn
몰타어 mt Latn
네팔어 ne Deva
네덜란드어 nl Latn
노르웨이어 no Latn
폴란드어 pl Latn
파슈토어 ps Arab
포르투갈어 (포르투갈 및 브라질) pt Latn
루마니아어 ro Latn
러시아어 ru Cyrl
러시아어 (페트린 철자법) ru-PETR1708 Cyrl
산스크리트 sa Deva
슬로바키아어 sk Latn
슬로베니아어 sl Latn
알바니아어 sq Latn
세르비아어 sr Cyrl
스웨덴어 sv Latn
스와힐리어 sw Latn
타갈로그어 tl Latn
터키어 tr Latn
우크라이나어 uk Cyrl
우르두어 ur Arab
우즈베크어 uz Latn
우즈베크어(키릴 문자) uz-Cyrl Cyrl
베트남어 vi Latn
이디시어 yi Hebr
중국어(간체) zh-Hans Hani
중국어(번체) zh-Hant Hani
줄루어 zu Latn
프로세서 버전
버전 ID 배포 채널 출시 버전 성숙도 설명
pretrained-foundation-model-v1.5-2025-05-05 정식 GA Gemini 2.5 Flash LLM으로 구동되는 프로덕션 레디 후보입니다. 최신 모델을 실험해 보려는 사용자에게 권장됩니다.
pretrained-foundation-model-v1.5-pro-2025-06-20 정식 GA Gemini 2.5 Pro LLM으로 구동되는 프로덕션 레디 모델입니다. 온라인 프로세스 요청에 대해 분당 최대 30페이지의 할당량을 지원합니다. 이 모델은 v1.5에 비해 품질이 개선되었으며 지연 시간이 더 길 수 있습니다.
pretrained-foundation-model-v1.5.1-2025-08-07 출시 후보 공개 프리뷰 Gemini 2.5 Flash LLM으로 구동되는 공개 프리뷰 모델입니다. 이 모델은 v1.5와 동일한 기능을 제공하며 적응형 퓨샷 학습이 개선되었습니다.
pretrained-foundation-model-v1.6-pro-2025-12-01 출시 후보 공개 프리뷰 Gemini 3 Pro LLM으로 구동되는 미리보기 모델입니다.
pretrained-foundation-model-v1.6-2026-01-13 출시 후보 공개 프리뷰 Gemini 3 Flash LLM으로 구동되는 프리뷰 모델입니다.
pretrained-foundation-model-v3.5-2026-05-26 출시 후보 공개 프리뷰 Gemini 3.5 Flash LLM으로 구동되는 프리뷰 모델입니다.

자세한 내용은 프로세서 버전 관리를 참고하세요.

할당량 및 한도
최대 페이지 수 (온라인/동기 요청): 15
최대 페이지 수 (일괄/오프라인/비동기 요청): 200
최대 페이지 수 (이미지 없는 모드 온라인/동기 요청): 30
정규화된 데이터 유형

자세한 내용은 강화 및 정규화데이터 세트 만들기 페이지를 참고하세요.

정규화된 데이터 유형의 전체 목록
  • dateTime as STRING
  • currency as STRING
  • money as google.type.Money
  • number as FLOAT or INTEGER
Uptraining
샘플 입력 파일 새 창에서 열기
샘플 출력 새 창에서 열기
지원되는 지역
  • asia-south1
  • asia-southeast1
  • australia-southeast1
  • eu
  • europe-west2
  • europe-west3
  • northamerica-northeast1
  • us
추가 정보 맞춤 추출기

양식 파서

설명

OCR 텍스트 외에도 문서에서 일반 키-값 쌍 (항목 및 체크박스), 표, 일반 항목을 추출합니다.

이 프로세서는 고급 머신러닝 기술을 적용하여 200개 이상의 언어로 된 문서에서 키-값 쌍, 체크박스, 표를 추출합니다. 또한 이 프로세서는 딥 러닝 모델을 활용하여 다양한 문서 유형에 일반적으로 포함되는 11개의 일반 항목을 추출합니다.

카테고리 추출
함수 OCR, 양식 파싱, 항목 추출
출시 단계 정식 버전
액세스 상태 공개
API 입력 FORM_PARSER_PROCESSOR
지원되는 언어
전체 언어 목록
언어 이름 BCP 47 태그 스크립트 필기 입력 지원
아프리칸스어 af Latn
알바니아어 sq Latn
아랍어 ar Arab
벨라루스어 be Cyrl
카탈로니아어 ca Latn
중국어 zh Hani
크로아티아어 hr Latn
체코 cs Latn
덴마크어 da Latn
네덜란드어 nl Latn
영어 en Latn
에스토니아어 et Latn
필리핀어 fil Latn
핀란드어 fi Latn
프랑스어 fr Latn
독일어 de Latn
히브리어 iw Hebr
힌디어 hi Deva
헝가리어 hu Latn
아이슬란드어 is Latn
인도네시아어 id Latn
이탈리아어 it Latn
일본어 ja Jpan
한국어 ko Kore
라트비아어 lv Latn
리투아니아어 lt Latn
마케도니아어 mk Cyrl
말레이어 ms Latn
마라타어 mr Deva
네팔어 ne Deva
노르웨이어 no Latn
페르시아어 fa Arab
폴란드어 pl Latn
포르투갈어 (포르투갈 및 브라질) pt Latn
루마니아어 ro Latn
러시아어 ru Cyrl
세르비아어 sr Cyrl
슬로바키아어 sk Latn
슬로베니아어 sl Latn
스페인어 es Latn
스웨덴어 sv Latn
타갈로그어 tl Latn
터키어 tr Latn
우크라이나어 uk Cyrl
베트남어 vi Latn
이디시어 yi Hebr
프로세서 버전
버전 ID 배포 채널 출시 버전 성숙도 추가 필드가 감지됨 설명
pretrained-form-parser-v1.0-2020-09-23 정식 GA

없음

기존 버전입니다. 최고의 품질과 전체 기능 집합을 사용하려면 양식 파서 v2.0을 사용하세요.
pretrained-form-parser-v2.0-2022-11-10 정식 GA
필드 표시
  • email
  • phone
  • url
  • date_time
  • address
  • person
  • organization
  • quantity
  • price
  • id
  • page_number
권장 버전입니다. 일반 항목을 지원하고 업그레이드된 표, KVP, 체크박스 모델과 200개가 넘는 언어를 포함합니다.
pretrained-form-parser-v2.1-2023-06-26 출시 후보 공개 프리뷰

없음

공개 미리보기 버전입니다. 디지털 PDF 파일에서 기본 텍스트 추출이 사용 설정된 v2.0과 동일한 모델입니다.

자세한 내용은 프로세서 버전 관리를 참고하세요.

할당량 및 한도
최대 페이지 수 (온라인/동기 요청): 15
최대 페이지 수 (일괄/오프라인/비동기 요청): 100
최대 페이지 수 (이미지 없는 모드 온라인/동기 요청): 30
Uptraining
샘플 입력 파일 새 창에서 열기
샘플 출력 새 창에서 열기
지원되는 지역
  • asia-south1
  • asia-southeast1
  • australia-southeast1
  • eu
  • europe-west2
  • europe-west3
  • northamerica-northeast1
  • us
추가 정보 양식 파서

레이아웃 파서

설명

문서 콘텐츠 요소 (텍스트, 표, 목록)를 추출하고 컨텍스트 인식 청크를 만듭니다.

레이아웃 파서는 텍스트, 표, 목록과 같은 문서 콘텐츠 요소를 추출하고 생성형 AI 및 탐색 애플리케이션에서 정보 검색을 용이하게 하는 컨텍스트 인식 청크를 만듭니다.

카테고리 추출
함수 레이아웃 파싱, 문서 청크 처리
출시 단계 정식 버전
액세스 상태 공개
API 입력 LAYOUT_PARSER_PROCESSOR
참고
  • 이 파서는 PDF, HTML, DOCX, PPTX, XLSX/XLSM 파일을 지원합니다.
지원되는 언어
전체 언어 목록
언어 이름 BCP 47 태그 스크립트 필기 입력 지원
아프리칸스어 af Latn
알바니아어 sq Latn
아랍어 ar Arab
아르메니아어 hy Armn
벨라루스어 be Cyrl
벵골어 bn Beng
뱅골어 bn Beng
불가리아어 bg Cyrl
카탈로니아어 ca Latn
중국어 zh Hani
크로아티아어 hr Latn
체코 cs Latn
덴마크어 da Latn
네덜란드어 nl Latn
영어 en Latn
에스토니아어 et Latn
필리핀어 fil Latn
핀란드어 fi Latn
프랑스어 fr Latn
독일어 de Latn
그리스어 el Grek
구자라트어 gu Gujr
히브리어 iw Hebr
힌디어 hi Deva
헝가리어 hu Latn
아이슬란드어 is Latn
인도네시아어 id Latn
이탈리아어 it Latn
일본어 ja Jpan
칸나다어 kn Knda
크메르어 km Khmr
한국어 ko Kore
라오어 lo Laoo
라트비아어 lv Latn
리투아니아어 lt Latn
마케도니아어 mk Cyrl
말레이어 ms Latn
말라얄람어 ml Mlym
마라타어 mr Deva
네팔어 ne Deva
노르웨이어 no Latn
페르시아어 fa Arab
폴란드어 pl Latn
포르투갈어 (포르투갈 및 브라질) pt Latn
펀자브어 pa Guru
루마니아어 ro Latn
러시아어 ru Cyrl
세르비아어 sr Cyrl
슬로바키아어 sk Latn
슬로베니아어 sl Latn
스페인어 es Latn
스웨덴어 sv Latn
타갈로그어 tl Latn
타밀어 ta Taml
텔루구어 te Telu
태국어 th Thai
터키어 tr Latn
우크라이나어 uk Cyrl
베트남어 vi Latn
이디시어 yi Hebr
프로세서 버전
버전 ID 배포 채널 출시 버전 성숙도 설명
pretrained-layout-parser-v1.0-2024-06-03 정식 GA 문서 레이아웃 분석의 정식 버전입니다. 기본 사전 학습된 프로세서 버전입니다.
pretrained-layout-parser-v1.5-2025-08-25 출시 후보 공개 프리뷰 PDF 파일의 레이아웃 분석을 개선하기 위해 Gemini 2.5 Flash LLM으로 구동되는 미리보기 버전입니다. 새 버전을 실험해 보려는 사용자에게 권장됩니다.
pretrained-layout-parser-v1.5-pro-2025-08-25 출시 후보 공개 프리뷰 PDF 파일의 레이아웃 분석을 개선하기 위해 Gemini 2.5 Pro LLM으로 구동되는 미리보기 버전입니다. v1.5-pro는 v1.5보다 지연 시간이 더 깁니다.
pretrained-layout-parser-v1.6-pro-2025-12-01 출시 후보 공개 프리뷰 Gemini 3.0 Pro LLM으로 구동되는 프리뷰 버전입니다.
pretrained-layout-parser-v1.6-2026-01-13 출시 후보 공개 프리뷰 Gemini 3.0 Flash LLM으로 구동되는 미리보기 버전입니다.

자세한 내용은 프로세서 버전 관리를 참고하세요.

할당량 및 한도
최대 페이지 수 (온라인/동기 요청): 15
최대 페이지 수 (일괄/오프라인/비동기 요청): 500
최대 페이지 수 (이미지 없는 모드 온라인/동기 요청): 30
Uptraining
샘플 입력 파일 새 창에서 열기
샘플 출력 새 창에서 열기
지원되는 지역
  • eu
  • us
추가 정보 레이아웃 파서

사전 학습된 프로세서 살펴보기

은행 명세서 파서

설명

은행 명세서에서 이름, 계좌, 거래 내역 등 추출

카테고리 선행 학습됨
함수 OCR, 항목 추출
출시 단계 정식 버전
액세스 상태 공개
API 입력 BANK_STATEMENT_PROCESSOR
참고
  • 다중 페이지 입력 파일의 페이지가 올바른 문서 유형이고 지원되는 버전 중 하나인 경우 프로세서가 지원되는 첫 번째 문서에서 엔티티 추출을 실행합니다. 프로세서가 입력 파일에서 적용 가능한 문서를 찾지 못하면 오류 메시지를 반환합니다.
지원되는 언어
언어 이름 BCP 47 태그 스크립트 필기 입력 지원
영어 en Latn
프로세서 버전
버전 ID 배포 채널 출시 버전 성숙도 설명
pretrained-bankstatement-v1.0-2021-08-08 정식 GA
pretrained-bankstatement-v1.1-2021-08-13 정식 GA
pretrained-bankstatement-v2.0-2021-12-10 정식 GA
pretrained-bankstatement-v3.0-2022-05-16 정식 GA 이 버전에서는 입력 파일에 은행 명세서가 하나만 포함되어 있다고 가정합니다. 기본 버전과 달리 이 버전은 은행 명세서의 입력 파일을 확인하지 않으며 은행 명세서가 없어도 오류를 반환하지 않습니다.
pretrained-bankstatement-v4.0-2023-07-31 출시 후보 공개 프리뷰
pretrained-bankstatement-v5.0-2023-12-06 정식 GA

자세한 내용은 프로세서 버전 관리를 참고하세요.

할당량 및 한도
최대 페이지 수 (온라인/동기 요청): 15
최대 페이지 수 (일괄/오프라인/비동기 요청): 30
최대 페이지 수 (이미지 없는 모드 온라인/동기 요청): 30
최신 버전에서 감지된 필드

감지된 필드 페이지에서도 이 정보를 확인할 수 있습니다.

전체 필드 목록
  • account_number
  • account_type
  • bank_address
  • bank_name
  • client_address
  • client_name
  • ending_balance
  • starting_balance
  • statement_date
  • statement_end_date
  • statement_start_date
  • table_item
    • table_item/transaction_deposit
    • table_item/transaction_deposit_date
    • table_item/transaction_deposit_description
    • table_item/transaction_withdrawal
    • table_item/transaction_withdrawal_date
    • table_item/transaction_withdrawal_description
보강된 필드

자세한 내용은 강화 및 정규화 페이지를 참고하세요.

정보가 추가된 필드의 전체 목록
  • bank_address
  • bank_name
정규화된 필드

자세한 내용은 강화 및 정규화 페이지를 참고하세요.

정규화된 필드의 전체 목록
  • ending_balance
  • starting_balance
  • statement_date
  • statement_end_date
  • statement_start_date
  • table_item/transaction_deposit
  • table_item/transaction_deposit_date
  • table_item/transaction_withdrawal
  • table_item/transaction_withdrawal_date
Uptraining
라벨 지정 안내 새 창에서 열기
샘플 입력 파일 새 창에서 열기
샘플 출력 새 창에서 열기
지원되는 지역
  • eu
  • us

W2 파서

설명

W2 양식에서 직원, 고용주, 임금 등 추출

카테고리 선행 학습됨
함수 OCR, 항목 추출
출시 단계 정식 버전
액세스 상태 공개
API 입력 FORM_W2_PROCESSOR
참고
  • 다중 페이지 입력 파일의 페이지가 올바른 문서 유형이고 지원되는 버전 중 하나인 경우 프로세서가 지원되는 첫 번째 문서에서 엔티티 추출을 실행합니다. 프로세서가 입력 파일에서 적용 가능한 문서를 찾지 못하면 오류 메시지를 반환합니다.
지원되는 언어
언어 이름 BCP 47 태그 스크립트 필기 입력 지원
영어 en Latn
지원되는 양식/버전
  • 2020년 (표준 및 맞춤 버전)
  • 2019년 (표준 및 맞춤 버전)
  • 2018년 (표준 및 맞춤 버전)
프로세서 버전
버전 ID 배포 채널 출시 버전 성숙도 추가 필드가 감지됨 설명
pretrained-w2-v1.0-2020-10-01 정식 GA

없음

pretrained-w2-v1.1-2022-01-27 정식 GA

없음

pretrained-w2-v1.2-2022-01-28 정식 GA
필드 표시
  • AllocatedTips
  • ControlNumber
  • DependentCareBenefits
  • EIN
  • EmployeeAddress
  • EmployeeName
  • EmployerNameAndAddress
  • EmployerStateIdNumber_Line1
  • FederalIncomeTaxWithheld
  • FormYear
  • LocalIncomeTax_Line1
  • LocalityName_Line1
  • LocalWagesTipsEtc_Line1
  • MedicareTaxWithheld
  • MedicareWagesAndTips
  • NonqualifiedPlans
  • SocialSecurityTaxWithheld
  • SocialSecurityTips
  • SocialSecurityWages
  • SSN
  • State_Line1
  • StateIncomeTax_Line1
  • StateWagesTipsEtc_Line1
  • WagesTipsOtherCompensation

품질 개선 및 새 필드 지원, 스플리터는 포함되지 않음

pretrained-w2-v2.0-2022-03-30 출시 후보 공개 프리뷰
필드 표시
  • AllocatedTips
  • ControlNumber
  • DependentCareBenefits
  • EIN
  • EmployeeAddress_AdditionalStreetAddressOrPostalBox
  • EmployeeAddress_City
  • EmployeeAddress_State
  • EmployeeAddress_StreetAddressOrPostalBox
  • EmployeeAddress_Zip
  • EmployeeName_FirstName
  • EmployeeName_LastName
  • EmployeeName_MiddleNameOrInitial
  • EmployerAddress_AdditionalStreetAddressOrPostalBox
  • EmployerAddress_City
  • EmployerAddress_State
  • EmployerAddress_StreetAddressOrPostalBox
  • EmployerAddress_Zip
  • EmployerName
  • EmployerStateIdNumber_Line1
  • FederalIncomeTaxWithheld
  • FormYear
  • LocalIncomeTax_Line1
  • LocalWagesTipsEtc_Line1
  • LocalityName_Line1
  • MedicareTaxWithheld
  • MedicareWagesAndTips
  • NonqualifiedPlans
  • SSN
  • SocialSecurityTaxWithheld
  • SocialSecurityTips
  • SocialSecurityWages
  • StateIncomeTax_Line1
  • StateWagesTipsEtc_Line1
  • State_Line1
  • WagesTipsOtherCompensation
  • a_Code
  • a_Value
  • b_Code
  • b_Value
  • c_Code
  • c_Value
  • d_Code
  • d_Value

품질 개선과 12번 입력란 필드 지원, EmployeeName, EmployeeAddress, EmployerNameAndAddress의 세부 예측이 더 이상 출력의 일부가 아니며 추가 필드로 대체됩니다.

pretrained-w2-v2.1-2022-06-08 정식 GA
필드 표시
  • AllocatedTips
  • ControlNumber
  • DependentCareBenefits
  • EIN
  • EmployeeAddress_AdditionalStreetAddressOrPostalBox
  • EmployeeAddress_City
  • EmployeeAddress_State
  • EmployeeAddress_StreetAddressOrPostalBox
  • EmployeeAddress_Zip
  • EmployeeName_FirstName
  • EmployeeName_LastName
  • EmployeeName_MiddleNameOrInitial
  • EmployeeName_Suffix
  • EmployerAddress_AdditionalStreetAddressOrPostalBox
  • EmployerAddress_City
  • EmployerAddress_State
  • EmployerAddress_StreetAddressOrPostalBox
  • EmployerAddress_Zip
  • EmployerName
  • EmployerStateIdNumber_Line1
  • FederalIncomeTaxWithheld
  • FormYear
  • LocalIncomeTax_Line1
  • LocalWagesTipsEtc_Line1
  • LocalityName_Line1
  • MedicareTaxWithheld
  • MedicareWagesAndTips
  • NonqualifiedPlans
  • SSN
  • SocialSecurityTaxWithheld
  • SocialSecurityTips
  • SocialSecurityWages
  • StateIncomeTax_Line1
  • StateWagesTipsEtc_Line1
  • State_Line1
  • WagesTipsOtherCompensation
  • a_Code
  • a_Value
  • b_Code
  • b_Value
  • c_Code
  • c_Value
  • d_Code
  • d_Value

버전 pretrained-w2-v2.0-2022-03-30와 유사하며 품질이 더욱 향상되었고 항목 EmployeeName_Suffix이 추가되었습니다.

자세한 내용은 프로세서 버전 관리를 참고하세요.

할당량 및 한도
최대 페이지 수 (온라인/동기 요청): 15
최대 페이지 수 (일괄/오프라인/비동기 요청): 15
최대 페이지 수 (이미지 없는 모드 온라인/동기 요청): 15
최신 버전에서 감지된 필드

감지된 필드 페이지에서도 이 정보를 확인할 수 있습니다.

전체 필드 목록
  • ControlNumber
  • EIN
  • EmployeeAddress
  • EmployeeName
  • EmployerNameAndAddress
  • FederalIncomeTaxWithheld
  • MedicareTaxWithheld
  • MedicareWagesAndTips
  • SSN
  • SocialSecurityTaxWithheld
  • SocialSecurityWages
  • WagesTipsOtherCompensation
보강된 필드

자세한 내용은 강화 및 정규화 페이지를 참고하세요.

정보가 추가된 필드의 전체 목록
  • EmployerNameAndAddress
  • EIN
Uptraining
샘플 입력 파일 새 창에서 열기
샘플 출력 새 창에서 열기
지원되는 지역
  • eu
  • us

신분증 증명 파서

설명

여러 신호를 사용하여 신분증의 유효성을 예측합니다.

신원 증명 문서 검증 프로세서는 다음과 같은 4개의 신호를 토대로 신분증의 유효성 예측을 지원하도록 설계되었습니다.

현재 프로세서는 다음 신호의 정보를 반환합니다.

  • fraud_signals_is_identity_document 감지: 이미지에 인식된 신분증이 포함되어 있는지 여부를 예측합니다.
  • fraud_signals_suspicious_words 감지: 신분증에 일반적으로 사용되지 않는 단어가 있는지 여부를 예측합니다.
  • fraud_signals_image_manipulation 감지: 이미지가 이미지 편집 도구를 통해 변경 또는 변조되었는지 여부를 예측합니다.
  • fraud_signals_online_duplicate 감지: 이미지를 온라인에서 찾을 수 있는지 여부를 예측합니다 (미국만 해당).

카테고리 선행 학습됨
함수 OCR, 품질 분석
출시 단계 정식 버전
액세스 상태 공개
API 입력 ID_PROOFING_PROCESSOR
참고
  • 온라인 중복 감지 기능은 현재 미국 데이터 센터에서 처리됩니다. 미국 외 지역에서는 이 기능에 대한 리전 및 멀티 리전 지원이 제공되지 않습니다.
  • 이 프로세서는 새 프로세서 버전이 출시되는 것보다 더 자주 업데이트되는 알고리즘에 의해 지원됩니다. 따라서 동일한 프로세서 버전을 사용하더라도 시간이 지남에 따라 프로세서에서 다른 출력을 반환할 수 있습니다. 예를 들어 온라인 중복 감지 시스템은 웹에 있는 이미지를 모니터링합니다. 그러면 시스템의 동작이 프로세서 버전에서 추적할 수 있는 것보다 더 빠르게 변경될 수 있습니다.
  • 책임감 있는 AI[†] 및 인적 검토[‡]에 관한 참고사항을 참고하세요.
지원되는 언어
언어 이름 BCP 47 태그 스크립트 필기 입력 지원
영어 en Latn
지원되는 양식/버전
  • 미국 여권, 패스카드, 운전면허증 지원
프로세서 버전
버전 ID 배포 채널 출시 버전 성숙도 추가 필드가 감지됨 설명
pretrained-id-proofing-v1.0-2022-10-03 정식 GA

없음

pretrained-id-proofing-v1.1-2023-05-18 출시 후보 공개 프리뷰
필드 표시
  • fraud_signals_photocopy_detection

추가 복사본 감지 신호