SaveDOCXToStream

문서 변환, 추출, DOCX, 스트림

설명

PDF 페이지 범위를 편집 가능한 WordprocessingML 문서로 변환하고 현재 스트림 위치에 DOCX 패키지를 씁니다

구문

Function TPDFlib.SaveDOCXToStream(Const PageRange: WideString;
  Options: Integer; Target: TStream): Integer;

매개변수

PageRange1부터 시작하는 페이지 범위이며 빈 문자열이면 모든 페이지를 나타냅니다. 명시적인 페이지 순서는 유지됩니다
Options비트 마스크: PDF_DOCX_INCLUDE_IMAGES = 1은 페이지 이미지를 부동 PNG 객체로 포함하고, PDF_DOCX_DETECT_HEADINGS = 2는 크고 짧은 줄을 Heading 1~Heading 3에 매핑하며, PDF_DOCX_PRESERVE_STYLES = 4는 글꼴 이름, 크기, 색상, Bold, Italic, 위 첨자 및 아래 첨자를 유지하고, PDF_DOCX_PRESERVE_PAGE_BREAKS = 8은 편집 가능한 페이지 나누기를 삽입하며, PDF_DOCX_DEFAULT는 네 항목을 모두 활성화함
Target라이브러리가 소유하지 않는 대상 스트림

반환 값

변환된 페이지 수를 반환하며 검증, 취소, 추출, 패키징 또는 쓰기 실패 시 0을 반환합니다

비고

분석은 형식별 Options와 별개로 SetStructuredTextOptions를 사용합니다. 읽기 소스와 폴백 경고는 GetLastStructuredTextDiagnostics에서 확인하십시오

콘텐츠 바인딩이 완전하면 실제 태그 트리 순서가 우선합니다. 해석되지 않거나 모호한 콘텐츠는 mixed 또는 geometric 폴백으로 추출 텍스트를 유지하고, 알 수 없는 사용자 정의 역할은 이름으로 추측하지 않습니다

읽기 순서 단락, 글머리표 및 번호 목록, 표는 페이지 스냅샷 대신 편집 가능한 네이티브 Word 콘텐츠가 됩니다

빈 태그 셀, 가로 범위, 세로 범위는 네이티브 Word 표 셀, w:gridSpan, w:vMerge를 사용합니다

이어진 표 조각은 페이지에 걸쳐 하나의 w:tbl에 남고 식별된 반복 헤더 행은 생략됩니다. 페이지 나누기 옵션은 이어지는 표에 편집 가능한 나누기를 삽입합니다

기하학적 단, 여백 장식 요소, 이어짐 매칭, 옵트인 병합 추론은 휴리스틱으로 남습니다. 충실도가 중요하면 최신 진단과 구조화 JSON 출처를 확인하십시오

선택한 페이지 모델과 포함된 이미지는 문서 전역 분석을 위해 유지되고 XML과 패키지 조립이 추가 버퍼를 쓰므로, 메모리는 선택한 콘텐츠와 이미지에 따라 늘어납니다

출력은 CRC 검사된 원시 Deflate 항목을 포함하는 결정론적 DOCX ZIP 패키지이며 Office를 설치할 필요가 없습니다

추출은 선택한 페이지와 열린 라이터 태그 스택을 유지합니다. 아직 저장하지 않은 현재 라이터 태그는 태그를 닫거나 문서를 마무리하지 않고 그대로 포함됩니다

잘못된 인수이면 LastErrorCode는 114이고 추출, 패키징 또는 스트림 실패이면 518입니다

참고 항목

SaveDOCXToFile, ExtractStructuredDocument, ExportDocumentHTML