SaveDOCXToStream

Konwersja dokumentów, wyodrębnianie, DOCX, strumienie

Opis

Przekształca zakres stron PDF w edytowalny dokument WordprocessingML i zapisuje pakiet DOCX w bieżącej pozycji strumienia

Składnia

Function TPDFlib.SaveDOCXToStream(Const PageRange: WideString;
  Options: Integer; Target: TStream): Integer;

Parametry

PageRangeZakres stron liczony od jedynki albo pusty ciąg oznaczający wszystkie strony; jawna kolejność stron zostaje zachowana
OptionsMaska bitowa: PDF_DOCX_INCLUDE_IMAGES = 1 osadza obrazy stron jako swobodne obiekty PNG, PDF_DOCX_DETECT_HEADINGS = 2 odwzorowuje duże krótkie wiersze na nagłówki Heading 1–Heading 3, PDF_DOCX_PRESERVE_STYLES = 4 zachowuje nazwy i rozmiary czcionek, kolory, pogrubienie, kursywę, indeks górny i dolny, a PDF_DOCX_PRESERVE_PAGE_BREAKS = 8 wstawia edytowalne podziały stron; PDF_DOCX_DEFAULT włącza wszystkie cztery
TargetStrumień docelowy, który nie staje się własnością biblioteki

Wartości zwracane

Zwraca liczbę przekonwertowanych stron albo zero, gdy walidacja, anulowanie, ekstrakcja, pakowanie lub zapis się nie powiedzie

Uwagi

Analiza używa SetStructuredTextOptions niezależnie od specyficznych dla formatu opcji Options; źródła kolejności czytania i ostrzeżenia fallbacku sprawdź w GetLastStructuredTextDiagnostics

Gdy powiązania treści są kompletne, pierwszeństwo ma rzeczywista kolejność drzewa tagów; treść nierozwiązana lub niejednoznaczna zachowuje wyodrębniony tekst w fallbacku mieszanym albo geometrycznym, a nieznanych ról niestandardowych nie zgaduje się po ich nazwach

Akapity w kolejności czytania, listy punktowane i numerowane oraz tabele stają się natywną, edytowalną treścią Word, a nie migawkami stron

Puste komórki otagowane, zakresy poziome i pionowe używają natywnych komórek tabel Word, w:gridSpan i w:vMerge

Scalone fragmenty tabel pozostają w jednym w:tbl przez strony, a rozpoznane powtarzające się nagłówki kontynuacji są pomijane; opcja podziału strony wstawia edytowalny podział w kontynuowanej tabeli

Kolumny geometryczne, elementy stałe marginesów, dopasowywanie kontynuacji i włączane jawnie wnioskowane scalenia pozostają heurystyką; gdy wierność ma znaczenie, obejrzyj najnowsze diagnostyki i pochodzenie w strukturalnym JSON

Modele wybranych stron i dołączone obrazy są przechowywane dla analizy całego dokumentu; składanie XML i pakietu używa dodatkowych buforów, więc pamięć rośnie wraz z wybraną treścią i obrazami

Dane wyjściowe są deterministycznym pakietem DOCX ZIP z wpisami raw Deflate sprawdzanymi przez CRC i nie wymagają instalacji Office

Wyodrębnianie zachowuje wybraną stronę i otwarty stos tagów zapisu; bieżące niezapisane tagi zapisu trafiają do wyniku bez tagów zamykających i bez finalizowania dokumentu

Wartość LastErrorCode wynosi 114 dla nieprawidłowych argumentów oraz 518 dla błędów ekstrakcji, pakowania lub strumienia

Zobacz również

SaveDOCXToFile, ExtractStructuredDocument, ExportDocumentHTML