SaveDOCXToStream
Konwersja dokumentów, wyodrębnianie, DOCX, strumienie
Opis
Przekształca zakres stron PDF w edytowalny dokument WordprocessingML i zapisuje pakiet DOCX w bieżącej pozycji strumienia
Składnia
Function TPDFlib.SaveDOCXToStream(Const PageRange: WideString;
Options: Integer; Target: TStream): Integer;Parametry
| PageRange | Zakres stron liczony od jedynki albo pusty ciąg oznaczający wszystkie strony; jawna kolejność stron zostaje zachowana |
|---|---|
| Options | Maska bitowa: PDF_DOCX_INCLUDE_IMAGES = 1 osadza obrazy stron jako swobodne obiekty PNG, PDF_DOCX_DETECT_HEADINGS = 2 odwzorowuje duże krótkie wiersze na nagłówki Heading 1–Heading 3, PDF_DOCX_PRESERVE_STYLES = 4 zachowuje nazwy i rozmiary czcionek, kolory, pogrubienie, kursywę, indeks górny i dolny, a PDF_DOCX_PRESERVE_PAGE_BREAKS = 8 wstawia edytowalne podziały stron; PDF_DOCX_DEFAULT włącza wszystkie cztery |
| Target | Strumień docelowy, który nie staje się własnością biblioteki |
Wartości zwracane
Zwraca liczbę przekonwertowanych stron albo zero, gdy walidacja, anulowanie, ekstrakcja, pakowanie lub zapis się nie powiedzie
Uwagi
Analiza używa SetStructuredTextOptions niezależnie od specyficznych dla formatu opcji Options; źródła kolejności czytania i ostrzeżenia fallbacku sprawdź w GetLastStructuredTextDiagnostics
Gdy powiązania treści są kompletne, pierwszeństwo ma rzeczywista kolejność drzewa tagów; treść nierozwiązana lub niejednoznaczna zachowuje wyodrębniony tekst w fallbacku mieszanym albo geometrycznym, a nieznanych ról niestandardowych nie zgaduje się po ich nazwach
Akapity w kolejności czytania, listy punktowane i numerowane oraz tabele stają się natywną, edytowalną treścią Word, a nie migawkami stron
Puste komórki otagowane, zakresy poziome i pionowe używają natywnych komórek tabel Word, w:gridSpan i w:vMerge
Scalone fragmenty tabel pozostają w jednym w:tbl przez strony, a rozpoznane powtarzające się nagłówki kontynuacji są pomijane; opcja podziału strony wstawia edytowalny podział w kontynuowanej tabeli
Kolumny geometryczne, elementy stałe marginesów, dopasowywanie kontynuacji i włączane jawnie wnioskowane scalenia pozostają heurystyką; gdy wierność ma znaczenie, obejrzyj najnowsze diagnostyki i pochodzenie w strukturalnym JSON
Modele wybranych stron i dołączone obrazy są przechowywane dla analizy całego dokumentu; składanie XML i pakietu używa dodatkowych buforów, więc pamięć rośnie wraz z wybraną treścią i obrazami
Dane wyjściowe są deterministycznym pakietem DOCX ZIP z wpisami raw Deflate sprawdzanymi przez CRC i nie wymagają instalacji Office
Wyodrębnianie zachowuje wybraną stronę i otwarty stos tagów zapisu; bieżące niezapisane tagi zapisu trafiają do wyniku bez tagów zamykających i bez finalizowania dokumentu
Wartość LastErrorCode wynosi 114 dla nieprawidłowych argumentów oraz 518 dla błędów ekstrakcji, pakowania lub strumienia
Zobacz również
SaveDOCXToFile, ExtractStructuredDocument, ExportDocumentHTML