Aspose::Pdf::Text::TextAbsorber class

TextAbsorber class

Представляет объект‑поглотитель текста. Выполняет извлечение текста и предоставляет доступ к результату через объект TextAbsorber::Text.

class TextAbsorber : public System::Object

Методы

МетодОписание
get_Errors() constСписок объектов TextExtractionError. Содержит информацию об ошибках, найденных во время извлечения текста. Поиск ошибок будет выполнен только если TextSearchOptions.LogTextExtractionErrors = true; и это может снизить производительность.
virtual get_ExtractionOptions()Получает параметры извлечения текста.
get_HasErrors() constЗначение указывает, были ли обнаружены ошибки во время извлечения текста. Поиск ошибок будет выполнен только если TextSearchOptions.LogTextExtractionErrors = true; и это может снизить производительность.
virtual get_Text()Получает извлечённый текст, который TextAbsorber извлекает из PDF‑документа или страницы.
virtual get_TextSearchOptions()Получает параметры поиска текста.
virtual set_ExtractionOptions(System::SharedPtr<TextExtractionOptions>)Устанавливает параметры извлечения текста.
virtual set_TextSearchOptions(System::SharedPtr<Aspose::Pdf::Text::TextSearchOptions>)Устанавливает параметры поиска текста.
TextAbsorber()Инициализирует новый экземпляр TextAbsorber.
TextAbsorber(const System::SharedPtr<TextExtractionOptions>&)Инициализирует новый экземпляр TextAbsorber с параметрами извлечения.
TextAbsorber(const System::SharedPtr<TextExtractionOptions>&, const System::SharedPtr<Aspose::Pdf::Text::TextSearchOptions>&)Инициализирует новый экземпляр TextAbsorber с параметрами извлечения и поиска текста.
TextAbsorber(const System::SharedPtr<Aspose::Pdf::Text::TextSearchOptions>&)Инициализирует новый экземпляр TextAbsorber с параметрами поиска текста.
virtual Visit(System::SharedPtr<Page>)Извлекает текст на указанной странице.
virtual Visit(System::SharedPtr<XForm>)Извлекает текст в указанном XForm.
virtual Visit(System::SharedPtr<Document>)Извлекает текст в указанном документе.

Примечания

Объект TextAbsorber используется для извлечения текста из документа Pdf или его страницы.

См. также