Current section
Files
Jump to
Current section
Files
lib/xberg/extracted_document.ex
# This file is auto-generated by alef — DO NOT EDIT.
# alef:hash:0ba7524a2759609dc6f17c04fa9ae89940b7a540ae2e9a3708ac3fca410f8701
# To regenerate: alef generate
# To verify freshness: alef verify --exit-code
defmodule Xberg.ExtractedDocument do
@moduledoc """
Document extracted by the core extraction pipeline.
`extract` and `extract_batch` return an `ExtractionResult` envelope whose
`results` field contains these per-document payloads.
"""
@typedoc "Document extracted by the core extraction pipeline."
@type t :: %__MODULE__{
content: String.t() | nil,
mime_type: String.t() | nil,
metadata: Xberg.Metadata.t(),
extraction_method: String.t() | nil | nil,
tables: [Xberg.Table.t()],
counts: Xberg.DocumentCounts.t(),
detected_languages: [String.t()] | nil,
chunks: [Xberg.Chunk.t()] | nil,
images: [Xberg.ExtractedImage.t()] | nil,
pages: [Xberg.PageContent.t()] | nil,
elements: [Xberg.Element.t()] | nil,
djot_content: Xberg.DjotContent.t() | nil,
ocr_elements: [Xberg.OcrElement.t()] | nil,
document: Xberg.DocumentStructure.t() | nil,
extracted_keywords: [Xberg.Keyword.t()] | nil,
quality_score: float() | nil,
processing_warnings: [Xberg.ProcessingWarning.t()],
annotations: [Xberg.PdfAnnotation.t()] | nil,
children: [Xberg.ArchiveEntry.t()] | nil,
uris: [Xberg.ExtractedUri.t()] | nil,
revisions: [Xberg.DocumentRevision.t()] | nil,
structured_output: String.t() | nil,
code_intelligence: String.t() | nil,
llm_usage: [Xberg.LlmUsage.t()] | nil,
entities: [Xberg.Entity.t()] | nil,
summary: Xberg.DocumentSummary.t() | nil,
extraction_confidence: Xberg.ExtractionConfidence.t() | nil,
translation: Xberg.Translation.t() | nil,
page_classifications: [Xberg.PageClassification.t()] | nil,
redaction_report: Xberg.RedactionReport.t() | nil,
formulas: [Xberg.Formula.t()],
form_fields: [Xberg.PdfFormField.t()],
formatted_content: String.t() | nil
}
defstruct content: nil,
mime_type: nil,
metadata: nil,
extraction_method: nil,
tables: [],
counts: nil,
detected_languages: nil,
chunks: nil,
images: nil,
pages: nil,
elements: nil,
djot_content: nil,
ocr_elements: nil,
document: nil,
extracted_keywords: nil,
quality_score: nil,
processing_warnings: [],
annotations: nil,
children: nil,
uris: nil,
revisions: nil,
structured_output: nil,
code_intelligence: nil,
llm_usage: nil,
entities: nil,
summary: nil,
extraction_confidence: nil,
translation: nil,
page_classifications: nil,
redaction_report: nil,
formulas: [],
form_fields: [],
formatted_content: nil
defimpl Jason.Encoder do
@doc false
def encode(value, opts) do
value
|> Map.from_struct()
|> Enum.reject(fn {_k, v} -> v == nil end)
|> Enum.into(%{})
|> Jason.Encoder.encode(opts)
end
end
end