using IronPdf;using System.IO;PdfDocument pdf = PdfDocument.FromFile("sample.pdf");// Extract textstring text = pdf.ExtractAllText();// Export the extracted text to a text fileFile.WriteAllText("extractedText.txt", text);
using IronPdf;
using System.IO;
PdfDocument pdf = PdfDocument.FromFile("sample.pdf");
// Extract text
string text = pdf.ExtractAllText();
// Export the extracted text to a text file
File.WriteAllText("extractedText.txt", text);
ImportsIronPdfImportsSystem.IOPrivate pdf AsPdfDocument = PdfDocument.FromFile("sample.pdf")' Extract textPrivate text AsString = pdf.ExtractAllText()' Export the extracted text to a text fileFile.WriteAllText("extractedText.txt", text)
Imports IronPdf
Imports System.IO
Private pdf As PdfDocument = PdfDocument.FromFile("sample.pdf")
' Extract text
Private text As String = pdf.ExtractAllText()
' Export the extracted text to a text file
File.WriteAllText("extractedText.txt", text)
using IronPdf;using System.IO;using System.Linq;// Open PDF from filePdfDocument pdf = PdfDocument.FromFile("sample.pdf");// Extract text by linesvar lines = pdf.Pages[0].Lines;// Extract text by charactersvar characters = pdf.Pages[0].Characters;File.WriteAllLines("lines.txt", lines.Select(l => $"at Y={l.BoundingBox.Bottom:F2}: {l.Contents}"));
using IronPdf;
using System.IO;
using System.Linq;
// Open PDF from file
PdfDocument pdf = PdfDocument.FromFile("sample.pdf");
// Extract text by lines
var lines = pdf.Pages[0].Lines;
// Extract text by characters
var characters = pdf.Pages[0].Characters;
File.WriteAllLines("lines.txt", lines.Select(l => $"at Y={l.BoundingBox.Bottom:F2}: {l.Contents}"));
ImportsIronPdfImportsSystem.IOImportsSystem.Linq' Open PDF from filePrivate pdf AsPdfDocument = PdfDocument.FromFile("sample.pdf")' Extract text by linesPrivate lines = pdf.Pages(0).Lines' Extract text by charactersPrivate characters = pdf.Pages(0).CharactersFile.WriteAllLines("lines.txt", lines.Select(Function(l) $"at Y={l.BoundingBox.Bottom:F2}: {l.Contents}"))
Imports IronPdf
Imports System.IO
Imports System.Linq
' Open PDF from file
Private pdf As PdfDocument = PdfDocument.FromFile("sample.pdf")
' Extract text by lines
Private lines = pdf.Pages(0).Lines
' Extract text by characters
Private characters = pdf.Pages(0).Characters
File.WriteAllLines("lines.txt", lines.Select(Function(l) $"at Y={l.BoundingBox.Bottom:F2}: {l.Contents}"))
using IronPdf;PdfDocument pdf = PdfDocument.FromFile("sample.pdf");// Extract imagesvar images = pdf.ExtractAllImages();for(int i = 0; i < images.Count; i++){ // Export the extracted images images[i].SaveAs($"images/image{i}.png");}
using IronPdf;
PdfDocument pdf = PdfDocument.FromFile("sample.pdf");
// Extract images
var images = pdf.ExtractAllImages();
for(int i = 0; i < images.Count; i++)
{
// Export the extracted images
images[i].SaveAs($"images/image{i}.png");
}
ImportsIronPdfPrivate pdf AsPdfDocument = PdfDocument.FromFile("sample.pdf")' Extract imagesPrivate images = pdf.ExtractAllImages()For i AsInteger = 0 To images.Count - 1 ' Export the extracted images images(i).SaveAs($"images/image{i}.png")Next i
Imports IronPdf
Private pdf As PdfDocument = PdfDocument.FromFile("sample.pdf")
' Extract images
Private images = pdf.ExtractAllImages()
For i As Integer = 0 To images.Count - 1
' Export the extracted images
images(i).SaveAs($"images/image{i}.png")
Next i
using IronPdf;PdfDocument pdf = PdfDocument.FromFile("sample.pdf");// Extract text from page 1string textFromPage1 = pdf.ExtractTextFromPage(0);int[] pages = new[] { 0, 2 };// Extract text from pages 1 & 3string textFromPage1_3 = pdf.ExtractTextFromPages(pages);
using IronPdf;
PdfDocument pdf = PdfDocument.FromFile("sample.pdf");
// Extract text from page 1
string textFromPage1 = pdf.ExtractTextFromPage(0);
int[] pages = new[] { 0, 2 };
// Extract text from pages 1 & 3
string textFromPage1_3 = pdf.ExtractTextFromPages(pages);
ImportsIronPdfPrivate pdf AsPdfDocument = PdfDocument.FromFile("sample.pdf")' Extract text from page 1Private textFromPage1 AsString = pdf.ExtractTextFromPage(0)Private pages() AsInteger = { 0, 2 }' Extract text from pages 1 & 3Private textFromPage1_3 AsString = pdf.ExtractTextFromPages(pages)
Imports IronPdf
Private pdf As PdfDocument = PdfDocument.FromFile("sample.pdf")
' Extract text from page 1
Private textFromPage1 As String = pdf.ExtractTextFromPage(0)
Private pages() As Integer = { 0, 2 }
' Extract text from pages 1 & 3
Private textFromPage1_3 As String = pdf.ExtractTextFromPages(pages)
How can IronPDF assist with extracting text from PDFs containing international languages?
IronPDF maintains proper encoding and character representation for international languages and UTF-8 characters, ensuring correct text extraction and display for non-Latin scripts and special characters.
Is it possible to extract images from a PDF for use in Azure Blob Storage using IronPDF?
Yes, IronPDF's image extraction capabilities are compatible with Azure Blob Storage workflows, allowing you to save extracted images in various formats and manage them effectively in the cloud.
Does IronPDF support extracting text from specific layers within a PDF?
Yes, IronPDF can extract text from specific layers (OCGs) within a PDF using the `ExtractTextFromLayer` and `GetTextObjectsByLayer` methods, which target content grouped in named layers like CAD drawings or map exports.