【尚学堂源码在哪找】【手机维修平台源码】【有信商城源码】pdfbox 源码-皮皮网

【尚学堂源码在哪找】【手机维修平台源码】【有信商城源码】pdfbox 源码

时间:2024-12-22 23:46:14 来源：delphi 曲线滤波源码编辑：Ai电子秤源码

1.我想问下 JAVA中如何读取PDF文件里面的源码内容谁给个详细的例子谢谢

pdfbox 源码

我想问下 JAVA中如何读取PDF文件里面的内容谁给个详细的例子谢谢

用Java简单的读取pdf文件中的数据：

第一步：下载PDFBox-0.7.2.jar。提供一个下载地址：/Resource.aspx?源码CID=--4ae1-b-c9e&RID=cd8f-1cee-b6-a3df-0eff8e0d2解压后，把lib文件下的源码尚学堂源码在哪找PDFBox-0.7.2.jar，PDFBox-0.7.2-log4j.jar放到你classpath路径下。源码（我把源码以及jar包都放到下面的源码手机维修平台源码附件里，方面你的源码有信商城源码使用。）

第二步：写个简单的源码读取pdf文件的程序。(PdfReader.java)

import java.io.File;

import java.io.FileOutputStream;

import java.io.OutputStreamWriter;

import java.io.Writer;

import java.net.MalformedURLException;

import java.net.URL;

import org.pdfbox.pdmodel.PDDocument;

import org.pdfbox.util.PDFTextStripper;

public class PdfReader {

public void readFdf(String file) throws Exception {

// 是源码否排序

boolean sort = false;

// pdf文件名

String pdfFile = file;

// 输入文本文件名称

String textFile = null;

// 编码方式

String encoding = "UTF-8";

// 开始提取页数

int startPage = 1;

// 结束提取页数

int endPage = Integer.MAX_VALUE;

// 文件输入流，生成文本文件

Writer output = null;

// 内存中存储的源码PDF Document

PDDocument document = null;

try {

// 首先当作一个URL来装载文件，如果得到异常再从本地文件系统//去装载文件

URL url = new URL(pdfFile);

//注意参数已不是源码以前版本中的URL.而是File。

document = PDDocument.load(pdfFile);

// 获取PDF的源码文件名

String fileName = url.getFile();

// 以原来PDF的名称来命名新产生的txt文件

if (fileName.length() > 4) {

File outputFile = new File(fileName.substring(0, fileName

.length() - 4)

+ ".txt");

textFile = outputFile.getName();

}

} catch (MalformedURLException e) {

// 如果作为URL装载得到异常则从文件系统装载

//注意参数已不是以前版本中的URL.而是File。

document = PDDocument.load(pdfFile);

if (pdfFile.length() > 4) {

textFile = pdfFile.substring(0,源码 pdfFile.length() - 4)

+ ".txt";

}

// 文件输入流，写入文件倒textFile

output = new OutputStreamWriter(new FileOutputStream(textFile),源码blue大神的源码

encoding);

// PDFTextStripper来提取文本

PDFTextStripper stripper = null;

stripper = new PDFTextStripper();

// 设置是否排序

stripper.setSortByPosition(sort);

// 设置起始页

stripper.setStartPage(startPage);

// 设置结束页

stripper.setEndPage(endPage);

// 调用PDFTextStripper的writeText提取并输出文本

stripper.writeText(document, output);

} finally {

if (output != null) {

// 关闭输出流

output.close();

}

if (document != null) {

// 关闭PDF Document

document.close();

}

* @param args

public static void main(String[] args) {

// TODO Auto-generated method stub

PdfReader pdfReader = new PdfReader();

try {

// 取得E盘下的SpringGuide.pdf的内容

pdfReader.readFdf("E:\\SpringGuide.pdf");

} catch (Exception e) {

e.printStackTrace();

}

这样就简单的完成了从pdf中读取数据了。在你的源码pdf文件所在的目录下生成一个同名的txt文件。

源码树莓派 omxplayer 源码

关注更多相关资讯请点击《综合》专栏

上一条：黑龙江哈尔滨、牡丹江两地联手共筑旅游监管防线
下一条：浙江培育放心消费商圈485个清除“霸王条款”179条

【尚学堂源码在哪找】【手机维修平台源码】【有信商城源码】pdfbox 源码

相关文章