网站首页 > 文章中心 > 其它

php如何提取pdf数据

作者:小编 更新时间:2023-10-05 13:36:14 浏览量:67人看过

PDF如何提取页面?怎么提取PDF文件中的某一页

要实现pdf的提取就必须要用到百度网盘,功能强大,使用方法简单.是一款必备的软件.

第一步,打开百度网盘主界面选择文档.

第二步,在文档页面选择全部工具.

第三步,在全部工具里找到,选择pdf提取.

php如何提取pdf数据-图1

第四步,选择网盘中的的文件.pdf文件开始提取.

第五步,等待提取完成.

注意事项

php提取pdf文本和图片有谁知道原理的

I 先来取模操作,实现步骤:

①..定位图片需要识别区域,从图片中取出此部分

II进行图片文字提取,实现步骤:

如何从php程序读取pdf文档中的文本信息

PHP程序pdf格式文件函数库

PDF是Adobe所发展的可携式文件格式,它的文件可以在网络上传输、浏览,甚至使用印表机印出,或使用其它输出装置输出,都可以保存原来的文字及图片的编排.详细的信息可以参考 Adobe 的网站.参考其中有关 PDF 或 Acrobat 的部份.

php如何提取pdf数据-图2

在 UNIX 系统中,可以使用 Thomas Merz 开发的 PDF 函数库.将它编译安装完成后,再编译 PHP 程序方可供 PHP 使用 pdflib.编译时可能要 JPEG library 及 TIFF library.

除了用这个函数库可以建立 PDF 文件外,FastIO 公司发展的产品 ClibPDF 也可以处理 PDF 文件.

以下为处理 PDF 文件的范例,本例对 test.pdf 加工后等待用户读取.

php

$fp = fopen("test.pdf", "w");

$pdf = PDF_open($fp);

pdf_set_info_author($pdf, "Uwe Steinmann");

PDF_set_info_author($pdf, "Name of Author");

pdf_set_info_creator($pdf, "See Author");

pdf_set_info_subject($pdf, "Testing");

PDF_add_outline($pdf, "Page 1");

pdf_set_text_rendering($pdf, 1);

pdf_stroke($pdf);

PDF_end_page($pdf);

PDF_close($pdf);

fclose($fp);

$fp = fopen("test.pdf", "r");

header("Content-type: application/pdf");

fpassthru($fp);

PDF_get_info: 返回文件信息.

PDF_set_info_creator: 配置建档者字符串.

PDF_set_info_title: 配置文件标题.

PDF_set_info_subject: 配置文件主题.

PDF_set_info_keywords: 配置文件的关键字.

PDF_open: 建立新的 PDF 档.

PDF_close: 关闭 PDF 档.

PDF_begin_page: 启始 PDF 文件页面.

PDF_end_page: 关闭 PDF 文件页面.

PDF_show: 输出字符串到 PDF 文件.

PDF_show_xy: 输出字符串到指定坐标.

PDF_set_font: 配置使用的字型及大小.

PDF_set_leading: 配置行距.

PDF_set_text_rendering: 配置文字表现方式.

PDF_set_horiz_scaling: 配置文字水平间距.

PDF_set_text_rise: 配置文字高度.

PDF_set_text_matrix: 配置文字矩阵.

PDF_set_text_pos: 配置文字位置.

PDF_set_char_spacing: 配置字符间距.

php如何提取pdf数据-图3

PDF_set_word_spacing: 配置字间距.

PDF_continue_text: 输出文字.

PDF_stringwidth: 计算字符串的宽度.

PDF_save: 储存环境变量.

PDF_restore: 还原环境变量.

PDF_translate: 移动原点.

PDF_scale: 缩放类.

PDF_rotate: 旋转类.

PDF_setflat: 配置平滑值.

PDF_setlinejoin: 配置连接参数.

PDF_setlinecap: 配置 linecap 参数.

PDF_setmiterlimit: 配置斜边界限.

PDF_setlinewidth: 配置线宽.

PDF_setdash: 配置虚线样式.

PDF_moveto: 配置处理的坐标点.

PDF_curveto: 绘贝氏曲线.

PDF_lineto: 绘直线.

PDF_circle: 绘圆.

PDF_arc: 绘弧.

PDF_rect: 绘长方形.

PDF_closepath: 形成封闭的向量形状.

PDF_stroke: 沿向量绘线.

PDF_closepath_stroke: 形成封闭的向量形状并沿向量绘线.

PDF_fill: 填满目前的向量.

PDF_fill_stroke: 填满目前的向量并沿向量绘线.

PDF_closepath_fill_stroke: 形成封闭的向量形状沿向量绘线并填满.

PDF_endpath: 关闭目前向量.

PDF_clip: 组合所有向量.

PDF_setgray_fill: 指定填入的颜色为灰阶.

PDF_setgray_stroke: 指定绘图的颜色为灰阶.

PDF_setgray: 指定绘图的颜色为灰阶并填入.

PDF_setrgbcolor_fill: 指定填入的颜色为彩色.

PDF_setrgbcolor_stroke: 指定绘图的颜色为彩色.

PDF_setrgbcolor: 指定绘图的颜色为彩色并填入.

PDF_add_outline: 目前页面加入书签.

PDF_set_transition: 配置页的转换.

PDF_set_duration: 配置二页的切换时间.

PDF_open_gif: 打开 GIF 图档.

PDF_open_memory_image: 打开内存图档.

PDF_open_jpeg: 打开 JPEG 图档.

PDF_close_image: 关闭图档.

PDF_place_image: 放置图片到 PDF 档指定位置.

PDF_put_image: 放置图片到 PDF 档.

PDF_execute_image: 放置 PDF 档中图片到指定位置.

PDF_add_annotation: 加入注释.

以上就是土嘎嘎小编为大家整理的php如何提取pdf数据相关主题介绍,如果您觉得小编更新的文章只要能对粉丝们有用,就是我们最大的鼓励和动力,不要忘记讲本站分享给您身边的朋友哦!!

版权声明:倡导尊重与保护知识产权。未经许可,任何人不得复制、转载、或以其他方式使用本站《原创》内容,违者将追究其法律责任。本站文章内容,部分图片来源于网络,如有侵权,请联系我们修改或者删除处理。

编辑推荐

热门文章