PDFIntact

从 PDF 中原样取出表格与正文

您需要 PDF 图表背后的数值

您想把报告或白皮书里图表的数字用到自己的表格中,但底层数据从未公开。只能照着图一个个抄,而抄错一位数字事后根本查不出来。

在 PDF 内部,图表只是线条、填充与字符,数值并不存放在任何地方。机器必须做您用眼睛做的事:从坐标轴刻度和柱形高度推算出数值。

🔴 这里要紧的是把读到的与推测的分开。图表若标注了数值,我们就读它;若没有,数值就来自形状。PDFIntact 绝不把推测值装扮成事实,因为一旦混在一起,它们就会进入某个人的报告,错误随之传开。

现在就试

用您自己的 PDF 确认

检测完全在您的浏览器内进行。文件不会被发送到任何地方,也无需注册。付款前就能看到能提取多少页、多少表格与图表。

实例

確度の3段階

結果には、値ごとに次のいずれかが付きます。

測定

グラフや文書に書かれている数値を読み取ったもの。そのまま使えます。

推定

数値ラベルが無く、形状と軸目盛りから推定したもの。元のグラフと照合してください。

読み取り不可

判断できなかったもの。空欄にせず、そう表示します。

常见问题

能读取 PDF 图表里的数值吗?
可以。柱形图、折线图和饼图都会被分析,系列与数值以表格形式导出到 Excel、Markdown 或 JSON。图表若标注了数字,就直接读取那些数字。
没有标注数字的图表怎么办?
数值会依据形状(柱形高度、数据点位置)与坐标轴刻度推测得出。这类数值一律标为推测值,绝不与读到的数值混在一起——把推测当作事实呈现,它就会被当作事实引用。
有读不了的图表吗?
多个图表合并成一张图的情况不在范围内。系列密集重叠,或图例仅以颜色区分系列时,准确度也会下降。哪些无法转换,购买前的检测会告诉您。
图表可以导出成哪些格式?
Excel(表格与图表分置于不同工作表)、Markdown 和 JSON。JSON 还带有坐标与可信度,可以追溯某个数值来自哪一页的哪个位置。图表也可以随正文一起导出到 Word。

把其他症状也一并检测各导出格式的差异