博客
关于我
强烈建议你试试无所不能的chatGPT,快点击我
python显示excel可视化html_我用Python做了一份PDF报告!!!
阅读量:6621 次
发布时间:2019-06-25

本文共 2782 字,大约阅读时间需要 9 分钟。

f7d1388d300dd8bdfcb76404badb9e34.png

这是恋习Python推荐的第28篇好文

来源:大邓与他的Python

作者:大邓

Pandas非常善于处理大规模数据,支持将结果导出到CSV,Excel,HTML,json等文件中。 如果您想将 多种信息(excel、图片等)组合 到一个文档中,那么事情变得更加困难。今天我们介绍如何将excel更好看的输出到pdf中,然后使用Jinja模板和WeasyPrint 再将其转换为独立的PDF文档。

操作流程

使用Pandas将数据输出到Excel文件中的多个工作表或者用DataFrames创建多个Excel文件非常方便。 但是,如果您想将 多种信息(excel、图片等)组合 输出到一个文件中,那么直接从Pandas进行操作的方法并不多。 幸运的是,万能的python大法有很多选项可以帮助我们。

在本文中,我将采用以下流程来创建多页PDF文档。

20da77dba3e9b78876b4262717cdf052.png

工具

我决定使用HTML作为模板语言,因为它可能是生成结构化数据最便捷的方法,支持各种格式数据(如图片、excel表)。我也认为每个人都知道(或可以弄清楚)足够的HTML知识来生成一个简单的报告。

这个工作流程中最困难的部分是弄清楚如何将HTML呈现为PDF。我觉得还没有最佳的解决方案,但我选择了 WeasyPrint ,因为它仍然在积极维护,我发现我可以相对容易地使它工作。作为替代方案,我过去使用过xhtml2pdf,它的效果也很好,遗憾的是该库缺乏文档说明,但它已存在一段时间,并且确实可以从HTML生成PDF。

数据

如上所述,我们将使用之前文章中的相同数据集。 为了使这一切成为一个独立的文章,下面是我如何导入数据,做描述性统计,及并生成关于CPU和软件销售的 数据透视表 。

导入模块,并读入销售渠道信息。

import pandas as pddf = pd.read_excel('salesfunnel.xlsx')df.head()

b1e532a68c44ba2ca128545e5745aa6b.png

对数据做透视表

sales_report = pd.pivot_table(df, index=["Manager", "Rep", "Product"],                               values=["Price", "Quantity"],                              aggfunc=[np.sum, np.mean],                               fill_value=0)sales_report.head()

161063b957a51bb5c2a83b0b1ed32a5b.png

模板

DataFrame拥有to_html()的方法,可以将dataframe数据转化为含有HTML格式的字符串。

但是随着您的报告变得越来越复杂或您选择将Jinja模板用于您的网络应用,jinja的这些功能将为您提供良好的服务。Jinja的另一个不错的功能是它包含多个内置过滤器,这些过滤器允许我们以Pandas中难以做到的方式格式化我们的一些数据。

为了在我们的应用程序中使用Jinja,我们需要做三件事:

1. 创建一个模板2. 将变量添加到模板上下文中3. 将模板渲染为HTML

这是一个非常简单的模板,我们称之为myreport.html:

    
   {<div></div> { title }}    title>head>    

Sales Funnel Report - Nationalh2>     {
{ national_pivot_table }} body>html>

上面html代码中拥有 {

{title}} 和 {
{national_pivot_table }}
 这两个关键词。这两个关键词用来接收需要渲染的数据,比如图片对象、dataframe对象等。

要填充这些变量,我们需要创建一个Jinja环境并获取我们的模板对象:

from jinja2 import Environment, FileSystemLoader env = Environment(loader=FileSystemLoader('.'))template = env.get_template('myreport.html')

在上面的示例中,我假设模板位于当前目录中,但您可以将完整路径放到模板位置。

另一个关键组件是 env 的创建。 这个变量是我们将数据(或对象)填充给模板的方式。 我们创建了一个名为 template_var 的字典,其中包含我们想要传递给模板的所有变量。

请注意变量的名称如何与我们的模板匹配。即名称要与myreport.html中的{

{}}夹住的关键词一样。

template_vars = {
"title" : "Sales Funnel Report - National",                 "national_pivot_table": sales_report.to_html()}

最后一步是将 template_vars 渲染到html模板中,并输出为html字符串,最终我们将使用该html字符串来生成pdf报告。 

html_out = template.render(template_vars)

为简洁起见,我不会显示完整的HTML,但您应该明白这一点。

生成pdf

pdf报告的生成部分相当简单,这里用到weasyprint库

from weasyprint import HTML HTML(string=html_out).write_pdf("report.pdf")

db84edf1558ccba81732d32a4b9851d9.png

但是打开的pdf样式很简单,白底黑字并不美观。之所以这样是因为我们没有使用自定义样式表css,但是咱们不熟悉css,有一种简单的办法就是用成熟的css,这里我用的typography.css 作为填充表格时的样式表。这个css的优点有:

1. 相对较小且易于理解2. 可以在PDF引擎中运行而不会抛出错误和警告3. 能让表格表格看起来很美观

让我们尝试使用我们更新的样式表重新渲染它:

HTML(string=html_out).write_pdf('beautiful_report.pdf', stylesheets=["typography.css"])

7e22f687865af85b075ceec1b7495d31.png

添加了一个stylesheets参数就让输出结果瞬间变得高端大气上档次。关注恋习Python后台回复“PDF”即可得到本项目代码。

精选文章:

深度好文 |Matplotlib 可视化最有价值的 50 个图表(附完整 Python 源代码)

30个常用Python实现,新手必备!

Python读写Excel表格,就是这么简单粗暴又好用

觉得有用,点个好看可否!

转载地址:http://qkcpo.baihongyu.com/

你可能感兴趣的文章
Codeforces 433 C. Ryouko&#39;s Memory Note
查看>>
java中的Static class
查看>>
实例讲解Linux下的makefile
查看>>
json lib 2.4及其依赖包下载
查看>>
SET XACT_ABORT ON
查看>>
计算机中文核心期刊
查看>>
sql的left join 命令
查看>>
8148 8168 中移植live55 出现except rtsp 中途莫名的断流
查看>>
查询及删除重复记录的方法
查看>>
黑苹果Yosemite 10.10.1懒人版完美安装及简单驱动设置
查看>>
【BZOJ】3832: [Poi2014]Rally
查看>>
[转]看懂ExtJS的API
查看>>
宜昌民生大厦
查看>>
推荐15款制作 SVG 动画的 JavaScript 库
查看>>
陀螺仪原理--网上转载
查看>>
转:OpenResty最佳实践(推荐了解lua语法)
查看>>
转:CEO, CFO, CIO, CTO, CSO是什么
查看>>
P2P之UDP穿透NAT的原理与实现 - 增强篇(附修改过的源代码)
查看>>
添加 All Exceptions 断点后, 每次运行都会在 main.m 中断的一种解决方法
查看>>
[Ubuntu] fg、bg让你的进程在前后台之间切换
查看>>