Apache POI 操作 Excel 和 Word

本贴最后更新于 2749 天前,其中的信息可能已经沧海桑田

Apache POI 官网下载:
http://poi.apache.org/download.html
下面需要用到的 poi jar 包百度网盘分享:
https://pan.baidu.com/s/1i4DDcpB

具体代码

java 使用 poi 读取 Word:
这里我们把在 word 中读取到的图片保存到一个专门的地方,内容用 html 的 img 标签代替

	/**
	 * 读取doc文件
	 * docPath: doc文件路径
	 * descImageFolder: doc文件中的图片存放位置文件夹
	 */
	public static StringBuilder readDoc(String docPath,String descImageFolder) throws Exception{
		InputStream is=new FileInputStream(new File(docPath));
		//poi读取doc
		HWPFDocument doc=new HWPFDocument(is);
		//存储doc内容
		StringBuilder sb=new StringBuilder();
		//获取doc图片表格对象
		PicturesTable pt=doc.getPicturesTable();
		Range docr=doc.getRange();
		CharacterRun run=null;
		for (int i = 0; i < docr.numCharacterRuns(); i++) {
			run=docr.getCharacterRun(i);
			//判断是不是图片
			if(pt.hasPicture(run)){
				//图片对象
				Picture pic=pt.extractPicture(run, true);
				//图片路径,文件以系统时间命名
				String imgSrc=descImageFolder+"/"+System.currentTimeMillis()+"."+pic.suggestFullFileName();
				sb.append("<img src='").append(imgSrc).append("' />");
				//输出图片
				this.writeFile(imgSrc,pic.getContent());
			}else{
				//在该范围内遍历字符,判断是否有换行符
				for(int j=run.getStartOffset();j<run.getEndOffset();j++){
					//获取单个字符
					String text=new Range(j, j+1, doc).text();
					int code=text.hashCode();
					//根据code判断是否有换行
					if(code==13||code==7)
						sb.append("\n");
					else
						sb.append(text);
				}
			}
		}
		return sb;
	}

	/**输出文件*/
	public static void writeFile(String path,byte []file){
		try{
			File f=new File(path);
			if(!f.exists())
				f.createNewFile();
			OutputStream os=new FileOutputStream(f);
			os.write(file);
			os.close();
		}catch(Exception e){e.printStackTrace();}
	}
	
	//main方法测试
	public static void main(String[] args) throws Exception {
		String docPath="C:/Users/Administrator/Desktop/测试.doc";
		String descImageFolder="C:/Users/Administrator/Desktop";
		StringBuilder sb=readDoc(docPath, descImageFolder);
		System.out.println(sb.toString());
	}

java 使用 poi 读取 Excel:

	//读取Excel打印到控制台
	public static void main(String[] args) throws Exception{
		String xlsPath="C:/Users/Administrator/Desktop/测试.xls";
		//读取excel对象
		HSSFWorkbook workbook=new HSSFWorkbook(new FileInputStream(xlsPath));
		//获取sheet数
		int sheets=workbook.getNumberOfSheets();
		HSSFSheet sheet=null;//sheet
		HSSFRow row=null;//row
		HSSFCell cell=null;//cell
		//遍历sheets
		for (int i = 0; i < sheets; i++) {
			sheet=workbook.getSheetAt(i);
			//遍历行
			for (int j = 0; j <= sheet.getLastRowNum(); j++) {
				row=sheet.getRow(j);
				//遍历列
				for (int s = 0; s < row.getLastCellNum(); s++) {
					cell=row.getCell(s);
					//打印列的值用|隔开,这里需要判断列的类型
					System.out.print(getCellValue(cell)+" | ");
				}
				//换行
				System.out.println();
			}
		}
	}

	
	//获取列的值,返回String
	public static String getCellValue(HSSFCell cell){
		if(cell==null) return null;
		Object obj=null;
		int type=cell.getCellType();
		//列为空
		if(type==cell.CELL_TYPE_BLANK){
			obj="";
		//boolean类型
		}else if(type==cell.CELL_TYPE_BOOLEAN){
			obj=cell.getBooleanCellValue();
		//数字/时间
		}else if(type==cell.CELL_TYPE_NUMERIC){
			if(HSSFDateUtil.isCellDateFormatted(cell))
				obj=cell.getDateCellValue();
			else
				obj=cell.getNumericCellValue();
		//字符串类型
		}else if(type==cell.CELL_TYPE_STRING){
			obj=cell.getStringCellValue();
		//其他类型
		}else/* if(type==cell.CELL_TYPE_FORMULA)*/{
			obj=cell.toString();
		}
		return obj!=null?String.valueOf(obj):null;
	}
  • Java

    Java 是一种可以撰写跨平台应用软件的面向对象的程序设计语言,是由 Sun Microsystems 公司于 1995 年 5 月推出的。Java 技术具有卓越的通用性、高效性、平台移植性和安全性。

    3187 引用 • 8213 回帖

相关帖子

欢迎来到这里!

我们正在构建一个小众社区,大家在这里相互信任,以平等 • 自由 • 奔放的价值观进行分享交流。最终,希望大家能够找到与自己志同道合的伙伴,共同成长。

注册 关于
请输入回帖内容 ...

推荐标签 标签

  • JavaScript

    JavaScript 一种动态类型、弱类型、基于原型的直译式脚本语言,内置支持类型。它的解释器被称为 JavaScript 引擎,为浏览器的一部分,广泛用于客户端的脚本语言,最早是在 HTML 网页上使用,用来给 HTML 网页增加动态功能。

    729 引用 • 1327 回帖
  • Hprose

    Hprose 是一款先进的轻量级、跨语言、跨平台、无侵入式、高性能动态远程对象调用引擎库。它不仅简单易用,而且功能强大。你无需专门学习,只需看上几眼,就能用它轻松构建分布式应用系统。

    9 引用 • 17 回帖 • 611 关注
  • 爬虫

    网络爬虫(Spider、Crawler),是一种按照一定的规则,自动地抓取万维网信息的程序。

    106 引用 • 275 回帖
  • 旅游

    希望你我能在旅途中找到人生的下一站。

    90 引用 • 899 回帖
  • Solidity

    Solidity 是一种智能合约高级语言,运行在 [以太坊] 虚拟机(EVM)之上。它的语法接近于 JavaScript,是一种面向对象的语言。

    3 引用 • 18 回帖 • 399 关注
  • JRebel

    JRebel 是一款 Java 虚拟机插件,它使得 Java 程序员能在不进行重部署的情况下,即时看到代码的改变对一个应用程序带来的影响。

    26 引用 • 78 回帖 • 664 关注
  • Firefox

    Mozilla Firefox 中文俗称“火狐”(正式缩写为 Fx 或 fx,非正式缩写为 FF),是一个开源的网页浏览器,使用 Gecko 排版引擎,支持多种操作系统,如 Windows、OSX 及 Linux 等。

    8 引用 • 30 回帖 • 407 关注
  • MongoDB

    MongoDB(来自于英文单词“Humongous”,中文含义为“庞大”)是一个基于分布式文件存储的数据库,由 C++ 语言编写。旨在为应用提供可扩展的高性能数据存储解决方案。MongoDB 是一个介于关系数据库和非关系数据库之间的产品,是非关系数据库当中功能最丰富,最像关系数据库的。它支持的数据结构非常松散,是类似 JSON 的 BSON 格式,因此可以存储比较复杂的数据类型。

    90 引用 • 59 回帖 • 1 关注
  • Maven

    Maven 是基于项目对象模型(POM)、通过一小段描述信息来管理项目的构建、报告和文档的软件项目管理工具。

    186 引用 • 318 回帖 • 303 关注
  • 微信

    腾讯公司 2011 年 1 月 21 日推出的一款手机通讯软件。用户可以通过摇一摇、搜索号码、扫描二维码等添加好友和关注公众平台,同时可以将自己看到的精彩内容分享到微信朋友圈。

    130 引用 • 793 回帖
  • RESTful

    一种软件架构设计风格而不是标准,提供了一组设计原则和约束条件,主要用于客户端和服务器交互类的软件。基于这个风格设计的软件可以更简洁,更有层次,更易于实现缓存等机制。

    30 引用 • 114 回帖 • 1 关注
  • JSON

    JSON (JavaScript Object Notation)是一种轻量级的数据交换格式。易于人类阅读和编写。同时也易于机器解析和生成。

    52 引用 • 190 回帖
  • 小薇

    小薇是一个用 Java 写的 QQ 聊天机器人 Web 服务,可以用于社群互动。

    由于 Smart QQ 从 2019 年 1 月 1 日起停止服务,所以该项目也已经停止维护了!

    34 引用 • 467 回帖 • 742 关注
  • IDEA

    IDEA 全称 IntelliJ IDEA,是一款 Java 语言开发的集成环境,在业界被公认为最好的 Java 开发工具之一。IDEA 是 JetBrains 公司的产品,这家公司总部位于捷克共和国的首都布拉格,开发人员以严谨著称的东欧程序员为主。

    180 引用 • 400 回帖
  • CSS

    CSS(Cascading Style Sheet)“层叠样式表”是用于控制网页样式并允许将样式信息与网页内容分离的一种标记性语言。

    198 引用 • 550 回帖
  • VirtualBox

    VirtualBox 是一款开源虚拟机软件,最早由德国 Innotek 公司开发,由 Sun Microsystems 公司出品的软件,使用 Qt 编写,在 Sun 被 Oracle 收购后正式更名成 Oracle VM VirtualBox。

    10 引用 • 2 回帖 • 6 关注
  • 黑曜石

    黑曜石是一款强大的知识库工具,支持本地 Markdown 文件编辑,支持双向链接和关系图。

    A second brain, for you, forever.

    15 引用 • 122 回帖
  • CSDN

    CSDN (Chinese Software Developer Network) 创立于 1999 年,是中国的 IT 社区和服务平台,为中国的软件开发者和 IT 从业者提供知识传播、职业发展、软件开发等全生命周期服务,满足他们在职业发展中学习及共享知识和信息、建立职业发展社交圈、通过软件开发实现技术商业化等刚性需求。

    14 引用 • 155 回帖
  • ZooKeeper

    ZooKeeper 是一个分布式的,开放源码的分布式应用程序协调服务,是 Google 的 Chubby 一个开源的实现,是 Hadoop 和 HBase 的重要组件。它是一个为分布式应用提供一致性服务的软件,提供的功能包括:配置维护、域名服务、分布式同步、组服务等。

    59 引用 • 29 回帖 • 5 关注
  • LeetCode

    LeetCode(力扣)是一个全球极客挚爱的高质量技术成长平台,想要学习和提升专业能力从这里开始,充足技术干货等你来啃,轻松拿下 Dream Offer!

    209 引用 • 72 回帖
  • Ruby

    Ruby 是一种开源的面向对象程序设计的服务器端脚本语言,在 20 世纪 90 年代中期由日本的松本行弘(まつもとゆきひろ/Yukihiro Matsumoto)设计并开发。在 Ruby 社区,松本也被称为马茨(Matz)。

    7 引用 • 31 回帖 • 211 关注
  • 宕机

    宕机,多指一些网站、游戏、网络应用等服务器一种区别于正常运行的状态,也叫“Down 机”、“当机”或“死机”。宕机状态不仅仅是指服务器“挂掉了”、“死机了”状态,也包括服务器假死、停用、关闭等一些原因而导致出现的不能够正常运行的状态。

    13 引用 • 82 回帖 • 53 关注
  • Redis

    Redis 是一个开源的使用 ANSI C 语言编写、支持网络、可基于内存亦可持久化的日志型、Key-Value 数据库,并提供多种语言的 API。从 2010 年 3 月 15 日起,Redis 的开发工作由 VMware 主持。从 2013 年 5 月开始,Redis 的开发由 Pivotal 赞助。

    286 引用 • 248 回帖 • 62 关注
  • 大数据

    大数据(big data)是指无法在一定时间范围内用常规软件工具进行捕捉、管理和处理的数据集合,是需要新处理模式才能具有更强的决策力、洞察发现力和流程优化能力的海量、高增长率和多样化的信息资产。

    93 引用 • 113 回帖
  • 音乐

    你听到信仰的声音了么?

    60 引用 • 511 回帖
  • Sublime

    Sublime Text 是一款可以用来写代码、写文章的文本编辑器。支持代码高亮、自动完成,还支持通过插件进行扩展。

    10 引用 • 5 回帖
  • 学习

    “梦想从学习开始,事业从实践起步” —— 习近平

    169 引用 • 506 回帖