PHP8.1.21版本已发布

vue8.1.21版本已发布

jquery8.1.21版本已发布

技术文章 > 后端开发 > php教程

javascript - 求大神破解印象笔记chrome插件“悦读”的识别算法

原创: 2016-06-06 20:44:30 927浏览

最近因为要做一个采集网页主体内容的软件，所以找了好久，最后觉得“悦读”的效果最理想。
有装了“悦读”的同学可以在C:\Users\Administrator\AppData\Local\Google\Chrome\User Data\Default\Extensions\iooicodkiihhpojmmeghjclgihfjdjhjchrome
找到源码，因本人学业不精，目前还无法看懂代码如何调用，求大神指点，急用，万分感谢。

回复内容：

最近因为要做一个采集网页主体内容的软件，所以找了好久，最后觉得“悦读”的效果最理想。
有装了“悦读”的同学可以在C:\Users\Administrator\AppData\Local\Google\Chrome\User Data\Default\Extensions\iooicodkiihhpojmmeghjclgihfjdjhjchrome
找到源码，因本人学业不精，目前还无法看懂代码如何调用，求大神指点，急用，万分感谢。

我觉得其实就是html的解析，这块你看看各种爬虫是怎么写的就行了

早期的印象的文本提取用的是这个库https://github.com/hatena/extract-content-javascript/，不过印象笔记收编了Readability的作者后，貌似换了文本提取引擎。

PHP课程 HTML视频教程 CSS视频 JS视频教程 Vue视频教程

声明：本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn核实处理。

上一条：php helpDB 下一条：PHP存放SESSION后，火狐如何查看SESSIONID啊？截图，谢谢

相关文章

查看更多

热门课程

通用后台管理系统实战开发（Thinkphp6+Layui）

￥89
￥99

已抢141034个
抢
swoole入门物联网开发与实战

￥119
￥109

已抢4625个
抢
go语言零基础开发内容管理系统

￥198
￥268

已抢7269个
抢
C#+WPF上位机开发课程（模块化与反应式编程）

￥246
￥499

已抢21436个
抢

打开APP，随时随地在线学习！