当前位置：首页 > 软件库 > 服务器软件 > 代理服务器软件 >

SeimiAgent

网址渲染服务

授权协议 Apache

开发语言 C/C++

所属分类服务器软件、代理服务器软件

软件类型开源软件

地区国产

投递者何松

操作系统 Windows

开源组织无

适用人群未知

软件官网

软件文档

官方下载

软件概览

SeimiAgent

SeimiAgent是基于QtWebkit开发的可在服务器端后台运行的一个webkit服务，可以通过SeimiAgent提供的http接口向SeimiAgent发送一个load请求（需求加载的URL以及对这个页面接受的渲染时间或是使用什么代理等参数），通过SeimiAgent去加载并渲染想要处理的动态页面，然后将渲染好的页面直接返给调用方进行后续处理。SeimiAgent的加载渲染环境都是通用浏览器级的，所以不用担心他对动态页面的处理能力。目前SeimiAgent只支持返回渲染好的HTML文档，后续会增加图像快照已经PDF的支持，方便更为多样化的使用需求。

下载

目前暂时只支持下面这两个平台的二进制版本的维护更新，其他平台暂时需要自行编译构建

快速开始

cd /dir/of/seimiAgent
./SeimiAgent -p 8000

执行命令后，SeimiAgent会起一个http服务并监听你所指定的端口，如例子中的8000端口，然后你就可以通过任何一种你熟悉的语言像SeimiAgent发送一个页面的加载渲染请求，并得到SeimiAgent渲染好的HTML文档进行后续处理。

示例

支持的http参数

仅支持post请求,请求地址/doload

url 目标请求地址，必填项
renderTime 在所有资源都加载好了以后留给SeimiAgent去渲染处理的时间，如果是很复杂的动态页面这个时间可能就需要长一些，具体根据使用情况进行调整。非必填,单位为毫秒
proxy 告诉SeimiAgent使用什么代理，非必填，格式:http|https|socket://user:passwd@host:port
postParam 这个参数只接受Json格式的值，值的形式为key-value对，告诉SeimiAgent此次请求为post并使用你给定的参数。
useCookie 是否使用cookie，如果设置为1则为使用cookie

如何构建

这个过程会花费很长时间如果你觉着很有必要的话，一般情况下更推荐使用发布好的二进制可执行文件

依赖

ubuntu上

sudo apt-get install build-essential g++ flex bison gperf ruby perl libsqlite3-dev libfontconfig1-dev libicu-dev libfreetype6 libssl-dev libpng-dev libjpeg-dev python libx11-dev libxext-dev

centos上

yum -y install gcc gcc-c++ make flex bison gperf ruby openssl-devel freetype-devel fontconfig-devel libicu-devel sqlite-devel libpng-devel libjpeg-devel

执行

python build.py

接下来就等吧，国内网络不好可能还要重来（因为需要先从github上下载qtbase和qtwebkit这两个依赖，后续如果有时间会把qtbase和qtwebkit拷到国内仓库一份），4核I5大概半个小时以上，单核云主机一般2个小时左右，16核以上服务器编译一般在十分钟以内

更多文档还在准备中，感谢大家支持Seimi家族(SeimiCrawler,SeimiAgent)

使用案例

SeimiAgent——基于QtWebkit的通用网页加载渲染代理服务

SeimiAgent SeimiAgent是基于QtWebkit开发的可在服务器端后台运行的一个webkit服务，可以通过SeimiAgent提供的http接口向SeimiAgent发送一个load请求（需求加载的URL以及对这个页面接受的渲染时间或是使用什么代理等参数），通过SeimiAgent去加载并渲染想要处理的动态页面，然后将渲染好的页面直接返给调用方进行后续处理。SeimiAgent的加
三、爬虫辅助工具 SeimiAgent

（一）作用简单点说，有些页面元素是靠js动态加载的，那么我们在使用爬虫时，无法直接取到这些动态加载的DOM元素。而使用 SeimiAgent 工具以后，它会在我们取DOM元素之前，预先将js动态加载的部分先加载出来，这样我们就可以向取普通DOM元素一样进行处理。（二）安装 1、先去SeimiAgent官网下载最新的工具包 2、centos上操作 yum -y install gcc gcc
SeimiAgent——基于QtWebkit的通用网页渲染代理服务

SeimiAgent SeimiAgent是基于QtWebkit开发的可在服务器端后台运行的一个webkit服务，可以通过SeimiAgent提供的http接口向SeimiAgent发送一个load请求（需求加载的URL以及对这个页面接受的渲染时间或是使用什么代理等参数），通过SeimiAgent去加载并渲染想要处理的动态页面，然后将渲染好的页面直接返给调用方进行后续处理。SeimiAgent的加

SeimiAgent

SeimiAgent

下载

快速开始

示例

支持的http参数

如何构建

依赖

执行

More

同类工具

相关阅读

相关文章

相关问答

相关文档