Ruby中的Mechanize的使用教程

站长资源 2026/7/16 佚名

41 1538 41

DDR爱好者之家 Design By 杰米

Ruby中实现网页抓取，一般用的是mechanize，使用非常简单。

安装
复制代码代码如下:
sudo gem install mechanize

抓取网页
复制代码代码如下:
require 'rubygems'
require 'mechanize'
agent = Mechanize.new
page = agent.get('http://google.com/')

模拟点击事件
复制代码代码如下:
page = agent.page.link_with(:text => 'News').click

模拟表单提交
复制代码代码如下:
google_form = page.form('f')
google_form["q"] = 'ruby mechanize'
page = agent.submit(google_form, google_form.buttons.first)
pp page

分析页面，mechanize用的是nokogiri解析网页的，所以可以参照nokogiri的文档
复制代码代码如下:
table = page.search('a')
text = table.inner_text
puts text

有几点注意的地方：如果需要先登录的网页，那么可以在网站先登录，登录后记录JSESSIONID，然后赋值给agent
复制代码代码如下:
cookie = Mechanize::Cookie.new("JSESSIONID", "BA58528B76124698AD033EE6DF12B986:-1")
cookie.domain = "datamirror.csdb.cn"
cookie.path = "/"
agent.cookie_jar.add!(cookie)

如果需要保存网页，使用.save_as，(或许save也可以，我没试过)例如
复制代码代码如下:
agent.get("http://google.com").save_as

小技巧

puts Mechanize::AGENT_ALIASES 可以打印出所有可用的user_agent
puts Mechanize.instance_methods(false) 输出Mechanize模块的所有方法
puts Mechanize.instance_methods() 输出Mechanize模块的所有方法以及所继承的类的函数

Ruby,Mechanize

DDR爱好者之家 Design By 杰米

广告合作：本站广告合作请联系QQ：858582 申请时备注：广告合作（否则不回）
免责声明：本站资源来自互联网收集,仅供用于学习和交流,请遵循相关法律法规,本站一切资源不代表本站立场,如有侵权、后门、不妥请联系本站删除！

DDR爱好者之家 Design By 杰米

评论“Ruby中的Mechanize的使用教程”

暂无评论...

P70系列延期，华为新旗舰将在下月发布

3月20日消息，近期博主@数码闲聊站透露，原定三月份发布的华为新旗舰P70系列延期发布，预计4月份上市。

而博主@定焦数码爆料，华为的P70系列在定位上已经超过了Mate60，成为了重要的旗舰系列之一。它肩负着重返影像领域顶尖的使命。那么这次P70会带来哪些令人惊艳的创新呢？
根据目前爆料的消息来看，华为P70系列将推出三个版本，其中P70和P70 Pro采用了三角形的摄像头模组设计，而P70 Art则采用了与上一代P60 Art相似的不规则形状设计。这样的外观是否好看见仁见智，但辨识度绝对拉满。

更新日志

2026年07月16日

Ruby中的Mechanize的使用教程

Rails应用程序中同时修改操作冲突问题的解决方案

Rails中使用MySQL分区表一个提升性能的方法

评论“Ruby中的Mechanize的使用教程”

P70系列延期，华为新旗舰将在下月发布

更新日志

友情链接