鱼C论坛

 找回密码
 立即注册
楼主: YuGuii

[作品展示] 百度文库爬虫(爬取需要下载券的文档)

  [复制链接]
发表于 2023-5-6 15:13:01 | 显示全部楼层

可以可以,正好需要!
小甲鱼最新课程 -> https://ilovefishc.com
回复 支持 反对

使用道具 举报

发表于 2023-5-9 18:11:34 | 显示全部楼层
怎么下载
小甲鱼最新课程 -> https://ilovefishc.com
回复 支持 反对

使用道具 举报

发表于 2023-5-10 14:12:26 | 显示全部楼层
looklook
小甲鱼最新课程 -> https://ilovefishc.com
回复 支持 反对

使用道具 举报

发表于 2023-5-20 17:47:02 | 显示全部楼层
好好学习天天向上
小甲鱼最新课程 -> https://ilovefishc.com
回复 支持 反对

使用道具 举报

发表于 2023-5-21 11:38:02 | 显示全部楼层
赶紧把代码给我们交出来
小甲鱼最新课程 -> https://ilovefishc.com
回复 支持 反对

使用道具 举报

发表于 2023-5-22 08:28:03 | 显示全部楼层
向大神致敬
小甲鱼最新课程 -> https://ilovefishc.com
回复 支持 反对

使用道具 举报

发表于 2023-6-11 11:20:22 | 显示全部楼层
冷小漠 发表于 2018-6-10 14:49
看了楼主的代码,总结了一下思路:

百度文库比较特殊,虽然抓包可以抓得到,但是文章的api很难逆向,至 ...

报错了这个怎么解决呀

Traceback (most recent call last):
  File "D:/快速访问/桌面/fishc百度文库.py", line 97, in <module>
    main()
  File "D:/快速访问/桌面/fishc百度文库.py", line 82, in main
    content = fetch_url(url)
  File "D:/快速访问/桌面/fishc百度文库.py", line 10, in fetch_url
    return session.get(url).content.decode('gbk')
UnicodeDecodeError: 'gbk' codec can't decode byte 0x98 in position 384: illegal multibyte sequence
小甲鱼最新课程 -> https://ilovefishc.com
回复 支持 反对

使用道具 举报

发表于 2023-6-11 17:03:15 From FishC Mobile | 显示全部楼层
想跟大神学着用啊
小甲鱼最新课程 -> https://ilovefishc.com
回复 支持 反对

使用道具 举报

发表于 2023-6-12 10:55:25 | 显示全部楼层
小甲鱼最新课程 -> https://ilovefishc.com
回复

使用道具 举报

发表于 2023-7-7 09:24:48 | 显示全部楼层
小甲鱼最新课程 -> https://ilovefishc.com
回复

使用道具 举报

发表于 2023-7-18 22:21:43 | 显示全部楼层
小甲鱼,谢谢分析
小甲鱼最新课程 -> https://ilovefishc.com
回复 支持 反对

使用道具 举报

发表于 2023-7-19 08:43:30 | 显示全部楼层
瞧瞧
小甲鱼最新课程 -> https://ilovefishc.com
回复

使用道具 举报

发表于 2023-7-25 14:40:41 | 显示全部楼层
11111
小甲鱼最新课程 -> https://ilovefishc.com
回复 支持 反对

使用道具 举报

发表于 2023-8-2 15:49:15 | 显示全部楼层
学习学习
小甲鱼最新课程 -> https://ilovefishc.com
回复 支持 反对

使用道具 举报

发表于 2023-8-16 20:06:39 | 显示全部楼层
厉害!!
小甲鱼最新课程 -> https://ilovefishc.com
回复

使用道具 举报

发表于 2023-8-16 21:07:48 | 显示全部楼层
相当6
小甲鱼最新课程 -> https://ilovefishc.com
回复 支持 反对

使用道具 举报

发表于 2023-8-17 10:20:31 | 显示全部楼层
学习了,感谢分享
小甲鱼最新课程 -> https://ilovefishc.com
回复 支持 反对

使用道具 举报

发表于 2023-8-18 16:29:50 | 显示全部楼层
出现 EOL while scanning string literal 这个错误。63行。是因为版本的原因么?我是3.9的Python
小甲鱼最新课程 -> https://ilovefishc.com
回复 支持 反对

使用道具 举报

发表于 2023-8-21 14:37:23 | 显示全部楼层

谢谢分享
小甲鱼最新课程 -> https://ilovefishc.com
回复 支持 反对

使用道具 举报

发表于 2023-9-21 13:15:29 | 显示全部楼层
1111
小甲鱼最新课程 -> https://ilovefishc.com
回复

使用道具 举报

您需要登录后才可以回帖 登录 | 立即注册

本版积分规则

小黑屋|手机版|Archiver|鱼C工作室 ( 粤ICP备18085999号-1 | 粤公网安备 44051102000585号)

GMT+8, 2026-5-25 05:58

Powered by Discuz! X3.4

© 2001-2023 Discuz! Team.

快速回复 返回顶部 返回列表