retime123
码龄12年
求更新 关注
提问 私信
  • 博客:23,618
    23,618
    总访问量
  • 12
    原创
  • 2
    粉丝
  • 74
    关注
IP属地以运营商信息为准,境内显示到省(区、市),境外显示到国家(地区)
IP 属地:江苏省
加入CSDN时间: 2014-12-23

个人简介:C/C++、python、java;爬虫、数据挖掘;机器学习、计算机视觉

博客简介:

retime123的博客

博客描述:
岁月静好....
查看详细资料
个人成就
  • 获得3次点赞
  • 内容获得7次评论
  • 获得21次收藏
  • 博客总排名1,047,823名
创作历程
  • 1篇
    2023年
  • 4篇
    2022年
  • 1篇
    2021年
  • 3篇
    2019年
  • 5篇
    2018年
成就勋章
TA的专栏
  • DolphinScheduler
    3篇
  • jenkins
    1篇
  • python
    7篇
  • 图片识别
    2篇
  • scrapy
    3篇

TA关注的专栏 0

TA关注的收藏夹 0

TA关注的社区 2

TA参与的活动 0

兴趣领域 设置
  • 人工智能
    语音识别深度学习神经网络自然语言处理图像处理
创作活动更多

AtomGit「码动四季·开源同行」秋季征稿活动

秋季征稿主题:开源成果经验分享 成果不止一种形态,我们为你准备了六大赛道,总有一款适合你: 开源项目成果复盘 把项目一年/一季的成长摊开来看:里程碑复盘、Star 与用户增长复盘、版本迭代复盘、从 0 到 1 的发布复盘。 🖊️ 示范选题: ●开源项目从 0 到 1000 Star,我做对了什么 ●开源一周年,我交出的成绩单 这类文章不只是一次经验分享,也是一张项目名片。欢迎将项目托管到 AtomGit 并申请成为 G-Star 项目,通过后可获得平台流量推荐、项目宣传等权益。(G-Star:AtomGit 最具影响力开源项目) ![在这里插入图片描述](https://i-blog.csdnimg.cn/direct/1f90c61528ad410d8d66f9d0e3707a5a.png) 咨询 G-Star 项目申请 2️⃣ 技术经验体系化沉淀 踩坑合集、最佳实践总结、工具链实战、CI/CD 流水线搭建、代码重构与架构演进。 🖊️ 示范选题: ●提了 50 个 PR 后,我总结的开源协作避坑清单 ●一次重大重构复盘:把单体拆成可维护的模块 3️⃣ AI 赋能开源的实战成果 AI 编程助手实战测评、基于开源模型的微调与应用开发、AI 辅助研发提效流水线。 🖊️ 示范选题: ●我用 AI 编程助手把提 PR 效率翻了 3 倍 ●基于开源大模型搭了个 XX 工具(附完整教程) 4️⃣ 开源共建笔记|文档、社区与布道 开源文档写作与翻译、issue 互助经验、组织 meetup、用开源项目做教学与分享。 🖊️ 示范选题: ●一个优秀开源项目,文档应该怎么写 ●我用开源项目做了个线上 Workshop ![在这里插入图片描述](https://i-blog.csdnimg.cn/direct/23e83ceebc594c379f7fc6aa8dcfa40c.png) 扫码加入码动四季投稿交流群,和更多伙伴一起交流技术!

275人参与 去参加
  • 最近
  • 文章
  • 专栏
  • 代码仓
  • 资源
  • 收藏
  • 关注/订阅/互动
更多
  • 最近

  • 文章

  • 专栏

  • 代码仓

  • 资源

  • 收藏

  • 关注/订阅/互动

  • 社区

  • 帖子

  • 问答

  • 课程

  • 视频

搜索 取消

爬虫之遇到woff字体反爬

本篇博文的主题就是处理字体反爬,其实这种网上已经很多了,只是这次有点不一样,处理方式变化了点,记录一下。
原创
博文更新于 2025.03.05 ·
1266 阅读 ·
1 点赞 ·
0 评论 ·
7 收藏

正则提取 英文日期

匹配--> 16th June 2020。
原创
博文更新于 2023.07.05 ·
591 阅读 ·
0 点赞 ·
0 评论 ·
0 收藏

发票图片数据集 发票图片数据集

发布资源 2022.09.21 ·
zip

DolphinScheduler 2.0.x 二开之增加“丢弃旧的实例”功能

保留最大实例数量,对旧的日志删除
原创
博文更新于 2022.06.02 ·
566 阅读 ·
0 点赞 ·
0 评论 ·
0 收藏

DolphinScheduler 2.0.x 二开之监控中心增加“磁盘可用”的监控

DolphinScheduler 二次开发
原创
博文更新于 2022.05.25 ·
603 阅读 ·
0 点赞 ·
0 评论 ·
0 收藏

DolphinScheduler 2.0.x版本在win10开发调试的环境配置

最近用DolphinScheduler搭建平台,有些不好的地方需要二开,记录一下本地环境配置DolphinScheduler官网地址:https://dolphinscheduler.apache.org/zh-cn/(平台部署也有坑,后续更新。。。)1.下载DolphinScheduler源码打开 DolphinScheduler 的 GitHub(https://github.com/apache/dolphinscheduler)选择下载的版本,可以clone或者直接下载zip包
原创
博文更新于 2022.05.14 ·
3314 阅读 ·
1 点赞 ·
0 评论 ·
5 收藏

爬虫之遇到521,破解cookie之window对象

使用python、scrapyimport execjs# 安装pip install PyExecJS 用这种方式只是为了调试,实际使用中还是要用js引擎v8看了不少博客是要用到模拟浏览器phantomjs、chrome什么的,其实有很多网站的js会发现这种操作(无头模式下navigatoe.webdriver为true,绕过检测要设置该属性)。下面一个网站为例(具体网站不公开!...
原创
博文更新于 2022.05.10 ·
818 阅读 ·
1 点赞 ·
0 评论 ·
0 收藏

scrapy多个爬虫公用一些中间件、pipelines

使用python3请求头headers:user-agent、代理ip,这些放在一个工程项目里,有的爬虫是需要中间件的或者根据反爬添加相应的条件,那这样的情况下怎么办?1.中间件处理默认带上请求头,不带启用ip代理功能spiders文件夹下的爬虫类添加属性中间件处理这样不管爬虫那边有没有添加属性,middlewares里就是会默认2.有些情况下请求头会带上cookie...
原创
博文更新于 2022.05.10 ·
2905 阅读 ·
0 点赞 ·
0 评论 ·
2 收藏

向scrapy中的spider传参,实现增量

有时候需要根据项目的实际需求向spider传递参数来控制spider的运行方式。比如说,1.根据用户提交的url来控制spider爬取的网站。2.根据需求增量爬取数据。今天就写一个增量(augmenter)的方式:Spider参数通过crawl命令的 -a 选项来传递,比如:scrapycrawlxxx-aaugmenter=xxxxxx注:augmente...
原创
博文更新于 2022.05.10 ·
1817 阅读 ·
0 点赞 ·
2 评论 ·
0 收藏

scrapy怎么post 请求payload形式的参数的实现;还有requests实现方式

payload是什么就不说了!https://mp.csdn.net/postedit/80363125一、payload在浏览器上的数据 浏览器上请求方式: 2.payload参数:可以看出来参数形式是json3.headers:4.response:可以看出来是json的数据!二、在scrapy中访问payload形式的url...
原创
博文更新于 2022.05.10 ·
2349 阅读 ·
0 点赞 ·
0 评论 ·
6 收藏

python3调用jenkins报401未授权问题

ubuntu 16.04系统安装的包python-jenkins,用的是目前最新的1.7.0(1.5~1.6页试过):import jenkinsserver = jenkins.Jenkins(JENKINS_MIMETUS_SERVER_URL, username=JENKINS_MIMETUS_USERNAME, password=JENKINS_MIMETUS_PASSWORD)# 调用方法server.get_running_builds()# 报错:Traceback
原创
博文更新于 2021.06.18 ·
3919 阅读 ·
0 点赞 ·
1 评论 ·
0 收藏

pip install出错:Cannot connect to proxy

pip install出错:Cannot connect to proxyCannot connect to proxy.', NewConnectionError('<pip._vendor.urllib3.connection.VerifiedHTTPSConnection object at 0x03111CF0>: Failed to establish a new co...
转载
博文更新于 2019.03.31 ·
1149 阅读 ·
0 点赞 ·
0 评论 ·
0 收藏

caffe整图训练---验证码

caffe自行安装,win版算法:Res_LSTM_CTC 不定长准备样本
原创
博文更新于 2019.03.25 ·
249 阅读 ·
0 点赞 ·
0 评论 ·
0 收藏

Scrapy如何获取返回的headers里面的多个Set-Cookie

https://blog.csdn.net/legendary_Dragon/article/details/81287593 cookie = response.headers.getlist('Set-Cookie')
转载
博文更新于 2018.11.28 ·
2133 阅读 ·
0 点赞 ·
0 评论 ·
1 收藏

虚拟机Ubuntu16.04 Server设置NAT方式修改ip

每次都要查看ip,每次都不一样,往往我们会选择“NAT模式”,但是选择的时候,ip地址会产生冲突,这样我们就要修改我们的IP地址来解决!!一、简单方式:1.工具栏‘编辑’  2.虚拟网络编辑器,选择NAT模式==》子网ip没法修改 3.‘更改设置’“子网IP”修改自己喜欢的网段,192.168.xxx.xxx最好是改这两个!4.‘DHCP设置’修改起始IP地址==》可以说这样就是自己的虚拟机的IP...
原创
博文更新于 2018.04.20 ·
811 阅读 ·
0 点赞 ·
0 评论 ·
0 收藏
加载更多