| 进度条:学习第 191 天|当前:第 2 周完结 |
一、这周我干了啥(按天过一遍)
1.1 Day 7:标注接单渠道大摸底 + 打框基本功
🔗 原博客链接:点击查看 Day 7 详细记录
-
任务原文:摸接单渠道,打磨打框基本功,盘点接触过的标注类型。
- 做了+结果:主要就干了两件事。第一,跑去QQ群搜了4个关键词找单子,发现每个群的公告要求都不一样,有的要审核资质,有的要开发商信息,干脆先截图存着慢慢看。第二,把质检工具从豆包换成了WorkBuddy,确实好用很多。同时也发现了自己之前的问题:模型指标忽高忽低(同样数据两次跑,一次47%,一次83%),而且纸箱和快递盒用了不一样的编号,属于重复标签。
| 任务项 | 具体操作 / 细节(大白话) | 状态 |
|---|---|---|
| 摸底接单渠道 | 在QQ群搜了4个关键词,发现群公告要求各异(审核要求、开发商资质等),先截图存档。 | ✅ 完成 |
| 盘点标注技能 | 理清三类:单图单标签(偏审核)、多标签分类(属性标注)、目标检测(画框,刚上手)。 | ✅ 完成 |
| 总结打框四原则 | 1.贴边(不留大空白);2.一物一框;3.禁止重叠;4.看见就框(一个都不能漏)。 | ✅ 完成 |
| 梳理接单模式 | 区分模式一(选择题型、偏审核)和模式二(标注题型、偏实操,这是我目前走的路线)。 | ✅ 完成 |
| 初步定位模型问题 | 发现当前问题:指标忽高忽低(同数据两次训练47%和83%)、标签重复(纸箱/快递盒用了不同编号)。 | ⚠️ 待解决 |
1.2 Day 8:重标第3版 + 跑YOLO模型验证标注质量
🔗 原博客链接:点击查看 Day 8 详细记录
-
任务原文:把昨天25张图重新打标,然后跑模型看效果。
- 做了+结果:今天把前两天打标出错的那25张图全部重标了。把前两版的问题修了,还把“袋子”和“麻袋”合并成了一个标签,类别从32类精简到31类。顺手继续在QQ群里排雷,看透了骗子套路(加好友、点链接、交钱的直接拉黑)。重标完之后用YOLO连着跑了4次训练,终于搞明白了——标注质量高低,真的直接决定模型跑出来的分数。
| 任务项 | 具体操作 / 细节(大白话) | 状态 |
|---|---|---|
| 继续筛选QQ群 | 只留活跃群观察真任务。建立防骗意识:凡是“加好友、点链接、先交钱”的,一律当骗子处理。 | ✅ 完成 |
| 第三版重标图 | 前两版打标有问题,今天彻底重标了 25 张图(包含处理图像重叠难框的问题)。 | ✅ 完成 |
| 合并重复标签 | 把“袋子”和“麻袋”合并成一个标签,把类目从 32 类精简为 31 类。 | ✅ 完成 |
| 执行重标三原则 | 1.同类统一名称;2.重叠物体分开框;3.框要贴边,不能模糊或虚大。 | ✅ 完成 |
| 跑4次模型训练 | 用重标后的25张图,跑了4次YOLO训练,揪出“我的标注质量到底怎么样”。 | ✅ 完成 |
1.3 Day 9:数据质检“避坑”实战 + 坐标反推法修复编号错乱
🔗 原博客链接:点击查看 Day 9 详细记录
-
任务原文:用 WorkBuddy 对标注结果做质检,修复编号错乱问题。
- 做了+结果:今天弄懂了为什么模型会认错物体。因为YOLO导出的编号是临时生成的,删改标签会导致编号重排。学了一个不用重画的“坐标反推法”,对比新旧框中心点距离小于0.012就认作同一个物体,10分钟就修完了。然后固定随机种子跑了50轮,模型跑到了0.856分(准确率77.7%,召回率63.2%)。最后把作废的907版和重标的908版分开管理,绝不混用。
| 任务项 | 具体操作 / 细节(大白话) | 状态 |
|---|---|---|
| 排查编号错乱(换座位) | 发现YOLO导出的编号是临时生成的,删改标签会导致编号重排,导致模型认错。 | ✅ 完成 |
| 修复错乱(坐标反推法) | 不重画!对比新旧版本框的中心坐标,距离<0.012算同一物体,反推匹配映射,10分钟修完。 | ✅ 完成 |
| 跑通模型训练 | 20张训练/5张测试/158个框,固定随机种子跑50轮。 | ✅ 完成 |
| 模型评估成绩 | mAP(准确率)50 = 0.856(P=0.777 准确率 / R=0.632 召回率),mAP50-95 = 0.720。 | ✅ 完成 |
| 明确小样本测试规则 | 验证集只有5张图,单次分数浮动0.01内正常,必须固定种子看趋势。 | ✅ 完成 |
| 数据版本管理 | 明确907版作废,908版与标准表对应。两版数据绝不混用。 | ✅ 完成 |
1.4 Day 10:目标检测五步闭环初步摸底:从“天书”到看懂“股票崩盘”
🔗 原博客链接:点击查看 Day 10 详细记录
-
任务原文:了解目标检测模型“收集、打标、训练、评估、输出”五个步骤背后的原理。
- 做了+结果:今天没跑代码,专心把目标检测的五个步骤(收集、打标、训练、评估、输出)背后的原理吃透了。最大的收获是学会了看评估曲线,知道了什么是“过拟合(学傻了)”,什么是“欠拟合”。还搞懂了算力不够的话,电脑会死机(内存满了,重启就行)或崩溃(程序挂了,训练白干)。弄清了脚本就是干活的锅,模型就是最后出锅的菜。
| 核心环节 | 输入(干什么) | 输出(得到什么) | 翻车点 / 跳过会怎样 |
|---|---|---|---|
| 1. 收集图片 | 准备真实世界的各种场景照片。 | 一批原始图片(JPG/PNG格式)。 | 翻车点:图太少、角度单一导致“偏科”;模型成了“井底之蛙”,遇到新场景直接傻眼。 |
| 2. 打标签 | 把图片里的物体框出来,并贴上分类名字。 | 带坐标和标签的文本文件。 | 翻车点:没有坐标和名字,机器就完全看不见目标,最后只能瞎猜。 |
| 3. 训练 | 把打好标签的文件和原图喂给机器。 | 模型权重文件(.pt格式)。 | 翻车点:轮次太多(死记硬背);轮次太少(没学到规律);算力不够会导致“死机”或“崩溃”。 |
| 4. 评估 | 训练好的模型 + 全新没见过的图片。 | 成绩单(像股票一样的曲线图 + mAP 数值)。 | 翻车点:作弊(混入训练过的图)、样本太少、全是同一种类别。跳过评估,就不知道模型好坏,实战直接报废。 |
| 5. 输出 | 评估合格的模型文件。 | 给一张新图,它能自动干活。 | 翻车点:前面任意一环有短板,这里都会暴露。输出就是一面“照妖镜”。 |
📊 成绩单怎么看(t / v / m 曲线的秘密):
- train(作业):正常状态是一开始像跳崖一样陡峭下降,然后慢慢变缓,最后变成一条直线(收敛)。
- val(期末):正常状态同样是一开始陡降,然后平缓,最后走平。
- mAP(分数):和错误率相反,一开始陡峭上升,然后变缓,最后趋于平稳。
- ⚠️ 过拟合(学傻了):train一直降,val过了某个点开始往上翘。欠拟合(没学会):mAP数值一直上不去。
🧠 避坑与底层认知:
- 算力不够会怎样? 死机是内存/显存占满(重启可恢复);崩溃是程序崩了(训练全白干)。解决方法:降低点难度(图片尺寸调小或换小模型),重新跑一遍。
- 脚本、程序、模型到底是什么关系? 脚本 = 程序 = 干活的工具(比如厨房里的锅)。模型 = 训练最终生成的成果(比如最后出锅的菜)。工具坏了可以重跑,模型是最后的活儿。
1.5 Day 11:文本分类初学:从定义到 102 道模拟题
🔗 原博客链接:点击查看 Day 11 详细记录
-
任务原文:学习文本分类基础,试用标注工具,完成模拟练习题。
- 做了+结果:今天把文本分类的“情感”和“主题”两大类练了。情感分类是判断外卖评论好坏(正/中/负面),做了50题,拿了98%。主题分类是判断新闻属于体育、科技、教育、娱乐还是财经,做了40题,拿了90%。发现自己科技和财经容易混,体育词汇看不懂,背了速记词卡补回来。折腾Label Studio时,旧域名进不去,换了新域名,还碰到了导出按钮点不出来的bug。
| 任务项 | 具体操作 / 细节(大白话) | 状态 |
|---|---|---|
| 情感分类 | 外卖评论判断正/负/中(50题练到98%)。 | ✅ 完成 |
| 主题分类 | 新闻判断体育/科技/财经/教育/娱乐(练到90%,专项补了12题到100%)。 | ✅ 完成 |
| 踩坑与补丁 | 科技/财经易混淆;体育术语不熟。用“主语判断法”+死磕体育速记词卡。 | ✅ 完成 |
| Label Studio | 旧域名 app.heartex.com 失效,换新域名 app.humansignal.com。导出弹窗无按钮是 v2.3 渲染bug,换 Chrome 或手机。 | ⚠️ 导出待解决 |
1.6 Day 12:文本分类收官,主观题见好就收
🔗 原博客链接:点击查看 Day 12 详细记录
-
任务原文:完成文本分类收尾三件套(相关性判断 / NER 划词 / 简答题),模块整体结课。
- 做了+结果:今天把文本分类最后三块硬骨头啃了。相关性判断做了20题(85%),发现“部分相关”最难搞(比如搜儿童自行车出来汽车),补了15道专项题才100%,其中包括“相关、部分相关、不相关”三个选项内容。NER划词练了三遍,从83%干到了100%,也搞清楚了“五年”是时长不是时间点。简答题做了6题,是AI写初稿我来批注修改,做了91%后觉得实在太耗时间,果断止损。用Word直接造题确实省时间,Label Studio平台搜索相关性和情感项目的全流程也跑通了。
| 任务项 | 具体操作 / 细节(大白话) | 状态 |
|---|---|---|
| 复习昨日错题 | 情感+主题各10题,20题全对。 | ✅ 完成 |
| 相关性判断题 | 20题85%,补专项题15道(33%→100%)。部分相关最难搞,做项目前必须定标准! | ✅ 完成 |
| Label Studio | 搜索相关性和情感项目全流程跑通。 | ✅ 完成 |
| NER 划词标注 | 初测83% → 二刷91% → 三刷100%。“五年”这种是时长,不是时间点,不能算。 | ✅ 完成 |
| 简答题练习 | 6题AI辅助,5.5/6(91%)。AI生成初稿,我来做人工批注和审核。偏主观、极耗时间,主动止损。 | ✅ 完成(主动止损) |
1.7 本周产出清单
| 产出类别 | 具体内容 / 数据(大白话) | 备注 / 说明 |
|---|---|---|
| 博客更新 | Day 7 ~ Day 12 完整实战记录 | 共 6 篇 |
| 图片标注与模型训练 | 重标25张图,合并重复标签(32类精简到31类)。用YOLO连跑4次训练,固定随机种子跑50轮。 | mAP 50跑到 0.856(准确率77.7%,召回率63.2%) |
| 文本分类练习 | 情感分类50题(98%),主题分类40题(90%,补12题到100%)。 | 累计 102 道模拟题 |
| 文本分类收尾 | 相关性判断20题(85%,补15题后100%);NER划词(83%→二刷91%→三刷100%);简答题6题(91%止损)。 | 模块整体结课 |
| 工具踩坑与解决 | Label Studio旧域名失效换新域名;导出按钮bug换Chrome搞定;坐标反推法10分钟修复YOLO编号错乱。 | 记录了3个工具级踩坑点 |
| 核心认知沉淀 | 目标检测五步闭环(含输入、输出、翻车点);t/v/m曲线图解读;脚本=锅,模型=菜。 | 沉淀 3 个核心方法论 |
二、这周学到的硬货(先术语,后大白话)
2.1 目标检测五步闭环(细节全貌+防坑指南):
| 核心环节 | 输入(干什么) | 输出(得到什么) | 翻车点 / 跳过会怎样 |
|---|---|---|---|
| 1. 收集图片 | 准备真实世界的各种场景照片 | 一批原始图片(JPG/PNG格式) | 翻车点:图太少、角度单一导致“偏科”;背景全是草地,模型就成了“井底之蛙”,遇到新场景直接傻眼。 |
| 2. 打标签 | 把图片里的物体框出来,并贴上分类名字 | 带坐标和标签的文本文件 | 翻车点:没有坐标和名字,机器就完全看不见目标,最后只能瞎猜。 |
| 3. 训练 | 把打好标签的文件和原图喂给机器 | 模型权重文件(.pt格式) | 翻车点:轮次太多(死记硬背,遇到新题就废);轮次太少(没学到规律,认不准);算力不够会导致“死机”或“崩溃”。 |
| 4. 评估 | 训练好的模型 + 全新没见过的图片 | 成绩单(曲线图 + mAP 数值) | 翻车点:作弊(混入训练过的图)、样本太少、全是同一种类别。跳过评估,就不知道模型好坏,实战直接报废。 |
| 5. 输出 | 评估合格的模型文件 | 给一张新图,它能自动干活 | 翻车点:前面任意一环有短板,这里都会暴露。输出就是一面“照妖镜”,流程里有一个工序不行,整体直接拉胯。 |
📊 成绩单怎么看(t / v / m 曲线的秘密):
- train(作业):训练集错误率。正常状态是:一开始像跳崖一样陡峭下降,然后慢慢变缓,最后变成一条直线(收敛,学到位了)。
- val(真实水平):验证集错误率。正常状态同样是一开始陡降,然后平缓,最后走平。这说明模型真学会了,不靠死记硬背。
- mAP(准确率):评估指标。和错误率相反,一开始陡峭上升,然后变缓,最后趋于平稳。
- ⚠️ 过拟合(学傻了):train(作业)一直降,但val(期末)过了某个点开始往上翘。欠拟合(没学会):mAP数值一直上不去,t和v的准确率都不高。
🧠 避坑与底层认知:
- 算力不够会怎样? 训练需要大量计算(通常需要显卡)。配置不行会“死机”(内存/显存占满,强制重启可恢复)或“崩溃”(训练软件崩了,这些训练全白干,得不到模型成果)。解决方法:重设设置,降低点难度(图片尺寸调小或换小模型),重新跑一遍。
- 脚本、程序、模型到底是什么关系? 脚本(Python) = 程序 = 干活的工具(比如厨房里的锅)。模型 = 训练最终生成的成果(比如最后出锅的菜)。工具坏了可以重跑,模型是最后的活儿,还没干出来时工具坏了,活儿就没了。
2.2 文本分类(四个关卡全貌)**:
- 大白话:以前以为只是“给文字贴标签”,实际做下来才发现有4个关卡,每一关的玩法、坑点和工具都不一样:
| 题型 | 具体操作 / 细节(大白话) | 成绩 / 状态 |
|---|---|---|
| 1. 选择题(情感/主题分类) | 情感分类:外卖评论判断正/负/中(50题练到98%)。 主题分类:新闻判断体育/科技/财经/教育/娱乐(练到90%,专项补了12题到100%)。 ⚠️ 踩坑:科技/财经容易混淆(选错词就偏了);体育术语不熟(积分榜、领跑、卫冕、晋级、夺冠等词汇看不懂)。 💡 补丁:用“主语判断法”(问主语是谁),外加死磕体育速记词卡。 | ✅ 完成 |
| 2. 相关性判断(三档边界) | 判断搜出来的内容跟搜索词对不对得上。 三档边界:完全无关 = 不相关;同一大类细分不同(比如搜“儿童自行车”,文章写“汽车”) = 部分相关;核心教材/答案一致(比如考研数学 vs 高数同济版) = 相关。 ⚠️ 踩坑:部分相关的边界最难搞,做项目前必须先跟客户定好标准! | ✅ 完成(补题后100%) |
| 3. NER 划词标注 | 就像拿记号笔去文章里“抓娃娃”,只抓人名、地名、机构名、具体时间这四类词。 ⚠️ 踩坑:“五年”这种是时长,不是时间点,不能算。还要小心数据泄漏。 | ✅ 完成(83%→补题后100%) |
| 4. 简答题(翻译/摘要/改写) | 翻译:关键术语要对,时态要对。 摘要:保留时间、主体、事件、核心数据。 改写:口语化,保留原意。 核心认知:不是让我去创作,而是 AI 生成初稿,我来做人工批注和审核。 ⚠️ 踩坑:偏主观、极耗时间,我拿到 91% 后果断止损。 | ✅ 完成(主动止损) |
| 5. 工具与项目搭建(Label Studio) | 跑通项目搭建和导出流程。 ⚠️ 踩坑:旧域名 app.heartex.com 注册入口已失效,必须换成新域名 app.humansignal.com。需 GitHub 授权,14天内免费。导出弹窗无“创建快照”按钮,刷新后无效,是 v2.3 渲染bug,换成 Chrome 或手机测试即可。 | ✅ 完成 |
💡 总结:文本分类不只是“选择题”,还有划词和简答。这四关全跑通,才算真正摸透了文本标注的底层逻辑。
三、这周卡在哪 & 还没搞懂的
| 类型 | 卡点 | 现在到哪一步了(大白话版) |
|---|---|---|
| 工具 | Label Studio 导出流程 | 旧域名 app.heartex.com 注册入口隐藏,换成新域名需要 GitHub 授权。导出弹窗无“创建快照”按钮,刷新也无效。后来发现是 v2.3 渲染 bug,换 Chrome 浏览器才勉强解决。替代方案还留了 doccano、LabelU、百度 EasyData、腾讯 QLabel 备用。 |
| 知识 | 目标检测代码(.py 脚本) | 知道 train.py 里要改 epochs=30(训练轮数)和 batch_size=8(看图数量),但自己没动手改过代码。只停留在用 WorkBuddy 生成,还没自己跑通一遍完整的训练脚本。 |
| 资源 | 接单渠道不清晰 | 搜了百度众测、腾讯搜活帮、京东众智等几个群。发现群公告要求各异(有的要考试、有的要开发者资质),骗子套路太多(凡是加好友、点链接、先交钱的一律拉黑)。还没完全筛选出真正有效的接单渠道,需要继续观察活跃群。 |
| 知识 | 目标检测后10%代码部分 | 图像模块暂时搁置。因为接下来要去学文本分类,所以这部分打算等以后回过头来精修,或者等学完代码基础后再来补。 |
四、这周想通了什么(认知变化)
-
以前觉得 AI 验收就是让 AI 帮我看看对不对,把 AI 当成替我干活的苦力。这周把质检从豆包换成 WorkBuddy 之后,我发现 AI 确实能帮我快速排查错误,但最终判断权必须在我手里——AI 不替我思考,只替我干活。
-
我彻底搞懂了**“脚本、程序、模型”**的关系:脚本 = 程序 = 干活的工具(比如厨房里的锅);模型 = 训练最终生成的成果(比如最后出锅的菜)。工具坏了可以重跑,模型是最后的活儿,还没干出来时工具坏了,活儿就没了。
✅ 一句话教训:AI排版润色博客内容可以,但最终判断权必须在我。
五、下周打算干啥
💡 注:这周结束,图像分类和文本分类两个板块就算是正式收尾了。下周不干别的,核心任务就是拿招聘信息来“检验成果”,看看自己到底能干点什么。
| 任务 | 验收标准(怎么算做完) |
|---|---|
| 整理招聘信息,检验学习成果 | 收集图像分类和文本分类相关的岗位JD,盘点自己目前具备哪些能力、还缺哪些能力。 |
| 整理能力对照表 | 根据招聘信息,列一张“学习成果 vs 岗位需求”的对照表,看清楚自己能胜任什么。 |
| 汇总文档结构 | 把这两个板块的知识点和踩坑记录,整理成一个清晰的文档结构(分类/框架)。 |
| 补齐 YOLO 和 COCO 格式 | 搞清楚这两个主流数据格式的必要形式和字段含义(本周找时间补一下)。 |
| 继续摸清工具和接单渠道 | 了解相关的证书工具(如LabelImg、CVAT等),搞清楚接单流程,继续防坑。 |
六、✨ 本周高光时刻
这周的高光时刻不止一个!第一个高光是文本分类模块正式结课,用102道模拟题把情感分类练到98%、主题分类练到90%,专项补题后全部达到100%。第二个高光是目标检测跑通了整个模型——成功跑通了从收集图片、打标签、训练、评估到输出的五步闭环,模型分数跑到了mAP50 = 0.856。最绝的是,我彻底弄懂了“脚本是锅,模型是菜”的底层逻辑,知道了算力不够会死机(重启就行)和崩溃(训练白干)的区别。这说明我不再是只会点按钮的小白,而是真正摸到了AI模型背后的门道。
- 为什么算高光:这是第一次从头到尾完整学完并跑通的两个核心AI标注模块(目标检测 + 文本分类),而且还是纯自主练习,没有商单逼着。这证明AI学习这件事,真的可以从“看不懂”变成“能上手”。
七、一句话总结本周
这周最大的收获不是学会了几款工具,而是发现自己面对一堆陌生术语时,不再害怕了。从搞懂脚本与模型的本质区别,到跑通目标检测和文本分类闭环,我彻底明白:AI不替我思考,但我能通过它真正学会“造轮子”。
📌 3 行速记
· 主线:接单渠道摸底 → 目标检测五步闭环 → 文本分类结课
· 工具:Label Studio、MAKE SENSE、WorkBuddy、豆包、YOLO
· 核心:AI 不替我思考,但能让我真正学会“造轮子”

331

被折叠的 条评论
为什么被折叠?



