【AI产品经理实战】Week 2 复盘|从“天书”到“选择题”,我摸到了AI标注的门道

| 进度条:学习第 191 天|当前:第 2 周完结 |

一、这周我干了啥(按天过一遍)

1.1 Day 7:标注接单渠道大摸底 + 打框基本功

🔗 原博客链接点击查看 Day 7 详细记录

  • 任务原文:摸接单渠道,打磨打框基本功,盘点接触过的标注类型。

    • 做了+结果:主要就干了两件事。第一,跑去QQ群搜了4个关键词找单子,发现每个群的公告要求都不一样,有的要审核资质,有的要开发商信息,干脆先截图存着慢慢看。第二,把质检工具从豆包换成了WorkBuddy,确实好用很多。同时也发现了自己之前的问题:模型指标忽高忽低(同样数据两次跑,一次47%,一次83%),而且纸箱和快递盒用了不一样的编号,属于重复标签。
任务项具体操作 / 细节(大白话)状态
摸底接单渠道在QQ群搜了4个关键词,发现群公告要求各异(审核要求、开发商资质等),先截图存档。✅ 完成
盘点标注技能理清三类:单图单标签(偏审核)、多标签分类(属性标注)、目标检测(画框,刚上手)。✅ 完成
总结打框四原则1.贴边(不留大空白);2.一物一框;3.禁止重叠;4.看见就框(一个都不能漏)。✅ 完成
梳理接单模式区分模式一(选择题型、偏审核)和模式二(标注题型、偏实操,这是我目前走的路线)。✅ 完成
初步定位模型问题发现当前问题:指标忽高忽低(同数据两次训练47%和83%)、标签重复(纸箱/快递盒用了不同编号)。⚠️ 待解决

1.2 Day 8:重标第3版 + 跑YOLO模型验证标注质量

🔗 原博客链接点击查看 Day 8 详细记录

  • 任务原文:把昨天25张图重新打标,然后跑模型看效果。

    • 做了+结果:今天把前两天打标出错的那25张图全部重标了。把前两版的问题修了,还把“袋子”和“麻袋”合并成了一个标签,类别从32类精简到31类。顺手继续在QQ群里排雷,看透了骗子套路(加好友、点链接、交钱的直接拉黑)。重标完之后用YOLO连着跑了4次训练,终于搞明白了——标注质量高低,真的直接决定模型跑出来的分数。
任务项具体操作 / 细节(大白话)状态
继续筛选QQ群只留活跃群观察真任务。建立防骗意识:凡是“加好友、点链接、先交钱”的,一律当骗子处理。✅ 完成
第三版重标图前两版打标有问题,今天彻底重标了 25 张图(包含处理图像重叠难框的问题)。✅ 完成
合并重复标签把“袋子”和“麻袋”合并成一个标签,把类目从 32 类精简为 31 类。✅ 完成
执行重标三原则1.同类统一名称;2.重叠物体分开框;3.框要贴边,不能模糊或虚大。✅ 完成
跑4次模型训练用重标后的25张图,跑了4次YOLO训练,揪出“我的标注质量到底怎么样”。✅ 完成

1.3 Day 9:数据质检“避坑”实战 + 坐标反推法修复编号错乱

🔗 原博客链接点击查看 Day 9 详细记录

  • 任务原文:用 WorkBuddy 对标注结果做质检,修复编号错乱问题。

    • 做了+结果:今天弄懂了为什么模型会认错物体。因为YOLO导出的编号是临时生成的,删改标签会导致编号重排。学了一个不用重画的“坐标反推法”,对比新旧框中心点距离小于0.012就认作同一个物体,10分钟就修完了。然后固定随机种子跑了50轮,模型跑到了0.856分(准确率77.7%,召回率63.2%)。最后把作废的907版和重标的908版分开管理,绝不混用。
任务项具体操作 / 细节(大白话)状态
排查编号错乱(换座位)发现YOLO导出的编号是临时生成的,删改标签会导致编号重排,导致模型认错。✅ 完成
修复错乱(坐标反推法)不重画!对比新旧版本框的中心坐标,距离<0.012算同一物体,反推匹配映射,10分钟修完。✅ 完成
跑通模型训练20张训练/5张测试/158个框,固定随机种子跑50轮。✅ 完成
模型评估成绩mAP(准确率)50 = 0.856(P=0.777 准确率 / R=0.632 召回率),mAP50-95 = 0.720。✅ 完成
明确小样本测试规则验证集只有5张图,单次分数浮动0.01内正常,必须固定种子看趋势。✅ 完成
数据版本管理明确907版作废,908版与标准表对应。两版数据绝不混用。✅ 完成

1.4 Day 10:目标检测五步闭环初步摸底:从“天书”到看懂“股票崩盘”

🔗 原博客链接点击查看 Day 10 详细记录

  • 任务原文:了解目标检测模型“收集、打标、训练、评估、输出”五个步骤背后的原理。

    • 做了+结果:今天没跑代码,专心把目标检测的五个步骤(收集、打标、训练、评估、输出)背后的原理吃透了。最大的收获是学会了看评估曲线,知道了什么是“过拟合(学傻了)”,什么是“欠拟合”。还搞懂了算力不够的话,电脑会死机(内存满了,重启就行)或崩溃(程序挂了,训练白干)。弄清了脚本就是干活的锅,模型就是最后出锅的菜。
核心环节输入(干什么)输出(得到什么)翻车点 / 跳过会怎样
1. 收集图片准备真实世界的各种场景照片。一批原始图片(JPG/PNG格式)。翻车点:图太少、角度单一导致“偏科”;模型成了“井底之蛙”,遇到新场景直接傻眼。
2. 打标签把图片里的物体框出来,并贴上分类名字。带坐标和标签的文本文件。翻车点:没有坐标和名字,机器就完全看不见目标,最后只能瞎猜。
3. 训练把打好标签的文件和原图喂给机器。模型权重文件(.pt格式)。翻车点:轮次太多(死记硬背);轮次太少(没学到规律);算力不够会导致“死机”或“崩溃”
4. 评估训练好的模型 + 全新没见过的图片。成绩单(像股票一样的曲线图 + mAP 数值)。翻车点:作弊(混入训练过的图)、样本太少、全是同一种类别。跳过评估,就不知道模型好坏,实战直接报废。
5. 输出评估合格的模型文件。给一张新图,它能自动干活。翻车点:前面任意一环有短板,这里都会暴露。输出就是一面“照妖镜”。

📊 成绩单怎么看(t / v / m 曲线的秘密):

  • train(作业):正常状态是一开始像跳崖一样陡峭下降,然后慢慢变缓,最后变成一条直线(收敛)。
  • val(期末):正常状态同样是一开始陡降,然后平缓,最后走平。
  • mAP(分数):和错误率相反,一开始陡峭上升,然后变缓,最后趋于平稳。
  • ⚠️ 过拟合(学傻了):train一直降,val过了某个点开始往上翘。欠拟合(没学会):mAP数值一直上不去。

🧠 避坑与底层认知:

  • 算力不够会怎样? 死机是内存/显存占满(重启可恢复);崩溃是程序崩了(训练全白干)。解决方法:降低点难度(图片尺寸调小或换小模型),重新跑一遍。
  • 脚本、程序、模型到底是什么关系? 脚本 = 程序 = 干活的工具(比如厨房里的锅)。模型 = 训练最终生成的成果(比如最后出锅的菜)。工具坏了可以重跑,模型是最后的活儿。

1.5 Day 11:文本分类初学:从定义到 102 道模拟题

🔗 原博客链接点击查看 Day 11 详细记录

  • 任务原文:学习文本分类基础,试用标注工具,完成模拟练习题。

    • 做了+结果:今天把文本分类的“情感”和“主题”两大类练了。情感分类是判断外卖评论好坏(正/中/负面),做了50题,拿了98%。主题分类是判断新闻属于体育、科技、教育、娱乐还是财经,做了40题,拿了90%。发现自己科技和财经容易混,体育词汇看不懂,背了速记词卡补回来。折腾Label Studio时,旧域名进不去,换了新域名,还碰到了导出按钮点不出来的bug。
任务项具体操作 / 细节(大白话)状态
情感分类外卖评论判断正/负/中(50题练到98%)。✅ 完成
主题分类新闻判断体育/科技/财经/教育/娱乐(练到90%,专项补了12题到100%)。✅ 完成
踩坑与补丁科技/财经易混淆;体育术语不熟。用“主语判断法”+死磕体育速记词卡。✅ 完成
Label Studio旧域名 app.heartex.com 失效,换新域名 app.humansignal.com。导出弹窗无按钮是 v2.3 渲染bug,换 Chrome 或手机。⚠️ 导出待解决

1.6 Day 12:文本分类收官,主观题见好就收

🔗 原博客链接点击查看 Day 12 详细记录

  • 任务原文:完成文本分类收尾三件套(相关性判断 / NER 划词 / 简答题),模块整体结课。

    • 做了+结果:今天把文本分类最后三块硬骨头啃了。相关性判断做了20题(85%),发现“部分相关”最难搞(比如搜儿童自行车出来汽车),补了15道专项题才100%,其中包括“相关、部分相关、不相关”三个选项内容。NER划词练了三遍,从83%干到了100%,也搞清楚了“五年”是时长不是时间点。简答题做了6题,是AI写初稿我来批注修改,做了91%后觉得实在太耗时间,果断止损。用Word直接造题确实省时间,Label Studio平台搜索相关性和情感项目的全流程也跑通了。
任务项具体操作 / 细节(大白话)状态
复习昨日错题情感+主题各10题,20题全对。✅ 完成
相关性判断题20题85%,补专项题15道(33%→100%)。部分相关最难搞,做项目前必须定标准!✅ 完成
Label Studio搜索相关性和情感项目全流程跑通。✅ 完成
NER 划词标注初测83% → 二刷91% → 三刷100%。“五年”这种是时长,不是时间点,不能算。✅ 完成
简答题练习6题AI辅助,5.5/6(91%)。AI生成初稿,我来做人工批注和审核。偏主观、极耗时间,主动止损。✅ 完成(主动止损)

1.7 本周产出清单

产出类别具体内容 / 数据(大白话)备注 / 说明
博客更新Day 7 ~ Day 12 完整实战记录共 6 篇
图片标注与模型训练重标25张图,合并重复标签(32类精简到31类)。用YOLO连跑4次训练,固定随机种子跑50轮。mAP 50跑到 0.856(准确率77.7%,召回率63.2%)
文本分类练习情感分类50题(98%),主题分类40题(90%,补12题到100%)。累计 102 道模拟题
文本分类收尾相关性判断20题(85%,补15题后100%);NER划词(83%→二刷91%→三刷100%);简答题6题(91%止损)。模块整体结课
工具踩坑与解决Label Studio旧域名失效换新域名;导出按钮bug换Chrome搞定;坐标反推法10分钟修复YOLO编号错乱。记录了3个工具级踩坑点
核心认知沉淀目标检测五步闭环(含输入、输出、翻车点);t/v/m曲线图解读;脚本=锅,模型=菜。沉淀 3 个核心方法论

二、这周学到的硬货(先术语,后大白话)

2.1 目标检测五步闭环(细节全貌+防坑指南):

核心环节输入(干什么)输出(得到什么)翻车点 / 跳过会怎样
1. 收集图片准备真实世界的各种场景照片一批原始图片(JPG/PNG格式)翻车点:图太少、角度单一导致“偏科”;背景全是草地,模型就成了“井底之蛙”,遇到新场景直接傻眼。
2. 打标签把图片里的物体框出来,并贴上分类名字带坐标和标签的文本文件翻车点:没有坐标和名字,机器就完全看不见目标,最后只能瞎猜。
3. 训练把打好标签的文件和原图喂给机器模型权重文件(.pt格式)翻车点:轮次太多(死记硬背,遇到新题就废);轮次太少(没学到规律,认不准);算力不够会导致“死机”或“崩溃”。
4. 评估训练好的模型 + 全新没见过的图片成绩单(曲线图 + mAP 数值)翻车点:作弊(混入训练过的图)、样本太少、全是同一种类别。跳过评估,就不知道模型好坏,实战直接报废。
5. 输出评估合格的模型文件给一张新图,它能自动干活翻车点:前面任意一环有短板,这里都会暴露。输出就是一面“照妖镜”,流程里有一个工序不行,整体直接拉胯。

📊 成绩单怎么看(t / v / m 曲线的秘密):

  • train(作业):训练集错误率。正常状态是:一开始像跳崖一样陡峭下降,然后慢慢变缓,最后变成一条直线(收敛,学到位了)。
  • val(真实水平):验证集错误率。正常状态同样是一开始陡降,然后平缓,最后走平。这说明模型真学会了,不靠死记硬背。
  • mAP(准确率):评估指标。和错误率相反,一开始陡峭上升,然后变缓,最后趋于平稳。
  • ⚠️ 过拟合(学傻了):train(作业)一直降,但val(期末)过了某个点开始往上翘。欠拟合(没学会):mAP数值一直上不去,t和v的准确率都不高。

🧠 避坑与底层认知:

  • 算力不够会怎样? 训练需要大量计算(通常需要显卡)。配置不行会“死机”(内存/显存占满,强制重启可恢复)或“崩溃”(训练软件崩了,这些训练全白干,得不到模型成果)。解决方法:重设设置,降低点难度(图片尺寸调小或换小模型),重新跑一遍。
  • 脚本、程序、模型到底是什么关系? 脚本(Python) = 程序 = 干活的工具(比如厨房里的锅)。模型 = 训练最终生成的成果(比如最后出锅的菜)。工具坏了可以重跑,模型是最后的活儿,还没干出来时工具坏了,活儿就没了。

2.2 文本分类(四个关卡全貌)**:

  • 大白话:以前以为只是“给文字贴标签”,实际做下来才发现有4个关卡,每一关的玩法、坑点和工具都不一样:
题型具体操作 / 细节(大白话)成绩 / 状态
1. 选择题(情感/主题分类)情感分类:外卖评论判断正/负/中(50题练到98%)。
主题分类:新闻判断体育/科技/财经/教育/娱乐(练到90%,专项补了12题到100%)。
⚠️ 踩坑:科技/财经容易混淆(选错词就偏了);体育术语不熟(积分榜、领跑、卫冕、晋级、夺冠等词汇看不懂)。
💡 补丁:用“主语判断法”(问主语是谁),外加死磕体育速记词卡。
✅ 完成
2. 相关性判断(三档边界)判断搜出来的内容跟搜索词对不对得上。
三档边界:完全无关 = 不相关;同一大类细分不同(比如搜“儿童自行车”,文章写“汽车”) = 部分相关;核心教材/答案一致(比如考研数学 vs 高数同济版) = 相关。
⚠️ 踩坑:部分相关的边界最难搞,做项目前必须先跟客户定好标准!
✅ 完成(补题后100%)
3. NER 划词标注就像拿记号笔去文章里“抓娃娃”,只抓人名、地名、机构名、具体时间这四类词。
⚠️ 踩坑:“五年”这种是时长,不是时间点,不能算。还要小心数据泄漏。
✅ 完成(83%→补题后100%)
4. 简答题(翻译/摘要/改写)翻译:关键术语要对,时态要对。
摘要:保留时间、主体、事件、核心数据。
改写:口语化,保留原意。
核心认知:不是让我去创作,而是 AI 生成初稿,我来做人工批注和审核。
⚠️ 踩坑:偏主观、极耗时间,我拿到 91% 后果断止损。
✅ 完成(主动止损)
5. 工具与项目搭建(Label Studio)跑通项目搭建和导出流程。
⚠️ 踩坑:旧域名 app.heartex.com 注册入口已失效,必须换成新域名 app.humansignal.com。需 GitHub 授权,14天内免费。导出弹窗无“创建快照”按钮,刷新后无效,是 v2.3 渲染bug,换成 Chrome 或手机测试即可。
✅ 完成

💡 总结:文本分类不只是“选择题”,还有划词和简答。这四关全跑通,才算真正摸透了文本标注的底层逻辑。

三、这周卡在哪 & 还没搞懂的

类型卡点现在到哪一步了(大白话版)
工具Label Studio 导出流程旧域名 app.heartex.com 注册入口隐藏,换成新域名需要 GitHub 授权。导出弹窗无“创建快照”按钮,刷新也无效。后来发现是 v2.3 渲染 bug,换 Chrome 浏览器才勉强解决。替代方案还留了 doccano、LabelU、百度 EasyData、腾讯 QLabel 备用。
知识目标检测代码(.py 脚本)知道 train.py 里要改 epochs=30(训练轮数)和 batch_size=8(看图数量),但自己没动手改过代码。只停留在用 WorkBuddy 生成,还没自己跑通一遍完整的训练脚本。
资源接单渠道不清晰搜了百度众测、腾讯搜活帮、京东众智等几个群。发现群公告要求各异(有的要考试、有的要开发者资质),骗子套路太多(凡是加好友、点链接、先交钱的一律拉黑)。还没完全筛选出真正有效的接单渠道,需要继续观察活跃群。
知识目标检测后10%代码部分图像模块暂时搁置。因为接下来要去学文本分类,所以这部分打算等以后回过头来精修,或者等学完代码基础后再来补。

四、这周想通了什么(认知变化)

  • 以前觉得 AI 验收就是让 AI 帮我看看对不对,把 AI 当成替我干活的苦力。这周把质检从豆包换成 WorkBuddy 之后,我发现 AI 确实能帮我快速排查错误,但最终判断权必须在我手里——AI 不替我思考,只替我干活

  • 我彻底搞懂了**“脚本、程序、模型”**的关系:脚本 = 程序 = 干活的工具(比如厨房里的锅);模型 = 训练最终生成的成果(比如最后出锅的菜)。工具坏了可以重跑,模型是最后的活儿,还没干出来时工具坏了,活儿就没了。

一句话教训:AI排版润色博客内容可以,但最终判断权必须在我。

五、下周打算干啥

💡 注:这周结束,图像分类和文本分类两个板块就算是正式收尾了。下周不干别的,核心任务就是拿招聘信息来“检验成果”,看看自己到底能干点什么。

任务验收标准(怎么算做完)
整理招聘信息,检验学习成果收集图像分类和文本分类相关的岗位JD,盘点自己目前具备哪些能力、还缺哪些能力。
整理能力对照表根据招聘信息,列一张“学习成果 vs 岗位需求”的对照表,看清楚自己能胜任什么。
汇总文档结构把这两个板块的知识点和踩坑记录,整理成一个清晰的文档结构(分类/框架)。
补齐 YOLO 和 COCO 格式搞清楚这两个主流数据格式的必要形式和字段含义(本周找时间补一下)。
继续摸清工具和接单渠道了解相关的证书工具(如LabelImg、CVAT等),搞清楚接单流程,继续防坑。

六、✨ 本周高光时刻

这周的高光时刻不止一个!第一个高光是文本分类模块正式结课,用102道模拟题把情感分类练到98%、主题分类练到90%,专项补题后全部达到100%。第二个高光是目标检测跑通了整个模型——成功跑通了从收集图片、打标签、训练、评估到输出的五步闭环,模型分数跑到了mAP50 = 0.856。最绝的是,我彻底弄懂了“脚本是锅,模型是菜”的底层逻辑,知道了算力不够会死机(重启就行)和崩溃(训练白干)的区别。这说明我不再是只会点按钮的小白,而是真正摸到了AI模型背后的门道。

  • 为什么算高光:这是第一次从头到尾完整学完并跑通的两个核心AI标注模块(目标检测 + 文本分类),而且还是纯自主练习,没有商单逼着。这证明AI学习这件事,真的可以从“看不懂”变成“能上手”。

七、一句话总结本周

这周最大的收获不是学会了几款工具,而是发现自己面对一堆陌生术语时,不再害怕了。从搞懂脚本与模型的本质区别,到跑通目标检测和文本分类闭环,我彻底明白:AI不替我思考,但我能通过它真正学会“造轮子”。


📌 3 行速记
· 主线:接单渠道摸底 → 目标检测五步闭环 → 文本分类结课
· 工具:Label Studio、MAKE SENSE、WorkBuddy、豆包、YOLO
· 核心:AI 不替我思考,但能让我真正学会“造轮子”


我是卿卿,一个正在自学 AI 知识的小白,正在探索和摸索自学的路上。 如果你也在学习,欢迎来交流。

评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

卿卿的产品经理日记

每一份打赏,都是对我干货的认可

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值