xsd20241118
码龄14年
求更新 关注
提问 私信
  • 博客:44,145
    44,145
    总访问量
  • 91
    原创
  • 1
    粉丝
  • 227
    关注
IP属地以运营商信息为准,境内显示到省(区、市),境外显示到国家(地区)
IP 属地:湖北省
目前就职: 武汉巽视达科技有限公司
加入CSDN时间: 2012-04-04

个人简介:专注于计算机视觉、视频分析和雷达融合感知以及大小模型技术应用

博客简介:

巽视达的专栏

查看详细资料
博客首页
个人成就
  • 武汉巽视达科技官方账号
  • 获得656次点赞
  • 内容获得0次评论
  • 获得540次收藏
  • 博客总排名23,346名
  • 原力等级
    原力等级
    4
    原力分
    283
    本月获得
    386
创作历程
  • 91篇
    2026年
成就勋章
  • 入选《人工智能领域内容榜》第34名
TA的专栏
  • 人工智能
    1篇

TA关注的专栏 3

TA关注的收藏夹 0

TA关注的社区 6

TA参与的活动 0

兴趣领域 设置
  • 人工智能
    计算机视觉人工智能深度学习边缘计算图像处理
创作活动更多

AtomGit「码动四季·开源同行」秋季征稿活动

秋季征稿主题:开源成果经验分享 成果不止一种形态,我们为你准备了六大赛道,总有一款适合你: 开源项目成果复盘 把项目一年/一季的成长摊开来看:里程碑复盘、Star 与用户增长复盘、版本迭代复盘、从 0 到 1 的发布复盘。 🖊️ 示范选题: ●开源项目从 0 到 1000 Star,我做对了什么 ●开源一周年,我交出的成绩单 这类文章不只是一次经验分享,也是一张项目名片。欢迎将项目托管到 AtomGit 并申请成为 G-Star 项目,通过后可获得平台流量推荐、项目宣传等权益。(G-Star:AtomGit 最具影响力开源项目) ![在这里插入图片描述](https://i-blog.csdnimg.cn/direct/1f90c61528ad410d8d66f9d0e3707a5a.png) 咨询 G-Star 项目申请 2️⃣ 技术经验体系化沉淀 踩坑合集、最佳实践总结、工具链实战、CI/CD 流水线搭建、代码重构与架构演进。 🖊️ 示范选题: ●提了 50 个 PR 后,我总结的开源协作避坑清单 ●一次重大重构复盘:把单体拆成可维护的模块 3️⃣ AI 赋能开源的实战成果 AI 编程助手实战测评、基于开源模型的微调与应用开发、AI 辅助研发提效流水线。 🖊️ 示范选题: ●我用 AI 编程助手把提 PR 效率翻了 3 倍 ●基于开源大模型搭了个 XX 工具(附完整教程) 4️⃣ 开源共建笔记|文档、社区与布道 开源文档写作与翻译、issue 互助经验、组织 meetup、用开源项目做教学与分享。 🖊️ 示范选题: ●一个优秀开源项目,文档应该怎么写 ●我用开源项目做了个线上 Workshop ![在这里插入图片描述](https://i-blog.csdnimg.cn/direct/23e83ceebc594c379f7fc6aa8dcfa40c.png) 扫码加入码动四季投稿交流群,和更多伙伴一起交流技术!

273人参与 去参加
  • 最近
  • 文章
  • 专栏
  • 代码仓
  • 资源
  • 收藏
  • 关注/订阅/互动
更多
  • 最近

  • 文章

  • 专栏

  • 代码仓

  • 资源

  • 收藏

  • 关注/订阅/互动

  • 社区

  • 帖子

  • 问答

  • 课程

  • 视频

搜索 取消

Python自动获取Google Earth图像+YOLOv9烟囱识别检测系统

Python自动获取Google Earth卫星图像+YOLOv9烟囱识别检测系统:卫星遥感图像中工业烟囱自动标注,经纬度坐标映射,环保监测与污染源排查工业烟囱是大气污染物排放的主要固定源之一,也是环保监管、碳排放核算、城市规划和工业调查的重点关注对象。传统的烟囱排查方式主要依赖人工现场巡查、企业自报和卫星图像人工判读——人工巡查效率低、覆盖范围有限、难以发现隐蔽和违规烟囱;企业自报数据存在瞒报漏报风险;卫星图像人工判读虽然覆盖范围广,但需要专业人员逐张查看,效率极低,一个地级市的工业区可能需要数周才能完成
原创
博文更新于 1 小时前 ·
7 阅读 ·
0 点赞 ·
0 评论 ·
0 收藏

Video2X:AI视频超分辨率与帧插值框架完整实战指南

项目代码结构清晰:src/为核心源码,include/libvideo2x/为可复用的C++库(libvideo2x是项目的核心引擎,其他程序可以通过链接这个库复用视频增强能力),models/集中存放四套算法的模型文件,docs/book为mdBook文档,tools/video2x是命令行入口,packaging/维护各发行版打包配置,scripts/包含Anime4K着色器管理脚本。传统播放器把视频放大,用的是双线性/双三次插值——在已知像素之间"平均"出新像素,结果永远是模糊的;
原创
博文更新于 2 小时前 ·
10 阅读 ·
0 点赞 ·
0 评论 ·
0 收藏

三光谱AI头皮检测:六维头皮问题智能识别

三光谱AI头皮检测系统:白光+偏振光+UV紫外光多光谱成像,六维智能识别头皮问题,量化评估与个性化建议头皮健康是毛发健康的根基,也是近年来消费医疗和养发行业最受关注的赛道之一。头油泛滥、头皮敏感泛红、毛囊堵塞、角质堆积、头发变细变软、密度下降——这些问题不仅影响外观,更是头皮微生态失衡、毛囊功能衰退的早期信号。然而,传统的头皮检测长期依赖美容师或皮肤科医生的肉眼观察和经验判断:检测结果主观性强、缺乏量化标准、不同检测人员之间结论差异大、无法追踪细微变化、消费者拿到的往往是"有点油""有点敏感"这类模糊描述,
原创
博文更新于 3 小时前 ·
17 阅读 ·
0 点赞 ·
0 评论 ·
0 收藏

激光雷达与摄像头融合:船舶吃水深度识别算法

激光雷达与摄像头融合的船舶吃水深度识别系统:点云干舷分割+视觉水线检测+多传感器融合,厘米级精度,全天候工作船舶吃水深度是衡量船舶载重状态最直接、最重要的参数之一。在港口水尺计重中,检验人员需要通过观测船舶六面吃水(船首左、右,船中左、右,船尾左、右)来计算船舶排水量和货物重量;在航道和船闸管理中,吃水深度是判断船舶是否超载、是否满足通航水深要求的核心依据;在航运安全中,吃水过浅可能导致货物装载不足影响经济性,吃水过深则可能触底搁浅。然而,传统的吃水测量方式长期依赖人工目测——检验人员需要乘坐小艇靠近船体,
原创
博文更新于 15 小时前 ·
98 阅读 ·
0 点赞 ·
0 评论 ·
1 收藏

AI台球自动计分系统:俯视相机视觉识别与球体跟踪

AI台球自动计分系统:俯视相机视觉识别与球体跟踪,端到端延迟低于200ms,支持中式八球、九球、斯诺克三种规则打台球时最让人分心的事情是什么?不是对手的实力,而是计分。中式八球要记谁打全色谁打花色、黑8能不能打、犯规后自由球摆哪里;九球要记1到9的顺序、大金小金怎么算;斯诺克更复杂,红彩交替、罚分规则、自由球、单杆最高分。传统的人工计分方式——用计分牌、扑克牌、手机APP,甚至口头记忆——不仅容易出错,还会打断打球的节奏和专注度。更麻烦的是争议球:这个球到底进没进?白球是不是先碰了对方的球?黑8是不是提前进
原创
博文更新于 昨天 07:30 ·
500 阅读 ·
4 点赞 ·
0 评论 ·
2 收藏

AI试卷批阅系统开发:从图像采集到智能评分的完整技术架构

AI试卷批阅系统:从图像采集、题目分割、手写OCR识别到智能评分的完整技术链路,机器批改准确率可达97%,效率提升10倍每次考试结束后,最让教师头疼的不是出题,而是阅卷。一个带5个班的高中数学老师,一次月考要批改250份试卷,每份试卷20多道题,仅选择题和填空题的机械判分就要花费数小时,解答题的分步批改和错因分析更是耗时耗力。语文和英语老师的作文批改同样繁重——逐句阅读、标注错误、给出评语、打出分数,一份作文平均需要5-8分钟,一个班50份就是4-6小时。更不用说阅卷过程中的疲劳误差、标准不一致、分数统计错
原创
博文更新于 前天 20:00 ·
336 阅读 ·
0 点赞 ·
0 评论 ·
4 收藏

生产线泡沫袋缺陷检测全解析:从划痕鼓包识别到AI视觉分拣的工程实践

传统图像处理(阈值/边缘/形态学)做简单缺陷(孔洞)和预处理,深度学习目标检测(YOLOv8/YOLO11+P2小目标头+SAHI)做划痕/鼓包/气泡破损/污渍定位分类,语义分割(Attention U-Net/YOLOv8-seg)做像素级轮廓和尺寸测量,无监督异常检测(PaDiM/PatchCore)做冷启动和未知缺陷兜底,3D点云分析做鼓包/凹凸检测。传统方法(阈值分割、边缘检测、形态学处理)对简单、高对比度缺陷有效,但对复杂背景(气泡纹理)、低对比度缺陷(细微划痕)、多样缺陷形态的鲁棒性差。
原创
博文更新于 前天 08:15 ·
197 阅读 ·
0 点赞 ·
0 评论 ·
0 收藏

无人机航拍生产库区目标检测与墙体裂缝识别:从航线规划到AI量化分析

无人机+AI为这个问题提供了全新的解决方案:用工业无人机按规划航线自动拍摄库区所有墙体的高清图像(GSD可达1-5mm/pixel,能看清发丝级裂缝),用深度学习算法自动识别和分割裂缝(像素级精度),并基于图像分辨率自动计算裂缝的实际宽度、长度、面积和等级,最后在三维模型上标注每一条裂缝的精确位置,生成结构化的缺陷台账和巡检报告。0.2mm以下的细微裂缝可能是正常的收缩裂缝,0.2-1mm的中等裂缝需要关注和监测,1mm以上的宽裂缝可能预示结构安全问题,必须立即评估和处理。专用模型精度高但需要多次推理。
原创
博文更新于 2026.09.17 ·
588 阅读 ·
2 点赞 ·
0 评论 ·
9 收藏

树莓派驱动MV-MIPI-IMX287M全局快门相机实现小目标检测:从硬件连接到边缘AI推理

如果小目标特别小(<16×16像素),可以改用YOLOv8n-p2(增加一个stride=4的P2检测头,160×160特征图,小目标特征更丰富),代价是推理速度降低约20%。②更低的噪声——信噪比高,小目标不会被噪声淹没;:MV-MIPI-IMX287M(索尼IMX287全局快门黑白传感器,720×544@523fps,6.9μm大像素,MIPI CSI-2接口,硬触发/软触发,闪光灯同步)+树莓派5 8GB(4核A76 2.4GHz,双MIPI接口,主动散热),整套成本约1500-2500元。
原创
博文更新于 2026.09.17 ·
389 阅读 ·
3 点赞 ·
0 评论 ·
2 收藏

WeKnora开源大模型知识平台:如何把原始文档变成可查询、可溯源的RAG

WeKnora的docreader 支持PDF、Word、TXT、Markdown、HTML、EPUB、MHTML、图片、CSV、Excel、PPT、JSON、XMind 等十余种格式,并具备多模态解析能力:PDF 图文混排还原、图片 OCR 文字识别、表格结构化提取。RAG 防幻觉的关键在提示词约束与证据回挂:系统把用户问题、Top-K片段和"只能依据给定资料回答、资料不足要明说、不得编造"的指令一起组装进提示词,大模型据此生成答案,并在结论处标注引用来源(具体到哪份文档、哪个片段甚至页码)。
原创
博文更新于 2026.09.17 ·
139 阅读 ·
2 点赞 ·
0 评论 ·
2 收藏

InfiniteTalk无限对话:稀疏帧音频驱动视频生成

-use_apg(APG加速);双重Cross-Attention是架构的精髓:音频交叉注意力保证"说得像"(口型、情绪、节奏与语音对齐),参考交叉注意力保证"长得像"(身份、手势、镜头与源视频一致),两者并行注入、互不干扰,共同实现"全身动态与音频有机同步+身份持续保持"。InfiniteTalk以"稀疏帧视频配音"重新定义了音频驱动视频生成:只保留关键帧锚定身份与镜头,把嘴部、表情、头部、身体全部交给模型随音频"即兴发挥",配合流式上下文帧注入、软参考机制与细粒度采样策略,实现了传统方案无法企及的。
原创
博文更新于 2026.09.16 ·
627 阅读 ·
2 点赞 ·
0 评论 ·
8 收藏

高德开源机器人侦查:ABot具身智能全栈开源技术详解与自主巡检实战指南

基于开源ABot体系,一次典型的机器人侦查任务流程如下:①任务下发(云端或自然语言指令)→②自主导航(先验地图+实时SLAM定位,路径规划与动态避障)→③环境感知(多模态数据采集,三维建图与目标检测)→④数据采集(对重点目标近距多角度采集,红外/气体传感器补充)→⑤智能分析(VLA模型推理,异常判定与语义理解)→⑥结果上报(告警推送、巡检报告、云端同步)。①云端大脑-边缘响应两级设计:重模型(VLA大模型、世界模型、任务规划)部署在云端,轻推理(实时定位、避障、目标检测)部署在机器人端侧。
原创
博文更新于 2026.09.16 ·
250 阅读 ·
0 点赞 ·
0 评论 ·
3 收藏

WeKnora:用RAG、Agent与自动Wiki把文档变成鲜活知识

同一批分块同时建立语义向量索引(应对"语义相近但用词不同"的问题,如问"设备坏了"检索"故障报修")、BM25关键词索引(应对"精确术语/型号/编号"的问题)、GraphRAG知识图谱索引(应对"多实体关系"的问题,如"哪些模块依赖A组件")。配合Neo4j profile(docker compose --profile neo4j),WeKnora可以构建知识图谱:抽取文档中的实体(如"设备A""协议B""部门C")及其关系(如"依赖""负责""引用"),图谱既用于可视化浏览,也用于。
原创
博文更新于 2026.09.16 ·
466 阅读 ·
1 点赞 ·
0 评论 ·
3 收藏

熔炼炉烟尘AI视觉识别:炉前浓烟/淡烟/无烟三分类实时监测

<think>我们根据要求,生成一篇不超过150字的文章摘要。需要概括熔炼炉烟尘AI视觉识别的核心内容,包括技术、功能和应用。保持简洁。</think>本文介绍基于计算机视觉的熔炼炉烟尘识别系统,通过耐高温摄像头与深度学习算法(YOLO检测、图像分割、三分类等),实现浓烟/淡烟/无烟实时识别,量化林格曼黑度与浓度,联动除尘与环保上报,解决传统监测痛点,助力冶金行业环保合规。
原创
博文更新于 2026.09.15 ·
531 阅读 ·
2 点赞 ·
0 评论 ·
10 收藏

猪只行为实时AI监测:计算机视觉驱动的进食/休息/活动/社交/嗅探/走动六维行为识别与健康预警

养猪业是中国畜牧业的支柱产业,2025年全国生猪出栏量超过7亿头,规模化养殖比例已突破65%。在万头级别的规模化猪场里,一栋猪舍可能饲养500-1000头猪,而一名饲养员通常需要管理2-3栋猪舍,人均照看数千头猪。传统的猪只行为监测完全依赖人工巡视——饲养员每天定时进入猪舍,用肉眼观察猪只的进食、休息、活动状况,发现异常再记录上报。这种模式存在三大根本性痛点:第一,覆盖不全、漏检率高。人工巡视每天只能进行3-4次,每次每栋猪舍停留10-15分钟,95%以上的时间猪只处于无人监控状态。很多异常行为(如夜间发病
原创
博文更新于 2026.09.15 ·
500 阅读 ·
0 点赞 ·
0 评论 ·
4 收藏

出餐口AI视觉质检:计算机视觉驱动的菜品质量自动检测

餐饮行业的出品质量直接决定顾客满意度和品牌口碑,但传统的人工质检方式存在三大痛点:一是主观性强——不同质检员对"分量够不够""颜色正不正常""摆盘标不标准"的判断标准不一致,同一道菜可能被A判合格、被B判不合格;二是效率低——人工检查一道菜需要5-30秒,高峰期出餐口排队严重,质检员往往只能抽查(通常抽查率不足5%),大量不合格品流到顾客手中;三是数据缺失——人工质检难以记录每道菜的详细质量数据(分量克数、颜色值、温度、缺陷类型),无法进行统计分析和持续改进,后厨管理仍停留在"凭经验、靠感觉"的阶段。这些问
原创
博文更新于 2026.09.15 ·
627 阅读 ·
1 点赞 ·
0 评论 ·
8 收藏

虹膜识别算法全套技术实战:从虹膜检测、精准定位、分割、归一化到特征编码与识别

在所有生物特征识别技术中,虹膜识别被公认为精度最高、稳定性最好的技术之一。虹膜是位于人眼黑色瞳孔和白色巩膜之间的环状区域,直径约11毫米,包含了极其丰富的纹理信息——隐窝、褶皱、色素斑、放射状条纹、冠状环等细节结构,其形态由胚胎发育过程中的随机因素决定,即使是同卵双胞胎的虹膜也完全不同,同一个人的左右眼虹膜也不相同。虹膜在出生后约8个月发育成熟,此后终身保持稳定(除极少数疾病和外伤外),不易被伪造和篡改。这些特性使得虹膜识别的误识率(FAR)可以低至百万分之一甚至千亿分之一,远高于人脸识别(约千分之一到万分
原创
博文更新于 2026.09.14 ·
1002 阅读 ·
10 点赞 ·
0 评论 ·
4 收藏

林区无人机影像松树枯死木识别算法技术

松树感染松材线虫病后,受水分、营养胁迫影响,绿色松针叶会逐渐变色(黄色、黄褐色、红褐色乃至红色),呈现枯死状,在无人机可见光影像上与健康松树形成明显色差——这正是"变色木/枯死木"视觉识别的物理基础。这一闭环的价值在于:监测周期从"人工数月普查"压缩到"无人机数日航拍+算法数小时出图",且输出的坐标信息可直接下发至清理作业队,实现"识别-定位-清理"的业务闭环,这也是国家层面松材线虫病防控(如国家重点研发计划"松材线虫病灾变机制与可持续防控技术"项目)持续推进的技术方向。
原创
博文更新于 2026.09.14 ·
527 阅读 ·
1 点赞 ·
0 评论 ·
13 收藏

海漂垃圾智能识别算法

技术上,YOLO系列目标检测是实时监控的主力,改进型算法(EMA注意力、自校准卷积、NWD损失)解决小目标与背景干扰难题,Mask R-CNN实例分割支撑覆盖率评估与路径规划,多目标追踪赋予系统"预测漂移"的能力;一项针对水面漂浮垃圾的对比研究评估了YOLOv5、YOLOv7、YOLOv8、YOLOv9、YOLOv10、YOLOv11六代模型在五种垃圾类别(易拉罐、泡沫、塑料袋、塑料瓶、杂物)上的检测与分类表现,验证了YOLO家族在重叠目标识别上的能力演进。适用于重点岸段、码头、入海口的7x24小时值守。
原创
博文更新于 2026.09.14 ·
571 阅读 ·
3 点赞 ·
0 评论 ·
5 收藏

野生动物识别算法

该研究以金钱豹、成年雄性岩羊、非成年雄性岩羊为目标构建野生动物视频检测数据集,对比了Faster R-CNN、SSD、YOLOv5、YOLOv8四种经典模型在真实场景中的检测精度、速度与效果,评估维度覆盖F1分数、mAP50、mAP50-95、参数量、帧率。本文系统梳理野生动物识别算法的技术图谱:人工特征时代的经典方法、深度学习时代的目标检测演进、面向复杂野外的模型改进研究、关键数据集与真实部署案例,以及两条技术路线的融合思路,为生态保护从业者、AI算法工程师和研究者提供完整参考。
原创
博文更新于 2026.09.13 ·
426 阅读 ·
3 点赞 ·
0 评论 ·
9 收藏
加载更多