您所在的位置: 成果库 一种图书馆智能机器人障碍物识别方法

一种图书馆智能机器人障碍物识别方法

成果类型:: 发明专利

发布时间: 2025-10-24 23:30:38

科技成果产业化落地方案
方案提交机构:成果发布人| 张慧如 | 2025-10-24 23:30:40

该成果核心技术路径以 “‘图像增强 - 光流分析 - 运动分割’三级协同” 为核心,具体步骤明确:①图像采集与增强:通过机器人搭载的传感器收集图书馆场景的彩色图像与深度图像,先对图像生成频率谱,构造复数相位核并与频率谱点乘,完成频率谱调制;再通过边缘权重调制彩色图像颜色,增强图像边缘细节(如书架缝隙、地面凸起),提升复杂光环境(如书架阴影、灯光反射)下的图像质量;②运动信息提取:采用 Farneback 稠密光流算法,分析连续帧图像的像素运动轨迹,生成二维光流场,精准捕捉运动障碍物(如行走的读者、移动的座椅)的运动特征;③障碍物区域定位:使用 K-means 聚类算法对二维光流场进行聚类,将运动特征相似的像素归类生成信息素值矩阵,再通过阈值分割提取有效运动区域,生成最终运动区域掩膜,结合增强后的静态图像,实现静态(书架、桌椅)与动态(读者)障碍物的精准区分。

本项目研发的图书馆智能机器人障碍物识别方法,通过三大创新突破上述痛点:一是首创 “相位拉伸变换 + 边缘权重” 图像增强技术,区别于传统单一滤波增强,先通过复数相位核调制频率谱,突出图像高频边缘信息(如书架缝隙、地面凸起),再结合边缘权重优化颜色对比度,复杂光环境下图像特征清晰度提升 80%,静态障碍物识别准确率从 60% 提升至 95%,定位偏差控制在 ±2mm 以内;二是 “Farneback 光流 + K-means 聚类” 运动分析,Farneback 稠密光流算法可捕捉像素级运动轨迹,生成的二维光流场完整反映动态目标运动趋势,再通过 K-means 聚类将运动特征相似的像素归类,有效区分 “读者行走” 与 “书架阴影”,运动障碍物误判率从 30% 降至 2% 以下;三是 “静态 + 动态” 障碍物协同识别,将增强后的静态图像与运动区域掩膜融合,既精准定位静态障碍物位置,又标记动态障碍物运动范围,机器人可根据障碍物类型调整避障策略(如静态障碍物绕行、动态障碍物等待),避障成功率从 75% 提升至 98%。

本项目研制的图书馆智能机器人障碍物识别方法,核心定位为 “智慧图书馆智能机器人障碍物识别核心算法”,可广泛应用于图书馆借阅机器人、巡馆机器人、整理机器人等领域,具体覆盖以下核心方向: 一是图书馆借阅机器人避障,可作为借阅机器人自主移动的核心算法,用于书籍搬运过程中的障碍物识别,适配书架密集区、读者流动区等场景。例如在深圳市某高校图书馆试点中,搭载该算法的借阅机器人,可精准识别书架边角、地面台阶等静态障碍物,同时避开行走的读者、临时停放的轮椅等动态目标,自主移动避障成功率从 75% 提升至 98%,书籍配送准确率从 88% 提升至 99%,单台机器人日配送书籍数量从人工 300 册提升至 800 册,且无碰撞事故发生;在书架密集区,算法对书架缝隙的识别精度达 ±2mm,机器人可精准停靠书架取书,取书效率提升 40%。 二是图书馆巡馆机器人环境监测,可用于巡馆机器人的安全巡检,识别图书馆内的异常障碍物(如掉落的书籍、倾倒的桌椅)。该算法通过运动区域掩膜快速区分 “正常读者” 与 “异常障碍物”,某公共图书馆试点显示,巡馆机器人发现异常障碍物的响应时间从人工 5 分钟缩短至 10 秒,异常处理效率提升 30 倍,同时避免误将读者判定为异常,减少不必要的预警干扰;在闭馆后巡检中,算法可在低光环境下清晰识别地面污渍、门窗异常,保障图书馆夜间安全。 三是图书馆书籍整理机器人定位,可辅助整理机器人精准识别书籍摆放偏差(如突出的书籍、错位的书架),通过图像增强后的边缘细节,机器人可快速定位需整理的书籍位置,整理效率较人工提升 2 倍;同时,算法兼容图书馆 RFID 标签识别,可在避障的同时完成书籍信息读取,实现 “避障 + 盘点” 一体化作业。 随着我国智慧图书馆建设加速(年增速超 25%),图书馆智能机器人市场规模年增 30%,预计 3 年内该方法可覆盖国内 25% 以上图书馆智能机器人,带动图书馆自动化率从目前的 40% 提升至 65%,年潜在经济效益超 8 亿元,推动文化服务向 “智慧化、无人化” 转型。

1. 胡琴(核心发明人,深圳市万德昌创新智能有限公司):公司技术总监,长期深耕计算机视觉与机器人障碍物识别领域,主导本成果整体技术架构设计,提出 “相位拉伸变换 + 光流聚类” 核心思路,曾参与广东省智慧图书馆专项课题(聚焦图书馆机器人自主移动),发表计算机视觉相关论文 6 篇,拥有 3 项图像识别领域专利,在技术研发中负责算法架构搭建与核心难点攻克(如相位核构造、光流聚类优化),是成果创新的领军者。2. 邹元华、邹佳轩(算法研发组,深圳市万德昌创新智能有限公司):邹元华负责图像增强模块开发,攻克 “复数相位核调制” 技术难点,优化频率谱与相位核点乘逻辑,使图像边缘细节清晰度提升 80%;邹佳轩专注于光流分析与聚类算法开发,优化 Farneback 稠密光流的参数设置(如窗口大小、迭代次数),提升运动轨迹捕捉精度,同时改进 K-means 聚类的初始聚类中心选择方法,运动区域分割准确率达 94%,二人共同保障算法核心性能。

为了研发该成果,深圳市万德昌创新智能有限公司在 2024 年 1 月 - 2025 年 5 月期间累计投入经费 480 万元,主要用于核心技术研发(图像增强算法 180 万元、光流聚类算法 150 万元)、测试平台搭建(图书馆场景模拟与数据采集 100 万元)、成果验证(50 万元),其中深圳市科技创新专项补贴 150 万元,企业自筹 330 万元。目前该算法已在 3 家图书馆的智能机器人上试点应用,试点反馈显示,机器人障碍物识别准确率提升 40%,避障成功率提升 23%,图书馆人工干预次数从每日 15 次降至 2 次,初步实现技术价值转化,预计 2025 年底可实现首笔算法许可收入。   针对产业化落地,尚需投入 220 万元研发经费(2025-2026 年),主要用于三方面:一是功能拓展,增加多语种图书馆场景适配(如外文书籍标签识别)、多机器人协同避障算法,预计投入 80 万元;二是行业适配,针对档案馆、书店等类似场景优化算法参数(如档案馆密集架识别、书店货架商品识别),预计投入 70 万元;三是合规认证,获取智慧图书馆装备相关认证(如文化行业技术标准认证),预计投入 70 万元,计划 6 个月内完成技术迭代。   成果在推动科学技术进步方面,突破了 “图书馆复杂场景机器人障碍物识别鲁棒性差” 的技术瓶颈,提出的 “相位拉伸增强 + 光流聚类” 技术范式,为特定场景(如密集货架、人流复杂区域)机器人障碍物识别提供新解决方案,相关技术可推动《图书馆智能机器人障碍物识别技术要求》行业标准的制定,提升我国智慧文化装备的自主创新能力;在保障产业发展方面,该算法可带动图书馆机器人、计算机视觉传感器、人工智能软件等上下游产业发展,预计 3 年内带动相关产业链增收 5 亿元;在社会效益方面,提升图书馆服务效率,减少人工成本(单台机器人替代 2 名图书管理员的基础工作),契合 “文化强国”“智慧社会” 国家战略,具备显著的科学价值、经济价值与社会价值。

1. 技术许可与算法销售:向图书馆机器人制造商(如文化装备企业、智能机器人厂商)许可核心技术(如 “相位拉伸图像增强算法”“光流聚类运动分割逻辑”),按机器人产量收取提成,单台机器人技术许可费 800-1500 元;向图书馆、档案馆等用户销售标准化障碍物识别算法包,针对不同场景提供定制化功能(图书馆版增加书架识别,档案馆版增加密集架适配),单套算法包售价 5-10 万元;为存量图书馆机器人提供算法升级服务(加装本成果算法模块),单台升级费用 3-5 万元,降低用户替换成本。   2. 联合开发与产品定制:与图书馆机器人整机企业联合开发 “图书馆专用智能机器人”,深圳市万德昌创新智能提供障碍物识别核心算法,合作方负责机器人硬件研发与市场推广,按产品销售额的 15%-20% 收取技术收益分成;优先对接年产能超 300 台的机器人企业,针对借阅、巡馆、整理等不同类型图书馆机器人,开发专属障碍物识别功能(如借阅机器人增加书籍取放避障,巡馆机器人增加异常检测)。   3. 智慧图书馆解决方案合作:为图书馆提供 “机器人 + 算法 + 运营” 打包服务,除销售算法与机器人外,协助图书馆设计智能借阅流程(如机器人取书 - 配送 - 还书的全流程避障规划),提供算法维护与升级服务,单图书馆解决方案费用 80-150 万元;与文化科技公司合作,将算法纳入智慧图书馆整体解决方案,共享项目收益;同时为图书馆工作人员提供算法操作培训,单次培训费用 3 万元 / 馆。   4. 资金与资源需求:产业化阶段需引入 600 万元合作资金,用于三方面:一是算法工程化(投入 300 万元,开发适配不同机器人的 SDK 与测试工具);二是市场推广(投入 150 万元,参加文化装备展会、对接全国图书馆协会);三是人才团队建设(投入 150 万元,引进计算机视觉、机器人系统集成领域专业人才);优先对接具备图书馆行业资源(如公共图书馆渠道)、机器人制造能力或文化科技服务经验的合作方,要求合作方具备 300 万元以上资金实力与 2 年以上相关行业经验。   转化目标:1 年内完成 8 家图书馆机器人企业技术许可,实现收入 500 万元。