实时数据分析
价格 双方协商
地区: 贵州省 贵阳市 观山湖区
需求方: 贵阳***公司
行业领域
生物与新医药技术
需求背景
近年来,我国突发公共卫生事件应急处置对 “实时性” 要求显著提升:据《中国公共卫生信息化发展报告》,基层公共卫生数据平均响应时间超 3 小时,多源数据融合延迟超 1 小时,导致疫情早期预警、异常病例追踪效率低,难以满足《“十四五” 国民健康规划》“分钟级响应” 要求。尤其在西南地区,公共卫生数据来源分散(医疗、环境、交通等)、格式异构,传统批处理技术已成为瓶颈。贵阳块数据公司作为贵州省公共卫生大数据核心服务商,虽已建成 “城市健康大脑”,但实时性不足:2024 年贵阳市流感监测中,病例数据从采集到分析需 2 小时,错过最佳干预窗口;多源数据(如医院就诊 + 地铁客流)融合时,延迟升至 1.5 小时,无法支撑精准防控决策。同时,贵州县域公共卫生机构技术能力薄弱,现有系统难以应对数据峰值(如疫情爆发时数据量激增 5 倍)。目前,国内头部企业如华为、阿里的流计算技术聚焦金融、电商领域,公共卫生场景适配不足;杭州 “城市大脑” 虽应用流计算,但未形成可复制的公共卫生解决方案。因此,研发公共卫生领域流计算技术,对贵阳块数据公司突破业务瓶颈、推动贵州公共卫生应急能力升级具有重要意义,也符合国家公共卫生安全战略。
需解决的主要技术难题
1. 流计算平台架构搭建难题:如何基于云原生技术(Kubernetes+Flink)搭建高可用流计算平台,解决现有测试环境 “多源数据接入不稳定、峰值处理易崩溃” 问题,支持医疗就诊、环境监测、交通客流等 10 + 类数据源实时接入,平台可用性≥99.99%,数据处理峰值能力提升至现有 5 倍;2. 多源数据实时融合难题:如何开发基于规则引擎 + AI 的实时数据融合算法,解决医疗文本(非结构化)、环境传感器数据(半结构化)、交通客流数据(结构化)的格式异构问题,实现数据清洗、对齐、关联的端到端延迟≤10 分钟,融合准确率≥95%;3. 公共卫生实时分析模型难题:如何针对疫情预警、慢性病急性发作监测等场景,开发轻量化实时分析模型(如异常检测、趋势预测),解决现有模型 “复杂度过高、推理慢” 问题,模型推理时间≤1 秒,突发公共卫生事件早期识别准确率≥90%
期望实现的主要技术目标
a. 平台性能目标:1 年内搭建云原生流计算平台,支持 15 + 类数据源实时接入,数据处理峰值能力≥10 万条 / 秒,平台可用性≥99.99%,单节点故障恢复时间≤5 分钟;b. 数据融合目标:2 年内完成多源数据实时融合算法研发,端到端处理延迟≤10 分钟,融合准确率≥95%,支持医疗、环境、交通等 8 大领域数据关联分析;c. 分析模型目标:2 年内开发 5 个公共卫生实时分析模型(疫情预警、异常病例识别等),模型推理时间≤1 秒,早期识别准确率≥90%,在贵阳市 30 家社区医院试点应用;d. 应急响应目标:3 年内在贵州省公共卫生事件应急处置中推广,突发公共卫生事件响应时间从小时级缩短至 15 分钟内,早期预警准确率提升 80%,支撑全省 500 家医疗机构数据实时联动;e. 成果转化目标:3 年内形成 “流计算 + 公共卫生决策” 解决方案 1 套,申请发明专利≥7 项,软件著作权≥10 项,推动方案纳入《贵州省公共卫生信息化建设指南》,向西南地区公共卫生机构推广