⚡
西安峻曦信息技术有限公司
数智全栈一体化解决方案技术服务商
v1.0
智数工坊 AI Data Weaver
零代码数据工程工作流平台
「 上传 Excel,说话出报表 」
8 大行业场景覆盖
千万级数据秒级处理
自然语言驱动工作流
信创私有化部署
02系统架构
AI Data Engineering Architecture
⑤
应用层
行业模板市场 · 报表大屏 · API服务
④
协作层
Canvas 自然语言编排器 · 节点式工作流
③
智能层
多 Agent 数据工程大脑(探源/清洗/质检/统计/解释)
②
执行层
规则引擎 · AI 沙箱 · SQLite / PostgreSQL / 国产库
①
接入层
文件上传 · 数据库连接 · API 接入 · 云存储
🔒 数据血缘追踪
📋 操作审计日志
✋ 人工确认闸门
🛡️ 信创安全合规
03设计理念
Design Philosophy
01
零门槛
会说话就能洗数据,业务人员无需学习 SQL 或代码
02
实时感
每步操作即时可见数据变化,所见即所得,错了立刻改
03
行业化
预置医院/政府/能源/零售等行业模板,开箱即用
04
可解释
血缘追踪透明可信,点击任意数字即可溯源到原始表
05
混合智能
规则引擎处理简单转换(快+准),AI 处理复杂逻辑(灵+强)
06
信创兼容
支持达梦/人大金仓等国产数据库,私有化部署无忧
04场景应用
Industry Scenarios · 痛点 → 方案 → 效果
🏥
医院运营分析
业务痛点
门诊/住院/药品/医生/科室 5张源表格式混乱,科室编码大小写混用、日期格式3种、费用字段带¥符号,数据清洗占分析工作 70% 时间。
解决方案
上传5张表 → 套用「医院运营模板」→ AI 探源Agent输出质量报告 → 自动清洗关联 → 一键生成 6张经营报表。
应用效果
月度运营报表从 3天缩短至30分钟;药占比、Top5医生、床位周转率自动计算;点击任意数字可溯源到原始处方明细。
🏛️
政府多部门数据汇总
业务痛点
民政、统计、卫健等多部门 Excel 字段命名各异("姓名"vs"人员姓名"vs"当事人"),手工合并易出错,上报 deadline 紧迫。
解决方案
上传各部门表格 → 自然语言描述"统一人员字段,按区县汇总" → AI 自动识别语义关联 → 生成标准上报格式。
应用效果
季度汇总从 5人×3天 降至 1人×2小时;字段匹配准确率 98.5%;工作流保存后每月自动复用,无需重复配置。
⛽
能源设备台账治理
业务痛点
采气厂各作业区设备表格式各异,"设备编号"="资产编码"="机台号",无法直接对接集团 ERP,手工整理耗时长。
解决方案
上传各作业区台账 → AI 探源识别字段语义 → 自动统一编码规则 → 清洗后生成标准设备主数据 → 一键导出 ERP 导入格式。
应用效果
台账统一治理从 2周缩短至半天;设备编码标准化率 100%;支持定时同步,作业区新数据自动归一化入库。
🛒
零售多平台销售对账
业务痛点
天猫/京东/抖音/拼多多 4平台订单字段完全不同("订单金额"vs"实付金额"vs"pay_amt"),SKU 编码不统一,财务对账痛苦。
解决方案
上传4平台订单表 → 自然语言"统一金额字段和SKU编码,按月份汇总GMV" → AI 自动映射字段语义 → 生成统一对账总表。
应用效果
月度对账从 3天手工复制粘贴 → 30分钟自动出表;SKU 匹配准确率 96%;自动识别异常订单(金额差异>5%标红)。
🏭
制造多工厂报表合并
业务痛点
集团5个工厂各用不同 MES 系统,导出格式各异,生产部每月手工合并产量/良率/能耗报表,VLOOKUP 频繁出错。
解决方案
上传各工厂 MES 导出表 → 套用「制造集团模板」→ AI 自动对齐字段 → 合并生成集团级产量/良率/能耗统一看板。
应用效果
集团月报从 5人×2天 降至 1人×1小时;数据错误率下降 70%;支持按工厂/产线/班次多维度下钻分析。
📢
广告投放跨平台ROI
业务痛点
巨量/腾讯/百度/小红书 4平台数据字段、时间粒度完全不同,优化师每天下载4个后台Excel,手工合并算ROI,错一个就是真金白银。
解决方案
上传4平台投放数据 → 自然语言"合并计算各平台ROI,按素材类型分组" → 自动关联后端成交数据 → 生成投放效果总表。
应用效果
日报制作从 2小时/天 → 10分钟自动刷新;素材ROI对比一目了然;异常消耗自动标红预警,止损响应提速10倍。
05建设内容
Core Modules · 6大功能模块
🖥️
智能工作台
业务人员一站式入口,最近项目、快速上传、模板推荐、使用统计,3秒进入工作状态。
- 最近项目卡片式展示,一键继续编辑
- 拖拽上传 CSV/Excel/XLSX,自动识别编码
- 基于历史行为智能推荐行业模板
- 个人/团队使用统计看板
🎨
Canvas 画布
节点式工作流编排器,拖拽连线+自然语言描述,可视化看到数据怎么"流"过每个处理环节。
- 清洗/关联/统计/导出/分支 5类节点
- 节点间连线支持条件分支(if/else)
- 工作流保存为可复用模板
- 支持版本回溯与对比
💬
自然语言引擎
顶部输入框描述需求,AI 自动生成工作流节点并连线,业务人员只需"说话"就能配置数据流水线。
- NL2Pipeline:自然语言生成完整工作流
- NL2Transform:自然语言描述清洗规则
- NL2SQL:自然语言描述统计逻辑
- 意图识别 + 歧义澄清预检
👁️
实时预览区
每步操作后右侧即时展示数据变化(前5行预览+字段统计摘要),所见即所得,错了立刻改。
- 虚拟滚动表格,千万级数据前端不卡
- 字段级统计:空值率/唯一值/分布图
- 前后步骤对比视图(清洗前后对照)
- 异常值自动标红提示
📦
行业模板市场
预置医院/政府/能源/零售/制造/投放等行业模板,一键套用,字段自动匹配,社区模板可上架售卖。
- 官方模板:6大行业 × 20+标准工作流
- 社区模板:用户分享,审核上架
- 智能匹配:上传数据后自动推荐模板
- 模板版本管理与更新通知
📊
报表中心
工作流输出结果自动对接可视化,支持定时调度、分享链接、导出多格式、对接 BI 大屏。
- 导出 CSV / Excel / HTML 可视化报表
- 定时调度:每日/每周自动执行工作流
- 分享链接:加密分享,权限可控
- API 输出:对接 ECharts / 帆软 / Tableau
06实施路线
Implementation Roadmap · 三期递进
PHASE 01
MVP 基础版
2-3 个月
• 单文件处理(≤100万行)
• 4大行业模板(医院/政府/能源/教育)
• 基础工作流:清洗→关联→统计→导出
• SQLite 本地执行引擎
• 自然语言生成工作流(NL2Pipeline)
PHASE 02
增强版
3-4 个月
• 多数据库接入(MySQL/PG/国产库)
• 模板市场上线 + 社区分享
• 数据血缘追踪可视化图谱
• 定时调度引擎(Cron表达式)
• 团队协作空间 + 权限管理
PHASE 03
领先版
4-6 个月
• 多 Agent 协作调度(5 Agent并行)
• 信创全适配(达梦/人大金仓/麒麟OS)
• 企业级审计日志 + SSO单点登录
• API 开放平台 + Webhook 推送
• 私有化部署 + 容器化交付
07成果预期
Expected Outcomes · 量化价值