字段设置(勾选要显示的列)
导出仍保留全部字段;此处仅影响列表展示。
已选 0 条
ℹ️ 「采集频率」为管理配置,用于登记厂商采集计划(默认每周)。
当前系统数据通过手动上传 / 批量导入入库,尚无自动爬虫驱动采集——该配置将在自动采集启用后生效。
| 编号 | 厂商名称 | 采集频率 | 芯片数量 | 管线状态 |
| 加载中... |
ℹ️ 厂商列表与芯片数量取自 chip_data 实际库存,已归一化合并同名厂商(带括号变体/子品牌)并过滤无效规格串。
合规底线:爬虫只抓下方「列表页 URL」单个页面、尊重 robots.txt、限速 ≥3s/页、可识别 UA、不绕验证码/登录墙(命中即跳过)。
落库为 pending_second_review(先进数据复核),人工通过后才前台可见。UA:加载中…
| 厂商 | 标签 | 芯片类型 | 列表页 |
robots | 启用 | 上次 | 操作 |
| 加载中… |
暂无上传结果
| 时间 | 文件 | 厂商 | 芯片类型 | 上传人 | 状态 | 解析/有效/错误 | PG 新增/更新/失败 | 操作 |
| 暂无记录 |
ℹ️ 当前类型为 chip_data 数据:已支持「字段映射」+「重新触发归一化」+「逐行比对」+「AI 映射」(在 AI 映射对话里用自然语言描述映射,预览确认后自动写入 chip_data 并记字段映射审计)。
🤖 AI 映射对话
👋 描述你的数据映射需求,我会自动解析并执行。例如:
"对于微控制器意法半导体公司,将预算报价(不含税)(CNY): 10K @ CNY31.37 的数据映射到 Price (usd$) 表头下,并进行 RMB 到 USD 的换算(1 : 6.7)"
原始数据展示
💡 在上方「全部文件」下拉中选择一个上传文件,即可查看该文件在 MongoDB 中的原始解析数据(LLM 映射前,原始 Excel 列头→值),用于核对导入是否完整。可与上方「清洗后数据」对照。
🔄 数据管线管理
💡 按芯片类型或原始 Excel 文件名查询 MongoDB 中的原始解析数据(LLM 映射前),用于核对导入是否完整。
| 原始 Excel 文件名 |
芯片类型 |
厂商 |
状态 |
解析/有效/无效 |
上传时间 |
操作 |
| 选择类型或输入文件名后点击查询 |
PostgreSQL 清洗后落库行(chip_data / MCU / 传感器 / FPGA 自动识别)· 含全部审核状态(含驳回);「✎核对」视图按成功入库口径排除驳回行
Mongo 原始 ↔ PG 清洗,按 part_no 对齐
| # |
part_no |
来源 |
Mongo 厂商 |
Mongo 状态 |
PG 审核状态 |
核对结果 |
💡 管理者可新建 / 编辑 / 删除活动;审核人仅可查看。改动即时生效到前台「活动」页。
| # | 英文字段 | 缩写 | 中文名称 | 专业释义 | 数据类型 | 校验规则 | 备注 | 分组 | 操作 |
| 加载中… |
AI 建议(dry-run,未落库)
勾选要应用的字段规则 → 点「应用勾选」落库。黄色行将覆盖已有「手编」规则,请留意。
💡 这里展示每个芯片类型的「标准字段定义」,数据来源于《芯片信息知识库系统》标准定义表。可在上方按芯片类型切换,或用关键词搜索字段。
💡 AI 参考芯片基础信息定义,为每个型号生成结构化「相似匹配画像」(匹配字段/算子/容差/权重/分层),驱动「相似芯片」推荐,替代写死规则。无规则的 MCU/传感器型号自动回退原算法。
🧠 RAG 向量知识库(PDF → MinerU → 切片 → 嵌入 → 检索 → 问答)
就绪状态加载中…
先「试点预览」验证链路(不写库,建议 limit=20);确认后「入库」。每篇 PDF 经 MinerU 解析(CPU 30-120s/篇),大批量耗时较长;幂等(同文件不重嵌,可中断续跑)。
💡 收录各品牌芯片型号命名规则(前缀/参数段/温度封装后缀拆解)。可在上方按品牌或关键词检索全文,点「查看」在线阅读,或下载原文件。
| 用户名 | 企业/机构 | 角色 | 注册时间 | 状态 | 操作 |
| 加载中... |
💡 用户注册后即可浏览全部信息,无需审核。管理者可对异常账户执行冻结操作。
| 角色 | 检索功能 | 语义检索 | 导出功能 | 数据审核 | 采集管理 | 用户管理 |
| 管理者 | ✓ | ✓ | ✓ | ✓ | ✓ | ✓ |
| 审核人 | ✓ | ✓ | ✓ | ✓ | ✗ | ✗ |
| 注册用户 | ✓ | ✓ | ✗ | ✗ | ✗ | ✗ |
| 非注册用户 | 有限 | 有限 | ✗ | ✗ | ✗ | ✗ |
💡 数据导出功能仅限管理者、审核人等内部角色使用。注册用户和非注册用户无论是否注册均不可使用导出功能。
🔍 数据健康检测
同 part_no 多 mfr 根名(括号分裂)/ 同 part_no 跨 chip_type(张冠李戴)。各展示前 100 条。
跨 chip_type 漂移 -
点击「刷新」加载…
🩺 质量检测(扫已有数据)
按上方 chip_type(留空=全部有规则类型)扫描 chip_data,列出违反规则的器件。每条可「修正」一键跳转批量字段修正。
点击「扫描」加载…
🎯 问题清单与一键解决
汇总全库可检测问题。⚡ 一键解决=带快照可回滚的批量自动修复(先预览再执行);去处理 →=跳转对应工具人工审核;ℹ 信息项=不可自动修(如血缘断链/配额受限)。
加载中…
🏆 各类型质量评分(升序,低分优先关注)
加载中…
🧰 治理工具入口
🧩 按芯片类型统计
Mongo 侧混合上传类型为空 → 归「(未分类/混合上传)」
加载中…
📁 上传文件落差明细
加载中…
加载中…
🔍 疑似误分类扫描
规则 -
规则库 = 种子(高置信度) + 自动派生(料号前缀多数派)。只读扫描,不改动数据。
📋 疑似误分列表
点击「扫描」加载…
② 流向矩阵(按 upload_id 聚合,Mongo vs PG)
🏃 治理操作历史(run)
误分类修正 / 漂移解决 / 批量改字段 / 回填 等 run 的统一视图,带回滚入口。
点击「刷新」加载…
🔍 重复扫描
同表重复 = 真 duplicate 行(合并);跨类型同料号 = 漂移(去「批量解决漂移」处理)。
🔀 跨 chip_type 同料号(一览)
点击「扫描」加载…
📋 已配置规则
规则按 priority 升序匹配,命中第一个 alias 即生效。
点击「刷新」加载…