工作周报(06-01-2026 ~ 06-05-2026)
一、本周定位
本周接上周阶段一(把 Medtronic Inceptiv 做透)的收尾。实际跑下来,专利检索和 PDF→MD 两条线都改了路子:前者从”用智慧芽 AI 检索”换成”检索式矩阵 + 人工分仓”,后者从”转换收尾” 变成 “转换引擎要重做”。另外多了一件计划外的工具,本地语音转文字,已经在日常用了。
二、本周进展
1. 钽屏蔽物理论证(P0,完成)
Inceptiv 钽屏蔽 DR 三阶段(机制辨析 → 材料权衡 → 证据反证),落三份文档:
- Prompt-1 屏蔽/去耦/失谐机制辨析
- Prompt-2 候选材料多轴对比
- Prompt-3 证据与反证
结论:钽是多目标折中下的可接受工程解,不是任何单一物理判据上的最优解。选它由生物相容、显影、机械和既有专利/产线复用一起决定。行业也没趋同——BSC 走 billabong 反向绕组,Abbott/Nevro 靠失谐和扫描条件,说明钽屏蔽是 Medtronic 的路径依赖,不是全行业物理最优。
3. 专利检索改走检索式(P1,计划变更)
实测智慧芽自带 AI 检索可信度极差,70% 以上结果有误,所以弃用,改纯检索式全量检索:
- 建广义全行业专利检索关键词矩阵,三轴=MR 危害(ISO/TS 10974 Clause)× 公司(受让人)× 产品类型,中英双语,覆盖神经调控、人工耳蜗、WPT、心脏 CIED,含国产厂商。
- 分工:按 MR 危害分建工作空间,筛选交王建文执行;我对各工作空间涉及的专利写脚本批量抓取。
4. PDF→MD 转换引擎(P0,受阻重做)
美国专利双栏 PDF 转得不对:双栏交错、行号混进正文,现成开源工具需要自定义优化。本周:
- 采用 PyMuPDF 引擎为底座, 文字层按坐标分栏重排 + 剔中央行号 + 按几何间隙裁标。
- 美国专利还有 bug(claims 续页误判、跨页段落断裂、标题识别),所以现在的专利文本有偏差,正在补自定义规则修。
5. 本地语音转文字
搭了一套本地、隐私保护的语音转文字,用 fun-asr-nano,支持热词,AIMD 专有名词识别准。一是语音不出本地,二是说话比打字更快地把指令传出去。已经在日常工作里用上了。
三、下周计划
| 优先级 | 任务 | 产出 |
|---|---|---|
| P0 | 美国专利 PDF→MD 引擎修复收尾(claims 续页、跨页段落、标题识别) | 专利文本无偏差 |
| P0/P1 | 检索式全量抓取:王建文按 MR 危害分仓筛选,我写批量抓取脚本 | 按危害分仓的专利清单(含法律状态) |
| P1 | 专利资料齐后做批量摘要试点 | 摘要模板 + 试点验证 |
| P1 | 可分享、可访问的知识库设计(参考 Apple Developer / Claude Docs) | 知识库形态方案 |
专利资料是前置,齐了才能往下做批量摘要和知识库。