AI / 智能体 / 软件系统
项目
当前的 AI 系统作品集,分为三组:Agent Infrastructure、Science AI 和 Operations AI。公开仓库附有链接;私有系统以系统概览形式描述,不放仓库链接。
在找我更早的电池材料科学工作? 研究档案 →
01 — Case Studies
2 Case Studies
两个我端到端负责的系统 —— 一个企业级交付,一个独立构建。
● 企业级 · 工作案例
Academy-Wide Virtual Assistant
面向约 3.8 万会员协会的 member-facing agentic 助手
一个基于 MCP 工具、以企业 CRM 实时数据为依据的 agent:从权威记录回答会员问题,答不了时自动创建服务工单。我负责 MCP 工具层、读写数据链路(直连库读、受管 REST 写),以及多环境 Azure 部署 —— Container Apps、Key Vault、托管身份、单静态出口 IP、SSO。
● 独立构建 · 日常在用
“Second Brain” — Local-First Personal AI
把工作流编译成知识的本地优先个人 AI
本地 RAG(ChromaDB + sentence-transformers,Flask 后端)、实时会议助手(流式 Whisper + 截图 vision/OCR + 自动综述),以及自我编译、与 Obsidian 同步的知识 wiki —— 全部本地运行。包含定位一个原生库并发段错误,以及把 LLM 调用改走 CLI 订阅以消除按量 API 成本。
02 — Agent Infrastructure
3 Agent Infrastructure
有据可查的智能体、检索,以及围绕它们的评估支架。
● 公开仓库
Scientific Agent Lab
科学 AI 的评估与可复现层
不是科学助手,而是它下面那一层 —— 回答“结果什么时候能信”的骨架。一个确定性、零依赖的管道:把证据和假设分开、把不确定性摆明、标出缺失的必需数据、证据不全时拒绝接受(判“再测”),并交出一份逐字节可复现、可被评估 harness 打分的轨迹。全程无 LLM。
查看仓库 ↗
● 在线 · 角标助手 Loopi — SciencesLoop site agent
带署名护栏的站内检索助手
常驻每个页面角落的检索增强助手:从公开语料回答关于我公开工作的问题,尽量给出引用,并拒绝把他人的工作错误归属。基于 Node RAG/LLM API。
打开 Loopi ↗
● 公开仓库 Realtime Synthetic Call Center
用于压测智能体的实时语音仿真
一个实时语音仿真环境,用于压测对话式智能体 —— 合成来电者、感知延迟的轮流对话,以及评估挂钩。
在 GitHub 查看 ↗
03 — Science AI
11 Science AI
面向科学工作的基础模型与领域智能体。
● 在线 Demo
ChemGraph Loop
一个可以现场跑的真实 agentic 化学工作流
用大白话问一个小分子问题,看真实 ChemGraph agent 识别分子、跑仿真、画 3D 结构,并对照工作流护栏审计结果。
试用 Demo ↗
● 在线 Demo 设备状态监测智能体
一个可以现场跑的确定性预测维护管道
在 NASA 公开涡扇发动机数据上跑 10 阶段剩余寿命分析,带人工决策把关、带证据的决策卡和带引用的诊断。
试用 Demo ↗
● 在线 Demo 预防健康模型实验室
一个能从头看到尾的 QLoRA 微调研究
在同一个预防健康任务、同一批合成数据和同一评估 harness 上,对比 Gemma 3 与 MedGemma 的受控 QLoRA 研究。
试用 Demo ↗
● 在线 Demo MIST 迁移学习 Benchmark
比较结构机器学习与微调分子基础模型
输入 SMILES,同时比较固定 Ridge、XGBoost、MLP 和 fine-tuned MIST-28M 对 QM9 DFT 性质标签的预测。
试用 Demo ↗
● 在线 Demo 液流电池氧化还原电位预测器
在预测前先确认分子身份的公开氧化还原电位 Demo
输入 SMILES 或化学名称,先检查 PubChem 支持的名称选项与可编辑 RDKit 结构,确认后才由固定 Random Forest 在 RedDB DFT 尺度上预测。
试用 Demo ↗
● 在线 Demo 分子发现工作流
解析身份、检查结构,再明确展示证据缺口
一个私有分子发现原型的公开受限版本:PubChem 身份解析、人工结构确认、RDKit 描述符,以及明确的证据缺口,而不是编造性质数值。
试用 Demo ↗
● 在线 Demo 指南忠实度聊天
如实复述临床指南立场,并保住每一份的官方推荐力度
问一个膝关节炎的问题,答案如实复述 NICE NG226 和 ACR/AF 怎么说,并回读原文让推荐力度保持忠实,而不是糊成一句笃定的话。指南忠实度的研究 demo——非医疗建议。
试用 Demo ↗
● 公开仓库 Scientific Discovery Flight Simulator
在同一模拟科研 campaign 中比较实验选择策略
一个离线、确定性的 benchmark:在同一个合成循环伏安 world、预算、约束、噪声和注入式仪器故障下,比较 random、fixed-grid 和 expected-information-gain 策略。它把 proposal、validation decision、observation、QC flag、cost、belief update 和 stopping decision 写入可审计 ledger。所有证据均来自模拟,不代表真实实验室或经过验证的 digital twin。
查看仓库 ↗
● 公开仓库 Scientific Foundation Model Lab
训练与理解科学基础模型
一个动手的实验室,用于训练和理解科学基础模型 —— 表示学习、性质预测,以及模型素养工具。
在 GitHub 查看 ↗
● 私有系统概览
SciFM Registry
哪些科学基础模型真正可用
一个登记表,追踪哪些科学基础模型在实践中真正可用,并配有可复现的可用性检查。
● 私有系统概览
RFB Formulation Agent
面向液流电池配方的结构化知识支持
一个垂直领域智能体,通过结构化检索、推理和验证,帮助组织液流电池配方知识。
04 — Operations AI
2 Operations AI
面向真实世界、高上下文运营的安全门控智能体。
● 私有系统概览
Property OS — Voice/SMS Operations Agent
可打断的实时语音与短信运营智能体
面向物业运营的可打断实时语音与短信助手:自然语音交互、安全门控的 LLM 层、只读运营控制台,以及运营记录与财务台账之间明确的数据治理边界。
● 私有系统概览
Insurance FNOL Agent
面向 first-notice-of-loss 流程的安全受理
一个以产品视角构建的受理智能体,面向 first-notice-of-loss 流程:结构化采集、路由,以及对理赔受理的安全处理。