Skip to content

情报源明细表 ​

本页是数字研究员正式 Watchlist 的可读投影。唯一事实源仍是 research/intelligence/REGISTRY.json;本页直接读取 Registry,不维护第二份名单。

人物是研究主体;仓库、论文、协议与官方入口是证据和观测来源。 人物数量与正式来源对象数量分别统计,不把二者简单相加。

分类统计 ​

47核心研究人物
56正式来源对象
24P0 每日
26P1 每周
6P2 专项
分类对象数P0 每日P1 每周P2 专项说明
AI 平台660045 个正式入口
GitHub 工程仓库359206核心工程、审计评测、工作实践与异常检测
论文与研究成果15960论文、研究机构、Artifact 与研究聚合索引

核心研究人物 · 47 ​

Chi Wang

S+

多智能体框架作者 / 研究者

多 Agent 拓扑协作协议长运行 Harness
关联仓库

Qingyun Wu

S+

高校学者 / Multi-Agent / 框架作者

多 Agent 编排Agent Network评测
关联仓库

Charles Packer

S+

Agent Memory / Stateful Runtime / 创业者

持久身份长期记忆状态化 Runtime
关联仓库

Sarah Wooders

S+

Agent Memory / Stateful Runtime / 研究工程

记忆系统持久 Agent运行时状态
关联仓库

Dawn Song

A+

AI Safety & Security 学者

Agent 安全可信 AI去中心化 AI
论文 / 协议 / 项目

Swyx / Shawn Wang

A+

AI Engineer 生态 / 研究媒体

Agent 工程开发者生态行业综合
论文 / 协议 / 项目

Tommaso Moro

A+

Agent / MCP 工程 / GitHub

GitHub MCPAgent Skills开发工作流
论文 / 协议 / 项目

Valerie Chen

S

学术研究者 / Human-Agent Collaboration / Verification

人机协作验证评测
论文 / 协议 / 项目

Xuhui Zhou

S

学术研究者 / Social & Safe Agents

Social AgentsAgent 安全评测
论文 / 协议 / 项目

Aaron Parecki

A+

身份协议专家 / OAuth / MCP Auth

OAuthMCP Authorization身份
论文 / 协议 / 项目

Shreya Shankar

A+

数据系统 / AI Evals / 学术研究

AI 评测数据系统可靠管线
论文 / 协议 / 项目

Hamel Husain

A+

工程实践者 / AI Evals / 可靠性

EvalsAgent 可靠性工程实践
论文 / 协议 / 项目

Wilson Lin

S+

Cursor / Long-running & Multi-Agent Runtime

Agent Swarms长程 AgentScaling Agents
论文 / 协议 / 项目

David Gomes

S

Cursor / Agent Autonomy & Auto-review

Auto-reviewAgent AutonomyCoding Workflow
论文 / 协议 / 项目

Travis McPeak

S

Cursor / Agent Security & Governance

Agent 安全Hooks治理
论文 / 协议 / 项目

Ani Betts

S

Cursor / Agent Sandbox & MCP

SandboxMCPDesktop Runtime
论文 / 协议 / 项目

Josh Ma

S

Cursor / Cloud Agent Runtime

Cloud AgentsAutomations长程执行
论文 / 协议 / 项目

Aman Sanger

A+

Cursor 创始人 / Agent 产品与架构

Agent 产品Cloud CodingRuntime 架构
论文 / 协议 / 项目

AI 平台 · P0 每日 ​

OpenAI

ChatGPT · Codex · OpenAI API · Agents

ChatGPT、Codex、API 与 Agent 产品更新、开发文档、企业控制和运行状态

P0每日11 个公开正式入口
官方通告Announcements ↗仅官方团队可形成平台事实
查看 5 个精准板块

精准板块只产生研究线索,需复现或官方确认后才能形成平台事实。

查看 5 个文档、GitHub 与状态入口

Google

Gemini · Gemini API · AI Studio · Vertex AI · Gemini CLI · ADK

Gemini、AI Studio、Vertex AI、Gemini CLI 与 ADK 的产品和工程变化

P0每日9 个公开正式入口
官方通告Announcement 标签 ↗必须核验官方员工身份
查看 3 个精准板块

精准板块只产生研究线索,需复现或官方确认后才能形成平台事实。

查看 5 个文档、GitHub 与状态入口

Anysphere

Cursor · Cursor Agents · Cloud Agents · Cursor CLI

AI 编程 Agent、Cloud Agents、CLI、开发工作流与产品变化

P0每日8 个公开正式入口
官方通告Announcements ↗仅官方团队可形成平台事实
查看 4 个精准板块

精准板块只产生研究线索,需复现或官方确认后才能形成平台事实。

查看 3 个文档、GitHub 与状态入口

GitHub

GitHub Copilot · Coding Agent · Copilot CLI · Code Review

Copilot Coding Agent、CLI、Code Review 与 GitHub 原生 Agent 能力

P0每日6 个公开正式入口
官方通告Copilot News and Announcements ↗仅官方团队可形成平台事实
查看 1 个精准板块

精准板块只产生研究线索,需复现或官方确认后才能形成平台事实。

查看 4 个文档、GitHub 与状态入口

Microsoft

Microsoft 365 Copilot · Copilot Studio · Agent Builder · Power Platform

Microsoft 365 Copilot、Copilot Studio、Agent Builder 与企业 Agent 平台

P0每日6 个公开正式入口
官方通告Copilot Studio Blog ↗仅官方团队可形成平台事实
查看 1 个精准板块

精准板块只产生研究线索,需复现或官方确认后才能形成平台事实。

查看 4 个文档、GitHub 与状态入口

GitHub 工程 Watchlist ​

openai/codex

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · digital-employee
P0每日
访问 GitHub ↗

openai/openai-agents-python

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · digital-employee · industry-architecture
P0每日
访问 GitHub ↗

anthropics/claude-code

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · digital-employee · industry-architecture
P0每日
访问 GitHub ↗

google-gemini/gemini-cli

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · digital-employee
P0每日
访问 GitHub ↗

google/adk-python

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · industry-architecture · digital-employee
P0每日
访问 GitHub ↗

github/copilot-cli

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · digital-employee
P0每日
访问 GitHub ↗

modelcontextprotocol/python-sdk

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · industry-architecture
P0每日
访问 GitHub ↗

modelcontextprotocol/typescript-sdk

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · industry-architecture
P0每日
访问 GitHub ↗

a2aproject/A2A

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · industry-architecture
P0每日
访问 GitHub ↗

microsoft/autogen

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · digital-employee
P1每周
访问 GitHub ↗

microsoft/semantic-kernel

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · industry-architecture
P1每周
访问 GitHub ↗

langchain-ai/langgraph

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · digital-employee
P1每周
访问 GitHub ↗

crewAIInc/crewAI

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · digital-employee
P1每周
访问 GitHub ↗

OpenHands/OpenHands

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · digital-employee
P1每周
访问 GitHub ↗

browser-use/browser-use

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:digital-employee · open-source-engineering
P1每周
访问 GitHub ↗

SWE-bench/SWE-bench

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · digital-employee
P1每周
访问 GitHub ↗

SWE-agent/SWE-agent

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · digital-employee
P1每周
访问 GitHub ↗

multi-agent-systems-failure-taxonomy/MAST

多智能体失败分类与轨迹数据

服务栏目:open-source-engineering · digital-employee
P1每周多智能体失败分类与轨迹数据
观察重点与专题触发条件失败分类 · 标注轨迹 · 任务验证失败 · Agent 间失配 · 评测管线

出现分类修订、新标注轨迹、Benchmark 或评测器变化,或可用于检验 TMPA 证据重建与 CodeFlowMu 验证机制的可复现结果。

访问 GitHub ↗

langfuse/langfuse

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · industry-architecture
P1每周
访问 GitHub ↗

Arize-ai/phoenix

Agent Runtime、协议、SDK、工具、恢复、评估、可观测性及工程实现变化。

服务栏目:open-source-engineering · industry-architecture
P1每周
访问 GitHub ↗

yzhao062/auditable

可审计 Agent 运行与恢复

服务栏目:digital-employee · open-source-engineering · industry-architecture
P1每周可审计 Agent 运行与恢复
观察重点与专题触发条件Adapter · 决策记录格式 · 重放 · 回滚

出现具备可复现证据的新 Adapter、重放/回滚机制或决策记录 Schema。

访问 GitHub ↗

yzhao062/grade

失败归因与运行图评测

服务栏目:open-source-engineering · digital-employee
P1每周失败归因与运行图评测
观察重点与专题触发条件数据集 · 图表示 · 失败定位 · 跨语料迁移

出现新的数据集、图表示、失败定位结果或跨语料迁移结果。

访问 GitHub ↗

yzhao062/catchbench

Agent 全生命周期审计 Benchmark

服务栏目:open-source-engineering · digital-employee
P1每周Agent 全生命周期审计 Benchmark
观察重点与专题触发条件PRE / LIVE / POST 评测板 · 数据集与固定版本 · 失败定位与检测 · 评测方法 · 已知局限与独立复现

论文正式发布、评测板或数据集发生实质变化、已知 Artifact 局限得到解决,或出现可用于 TMPA 证据重建与 CodeFlowMu 验证的独立可复现结果。

访问 GitHub ↗

yzhao062/anywhere-agents

Agent 工作配置与安全实践

服务栏目:digital-employee · open-source-engineering
P1每周Agent 工作配置与安全实践
观察重点与专题触发条件Codex 与 Claude 配置 · Skill 路由 · 双 Agent Review · 安全钩子

出现可复用于 FCoP 或 CodeFlowMu 的配置治理或多 Agent Review 机制。

访问 GitHub ↗

HeadyZhang/agent-audit

Agent 部署前安全审计

服务栏目:open-source-engineering · digital-employee
P2每两周或版本触发Agent 部署前安全审计
观察重点与专题触发条件MCP 配置扫描 · 提示注入 · 污点传播 · 过度权限

版本新增可复现、可用于部署门禁的扫描器、规则集或风险模型。

访问 GitHub ↗

Justin0504/Aegis

Agent 运行时策略执行

服务栏目:digital-employee · open-source-engineering · industry-architecture
P2每两周或版本触发Agent 运行时策略执行
观察重点与专题触发条件工具执行前策略检查 · 人工审批 · 加密审计轨迹 · 运行时强制执行

版本对工具调用约束、审批或审计轨迹证据作出实质变化。

访问 GitHub ↗

yzhao062/agent-style

Agent 技术写作质量

服务栏目:digital-employee · open-source-engineering
P2每两周或版本触发Agent 技术写作质量
观察重点与专题触发条件写作规则 · 引用纪律 · 自动检查

出现可与 JoinWell52 编辑评分体系对照的规则或检查器。

访问 GitHub ↗

yzhao062/cs-paper-checklist

研究论文发布质量

服务栏目:open-source-engineering · digital-employee
P2每两周或版本触发研究论文发布质量
观察重点与专题触发条件论文完整性 · 方法报告 · 评估报告 · 投稿检查

清单变化能够在不降低证据要求的前提下强化 TMPA 发布门禁。

访问 GitHub ↗

yzhao062/pyod

异常检测方法与工具

服务栏目:open-source-engineering
P2每月异常检测方法与工具
观察重点与专题触发条件新检测器 · 评估变化 · 行为异常应用

出现可直接用于 Agent 运行时异常信号的方法或评估变化。

访问 GitHub ↗

yzhao062/anomaly-detection-resources

异常检测研究聚合

服务栏目:open-source-engineering · digital-employee
P2每月异常检测研究聚合
观察重点与专题触发条件新综述 · Benchmark · 工具集合 · Agent 行为异常研究

出现将异常检测与 Agent 行为或运行时治理实质关联的新资源群。

访问 GitHub ↗

Kyvvu/manifests

运行路径策略

服务栏目:open-source-engineering · digital-employee · industry-architecture
P1每周运行路径策略
观察重点与专题触发条件路径依赖策略 · 动作前决策 · 策略测试 · 策略格式

访问 GitHub ↗

schroederdewitt/perfectly-secure-steganography

隐蔽通信与可观测性边界

服务栏目:open-source-engineering · digital-employee · industry-architecture
P1每周隐蔽通信与可观测性边界
观察重点与专题触发条件最小熵耦合 · 隐写通信评测 · 可观测性边界

访问 GitHub ↗

mansura-habiba/bulbasaur-skill-cli

Agent 技能审计

服务栏目:open-source-engineering · digital-employee · industry-architecture
P1每周Agent 技能审计
观察重点与专题触发条件技能契约 · 信任审计 · 隔离与审阅 · 评测 · 依赖锁定

访问 GitHub ↗

ag2ai/Agents_Failure_Attribution

Agent 失败归因

服务栏目:open-source-engineering · digital-employee · industry-architecture
P1每周Agent 失败归因
观察重点与专题触发条件Who and When 数据集 · 失败归因 · 关键步骤 · 评测脚本

访问 GitHub ↗

haoyuwang99/AgentSpec

Agent 运行时约束

服务栏目:open-source-engineering · digital-employee · industry-architecture
P1每周Agent 运行时约束
观察重点与专题触发条件策略 DSL · 触发与判定 · 约束动作 · 评测与回归

访问 GitHub ↗

论文与研究成果 ​

arXiv

学术预印本平台;重点关注 cs.MA、cs.SE、cs.AI

cs.MA · cs.SE · cs.AI
P0每日
访问来源 ↗

Autonomous Agents and Multi-Agent Systems

《自主智能体与多智能体系统》期刊;关注 Agent 组织、协调、协议与治理

multi-agent systems · agent organization · coordination · protocol · governance
P0每日
访问来源 ↗

Journal of Systems and Software

《系统与软件》期刊;关注软件架构、工程实现、实证评估与可复现性

software architecture · software engineering · empirical evaluation · reproducibility · agent engineering
P0每日
访问来源 ↗

Zenodo

开放科研成果存档平台;关注软件、数据集、Artifact 与复现证据

multi-agent · agent runtime · orchestration · software artifact · reproducibility
P0每日
访问来源 ↗

OpenReview

开放同行评审平台;关注论文与公开评审

conference-paper · review
P0每日
访问来源 ↗

OpenAI Research

OpenAI 官方研究

official-research · system-card · technical-report
P0每日
访问来源 ↗

Anthropic Research

Anthropic 官方研究

official-research · system-card · technical-report
P0每日
访问来源 ↗

Google DeepMind Research

Google DeepMind 官方研究

official-research · technical-report
P0每日
访问来源 ↗

Microsoft Research

微软研究院;关注 Agent、企业 AI、软件工程、系统架构与 Benchmark

official-research · technical-report · benchmark
P0每日
访问来源 ↗

ACL Anthology

ACL 论文库;NLP、Agent 与语言技术

conference-paper · journal-paper
P1每周
访问来源 ↗

ACM Digital Library

ACM 数字图书馆

conference-paper · journal-paper
P1每周
访问来源 ↗

IEEE Xplore

IEEE 论文与标准

conference-paper · journal-paper · standard
P1每周
访问来源 ↗

Awesome Auditable AI

可审计 AI 的论文、数据集、基准、标准与工具聚合索引;仅用于发现线索,采用前必须回到一手来源核验。

agent auditability · agent reliability · failure attribution · runtime monitoring · decision records · standards and governance
P1每周二级导航源

证据规则:任何有价值的条目在作为证据前,都必须回到原始论文、官方仓库、数据集、Benchmark 或标准核验。

专题研究触发条件出现重大分类变化、新标准、高价值论文群,或与 TMPA、FCoP、CodeFlowMu 直接相关的新机制。
访问来源 ↗

说明 ​

  • P0 / 每日:Discovery 每日正式检查的核心来源。
  • P1 / 每周:扩大覆盖面的高价值来源。
  • P2 / 专项:每两周、按版本或每月查看;Registry 同时记录观察重点与专项触发条件。
  • 研究聚合索引只负责发现线索,不能替代原始论文、官方仓库、数据集、Benchmark 或标准文件。
  • 今日实际扫描结果记录在当天 Intelligence Run;新增或删除来源只修改 Registry,本页随构建自动更新。

Last updated: