研究

把一线落地,沉淀成可复现的研究。

检索增强生成、LLM 长期记忆、知识图谱:我们把生产实践形式化为可复现的工作。这里是团队公开的论文、专利与学术服务,链接均指向可核验的原始来源。

论文与专利

预印本 · 综述人机协同2026

When Should the Agent Speak? A Survey of Intervention Timing for Always-On AI Assistants

Tao An

常驻助手(眼镜、MR、环境 copilot)的介入时机综述,围绕一条决策规则组织:当行动的期望收益减去打扰的期望代价超过阈值时才出手。重连两条互不引用的文献:1999–2017 的可打扰性研究把打扰代价形式化到了效用理论的程度,却没有能兑现收益的执行者;2024–2026 的主动智能体浪潮有了执行者,却只以碎片形式重新发现代价项(误报定价、认知负荷、社交违规、算力),无人统一。评估是闸门层:介入质量不可测量之前,主动性的强化学习奖励无从定义。因此提出一个带显式成本项的开放世界介入时机基准设计。

在审 · BlackboxNLP 2026可解释性2026

Registers, Not Plans: What Lives in a Language Model's Workspace That Isn't on Its Tongue

Tao An

在开源模型上独立复现 Anthropic 的「全局工作空间」主张。用模型自身的 next-token 分布过滤 lens 读出,把工作空间劈成两半:可因果操纵的上下文寄存器(对话语言、被纠正的错字)留存,内容计划(押韵、心算)跌到置换基线。编辑一个寄存器还会改写模型对「自己被问了什么」的表征,在 1.7B–14B 尺度阶梯与第二个架构上稳定成立。

在审AI 安全2026

CGEP: Toward Detecting and Attributing GEO Poisoning in Chinese AI Search

Tao An

面向中文生成式搜索(DeepSeek、豆包、Kimi)定义 GEO 投毒的检测与归因问题:五类操纵手法的分类学、从「攻击成功率」到 检测 → 分类 → 账号簇归因 的任务重构,以及一个合法构建的合成基准。溯源试验表明检测与归因需要不同的信号底座:内容特征能检出操纵(F1 0.93)却归因不到卖家簇,账号交互图才能归因(0.96);置信度门控的融合覆盖了单一底座检测器、GNN 与零样本 LLM 都失效的全部手法。

在审 · TMLR人机协同2026

The Preference Centroid: Consensus Density Governs Output Dispersion in Aligned LLMs

Tao An, Shuai Feng

反复采样一个对齐后的 LLM 并对补全做嵌入,输出的离散度(平均两两余弦距离)由任务的「共识密度」决定:事实型 prompt 上近乎为零,开放型 prompt 上很宽(Spearman ρ = 0.85),在第二个模型上复现,并可由只看 prompt 的留出评审预测(ρ = −0.91)。基座 vs 指令模型的对照显示:对齐放大了预训练基座已携带的梯度。

在审 · ARRLLM 记忆2026

It's Fidelity, Not Structure: Verbatim Chunks Beat Lossy Artifact Extraction in Long-Conversation LLM Memory

Tao An

在固定的 检索–重排–推理 管线内做受控消融,隔离「存储的记忆表示」这一变量:LLM 抽取的结构化 artifact vs 原文对话切片。原文切片在 LoCoMo 上领先 15.9 分(43.9% vs 28.0%)、在 LongMemEval-S 上领先 22.0 分。结构化记忆应增强而非替代原文。

HHAI 2026 · IOS Press人机协同2026

AI as Equalizer or Amplifier? Task Complexity as the Moderating Factor for Human Expertise in Hybrid Intelligence Systems

Tao An

发表于第 5 届混合人机智能大会(HHAI 2026,布鲁塞尔)论文集,IOS Press《Frontiers in AI and Applications》第 423 卷,pp. 212–220(开放获取,CC BY-NC)。基于 2024 年中以来的结构化田野观察,调和「AI 是均衡器还是放大器」之争:AI 在常规、结构良好的任务上缩小新手与专家差距,在需要深度判断的复杂任务上放大差距。决定谁最受益的是领域专业度,而非提示工程。

预印本 · arXivLLM 记忆2025

Cognitive Workspace: Active Memory Management for LLMs

Tao An

提出 Cognitive Workspace 范式,超越传统 RAG,模拟人类认知机制:主动记忆管理、分层认知缓冲、任务驱动的上下文优化。记忆复用率 58.6%(RAG 为 0%),净效率提升 17–18%。

专利 · 在审知识图谱2026

A Graph-Neural-Network Method for Data-Information Recommendation

Tao An

中国发明专利,实质审查中。基于 GNN,在异构「数据–信息」图上做推荐。

学术服务

伦理审稿人

NeurIPS 2026· 2026

神经信息处理系统大会(NeurIPS 2026)伦理审查委员会,依据 NeurIPS 伦理准则审查被标记的投稿:数据来源与知情同意、双重用途与滥用风险、涉人研究考量、更广泛的社会影响。

想深入某个研究方向?

无论是产学研合作、技术方案,还是想聊聊某篇工作,都欢迎直接联系。

联系我们