文章
文章
论文导读与实践笔记,来自我们正在做的研究与产品。
精选
📰
论文导读
2026年7月18日
AI 是均衡器还是放大器?分水岭在任务复杂度
HHAI 2026 论文导读:AI 在常规任务上缩小新手与专家的差距,在复杂任务上反而放大差距。决定谁最受益的是领域专业度,不是提示工程。
阅读更多
专家访谈
2026年1月30日
AI的真相:一场没有炒作的专家访谈
前段时间,我接受了来自Capital Numbers项目经理Sanjay Singhania的书面采访,围绕AI在2026年的实际应用展开了深入讨论。
阅读更多更多文章
论文导读
2026年7月18日
超越 RAG:给大模型一个会主动管理的工作记忆
arXiv 预印本导读:Cognitive Workspace 用主动记忆管理与分层认知缓冲替代「检索完即忘」,记忆复用率 58.6%,净效率提升 17–18%。附一年后的自我修正。
阅读更多论文导读
2026年7月18日
常驻 AI 助手什么时候该开口?
综述导读(TMLR 在审):1999 年的可打扰性研究把打扰代价形式化到了效用理论的程度,2024 年后的主动智能体却把这一项整个丢了。综述把两条线接回同一条决策规则。
阅读更多论文导读
2026年7月18日
大模型的工作空间里住着什么:寄存器,不是计划
论文导读(BlackboxNLP 在审):在开源模型上独立复现「全局工作空间」主张。用模型自己的下一词分布过滤后,可因果操纵的只剩上下文寄存器,内容计划跌到置换基线。
阅读更多论文导读
2026年7月18日
同一个问题问十次,答案有多散?共识密度说了算
论文导读(TMLR 在审):对齐模型的输出离散度由任务共识密度决定。只看 prompt、不看输出的评审就能预测离散度(ρ = −0.91),对齐放大了基座已有的梯度而非创造它。
阅读更多论文导读
2026年7月18日
长对话记忆:原文切片赢了结构化提取
论文导读(ARR 在审):固定管线内的受控消融显示,直接存原文对话切片比 LLM 提取的结构化记忆在 LoCoMo 上高 15.9 分,在 LongMemEval-S 上高 22.0 分,连每条正确答案的成本也更低。
阅读更多论文导读
2026年7月18日
中文 AI 搜索的内容投毒:检测到了,不等于知道是谁干的
论文导读(在审):面向 DeepSeek、豆包、Kimi 的 GEO 投毒检测与归因。内容特征能检出操纵(F1 0.93)却归因不到人,账号交互图反过来(0.96),两者必须分开建模。
阅读更多订阅更新
获取最新的技术文章、行业洞察和产品更新。
我们尊重您的隐私,绝不发送垃圾邮件。