ALL HERE INDUSTRY INSIGHTS
行业咨询
来自一手发布、开源社区与论文平台的前沿动态。
Agent 记忆评测翻车了:三周最好的方案,九周几乎垫底
一个工具如何揭开了 Agent 长期记忆的“伪靠谱”面纱 AI Agent 最令人头疼的问题之一不是推理,而是 记忆 ——那种能记住用户上个月提过的需求、三个月前配置偏好、甚至哪些
发布日期:
阅读全文 →企业AI Agent的权限漏洞,这篇ICML论文给出了工程解法
动态权限收缩:企业AIagent的安全新范式 近年来,随着AI Agent在企业场景中的广泛应用,权限安全问题日益凸显。Agent在运行过程中往往持有一整套工具凭证,但许多任务并不
发布日期:
阅读全文 →Anthropic发布Claude Opus 5:性能逼近Fable 5,成本减半
Anthropic 正式发布 Claude Opus 5:性能刷新纪录,成本减半的“日常默认”模型 2026年7月24日,Anthropic 正式推出了备受瞩目的 Claude O
发布日期:
阅读全文 →超越“存储与检索”:Agentic Context Management 如何重塑 Agent 的生存法则
超越“存储与检索”:Agentic Context Management 如何重塑 Agent 的生存法则 在 AI Agent 从实验室原型走向生产环境的进程中,一个被长期忽视的
发布日期:
阅读全文 →AREX:实现递归自我改进的深度研究智能体
AREX:实现递归自我改进的深度研究智能体 核心事件 :2026年7月23日,Shuqi Lu 等24位作者向 arXiv 提交了题为《AREX: Towards a Recurs
发布日期:
阅读全文 →无需云端即可实现智能体编程:开源大模型在纵向数据准备任务中的表现评估
本地AI新突破:UCL发布RRBench基准,31B开源模型在隐私敏感场景表现优异 摘要: 英国伦敦大学学院(UCL)研究团队发布RRBench框架,评估开源大语言模型在本地环境下
发布日期:
阅读全文 →面向企业AI Agent民主化:持续保障框架的提出与实践
当业务人员开始“搭建”AI Agent:一个被忽视的可靠性危机 你有没有想过,当公司的销售总监用低代码平台花一下午搭了一个“客户意向分析 Agent"时,这个 Agent 真的可靠
发布日期:
阅读全文 →slang.gr:大规模众包非标准希腊语资源及其计算分析
slang.gr:大规模众包非标准希腊语资源及其计算分析 核心事件 论文 arXiv:2607.21255 首次对众包希腊语俚语词典 slang.gr 进行了大规模计算语言学研究,
发布日期:
阅读全文 →希腊语图书检索基准CUP发布:混合检索策略在真实出版场景中表现最佳
希腊语图书检索基准 CUP 发布:混合检索胜出,多语言模型表现超预期 在自然语言处理技术深入垂直行业的进程中,小语种和非结构化数据的检索优化始终是痛点。近日,来自希腊的研究团队发布
发布日期:
阅读全文 →VALE 2026 录用 | 提出统一道德价值观数据集,为指令微调提供价值对齐资源
VALE 2026 新成果:构建统一道德价值观数据集,推动大模型价值对齐 随着大型语言模型(LLM)能力的飞速跃迁,它们已深度嵌入我们的日常生活。然而,一个悬而未决的关键问题始终困
发布日期:
阅读全文 →news-crawler-LM:用小型长上下文模型解决新闻抓取结构化难题
告别“规则太死、大模型太贵”:专用小模型如何重塑新闻抓取? 在当前的互联网信息生态中,从网页中提取高质量、结构化的新闻内容始终是一项极具挑战性的任务。面对异构的 HTML 布局、不
发布日期:
阅读全文 →无需重新训练,AdaDSF实现大模型推理加速:基于层间相似性的动态稀疏化
无需重新训练,AdaDSF实现大模型推理加速:基于层间相似性的动态稀疏化 在大语言模型(LLM)应用迅速扩张的当下,如何降低推理成本并保持模型性能,始终是业界关注的核心痛点。7月2
发布日期:
阅读全文 →GRADRAG:跨组件提示适配,让多智能体 RAG 系统"协同进化"
GRADRAG:跨组件提示适配,让多智能体 RAG 系统“协同进化” 在 Retrieval-Augmented Generation(RAG)系统日益复杂化的当下,一个被长期忽视
发布日期:
阅读全文 →