AI Agent
FinanceHarness:自主金融深度研究框架
FinanceHarness: Autonomous Financial Deep Research Framework
通用 Deep Research 写不出合格的金融研报,因为金融研究的本质是「用截止日之前的证据,预判截止日之后的结果」。这篇论文同时给出考卷(FinanceGym:400 道专家标注题 + Point-in-Time 防泄漏沙盒)和答题方法(FinanceHarness 分层智能体框架)。结果:17 个顶尖系统全部低于 40 分,最强的 Claude-Opus-4.7 也只有 34.1 分;所有系统取证题 40–50 分、前瞻判断题仅 5–13 分——「AI 取代分析师」短期仍是伪命题,但证据收集环节的降本已真实发生。
Deep Research金融AIAgent 评测LLMRAG
Google Cloud AI Research × UCLA阅读精读 →
