<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"><channel><title>科技投资随笔</title><description>关于AI、云、半导体、软件与平台生意的长期研究记录。不预测下一个季度，只记录一个判断如何形成、如何被数据检验，以及在什么条件下它会失效。</description><link>https://personal-investing-site.pages.dev/</link><language>zh-CN</language><item><title>谁更擅长真实投研工作流？Fin-Agent-Bench R1 八模型实测</title><link>https://personal-investing-site.pages.dev/blog/2026-08-fin-agent-bench-r1/</link><guid isPermaLink="true">https://personal-investing-site.pages.dev/blog/2026-08-fin-agent-bench-r1/</guid><description>用 36 个真实投研任务测试 8 套模型与 Agent 系统：GLM 5.3 和 Claude Sonnet 5 跑满全量组，真正拉开差距的是材料路由、权限边界与财报语义约束。</description><pubDate>Sun, 23 Aug 2026 00:00:00 GMT</pubDate><category>AI Agent</category><category>模型测评</category><category>投研工作流</category><category>Fin-Agent-Bench</category></item></channel></rss>