研究实践 / 研究原型
中文现代诗分析实验室
我把诗歌研究材料、分析规则和一个可运行原型接在一起,试着让模型的赏析更贴近具体文本,也更容易被检查。
- 时间
- —
- 我的角色
- 这个项目由我独立完成。我负责研究材料、分析框架、系统设计、实现组织和实验验收。
- AI 帮了什么
- AI Agent 参与资料整理、提示实验、代码实现和测试;分析框架及最终取舍由我确定。
诗歌赏析很容易写得像样。我想知道,能不能把研究材料、分析规则和测试接起来,让模型的判断更贴近具体文本?
CURRENT RESULTS
现在的结果
研究材料37 份研究文件
Bridge48 项中间资产
测试47 个测试文件
我为什么拿诗歌做实验
让模型写一段像样的诗歌赏析并不难。可我回到原诗时,经常会发现它在套用术语、补写作者意图,或者把一种可能的解释说成唯一答案。
我想把这个问题做成一个研究原型:先整理分析材料和常见失败,再看这些内容最后有没有改变系统的输出。
给研究和产品加一座桥
项目最早分成研究笔记和产品代码两块。两边都有内容,但模型仍然会自由发挥。我后来在中间加了一层 Bridge,把每个分析维度对应的观察、文本证据、提示来源和失败方式整理成工程可以调用和测试的资产。
这层工作让研究材料开始进入具体行为:一条规则来自哪里、在哪个提示里使用、由什么测试检查,都可以顺着结构找到。
我选择保留多种读法
原型没有给诗歌设置一个总分。它会从多个角度观察文本、引用具体诗句,并保留不同解释之间的空间。
我也把几种常见问题放进测试和审阅:套用术语、过度阐释、离开原文,以及把作者意图写成事实。
原型现在做到哪儿
目前项目形成了 Research、Bridge 和 Product 三层,包含 37 份研究文件、48 项 Bridge 资产和 47 个测试文件。它已经能作为研究原型继续迭代,暂时没有作为成熟产品上线。
下一步
诗歌没有一套简单的标准答案,自动测试只能守住结构和明显错误。下一步需要加入更多真实文本和有经验读者的反馈,再检查现在的分析框架在哪些作品上会失效。