返回项目

研究实践 / 研究原型

中文现代诗分析实验室

我把诗歌研究材料、分析规则和一个可运行原型接在一起,试着让模型的赏析更贴近具体文本,也更容易被检查。

时间
我的角色
这个项目由我独立完成。我负责研究材料、分析框架、系统设计、实现组织和实验验收。
AI 帮了什么
AI Agent 参与资料整理、提示实验、代码实现和测试;分析框架及最终取舍由我确定。
起点
诗歌赏析很容易写得像样。我想知道,能不能把研究材料、分析规则和测试接起来,让模型的判断更贴近具体文本?

CURRENT RESULTS

现在的结果

研究材料37 份研究文件
Bridge48 项中间资产
测试47 个测试文件

我为什么拿诗歌做实验

让模型写一段像样的诗歌赏析并不难。可我回到原诗时,经常会发现它在套用术语、补写作者意图,或者把一种可能的解释说成唯一答案。

我想把这个问题做成一个研究原型:先整理分析材料和常见失败,再看这些内容最后有没有改变系统的输出。

给研究和产品加一座桥

项目最早分成研究笔记和产品代码两块。两边都有内容,但模型仍然会自由发挥。我后来在中间加了一层 Bridge,把每个分析维度对应的观察、文本证据、提示来源和失败方式整理成工程可以调用和测试的资产。

这层工作让研究材料开始进入具体行为:一条规则来自哪里、在哪个提示里使用、由什么测试检查,都可以顺着结构找到。

我选择保留多种读法

原型没有给诗歌设置一个总分。它会从多个角度观察文本、引用具体诗句,并保留不同解释之间的空间。

我也把几种常见问题放进测试和审阅:套用术语、过度阐释、离开原文,以及把作者意图写成事实。

原型现在做到哪儿

目前项目形成了 Research、Bridge 和 Product 三层,包含 37 份研究文件、48 项 Bridge 资产和 47 个测试文件。它已经能作为研究原型继续迭代,暂时没有作为成熟产品上线。

下一步

诗歌没有一套简单的标准答案,自动测试只能守住结构和明显错误。下一步需要加入更多真实文本和有经验读者的反馈,再检查现在的分析框架在哪些作品上会失效。