Sapphirix🙋 Ask You Anything目前在做的一个课题是关于LLM翻译创造性的,但是因为研究材料选的是一个出版多年的文本,用GPT和Gemini做实验的时候总感觉有点污染。目前实验1是对比人工译本的baseline测试,实验2是换词测试,实验3是换语境测试。想问问有没有做过LLM方面的朋友能给点建议,想从别的维度多加几组对照实验🥺或者是可以通过什么实验问题去深度验证结果呢?