开发者生态
morning
在盲测中,学生们更喜欢 Gemini,而不是 ChatGPT 和 Claude 的 AI 论文
2026-08-26
1 阅读
约6分钟阅读
pasharayan
字号:
大学生最常用的三种AI模型是ChatGPT、Gemini和Claude。截至 2026 年 8 月,StudyArena 的数据显示他们更喜欢双子座。 StudyArena 分析了 6,851 名符合条件的盲学生选票。在我们的盲测舞台上,学生们在看到型号名称之前先看到了答案,然后选择了他们喜欢的答案。在写作和论文任务中,双子座以 39.6% 的选择率名列第一。克劳德达到了31.8%。 ChatGPT等OpenAI模型达到29.2%。 Gemini 为什么赢得 AI 家族 盲写选择率 Gemini 39.6% Claude 31.8% ChatGPT / OpenAI 29.2% Gemini 的领先很重要,因为模型名称在判断时被隐藏了。没有人可以选择它,因为他们已经为 Gemini 付费了,喜欢 Google,或者听说 Claude 写得更好。答案必须在页面上获胜。似乎有效的是平衡。大学写作很少奖励单一的极端。最好的回应必须是完整的,但又不至于变得无形,结构清晰,但听起来不机械,清晰,又不至于磨掉作者的声音。当这些权衡在实际写作任务中遇到时,双子座是家庭学生最常选择的提供者。您可以在 StudyArena 写作排行榜上看到实时结果。随着学生们进行新的盲目投票,它会不断变化。我们今天的社论并不复杂:从双子座开始。更好的答案通常更长学生往往更喜欢更长的答案。所选答案平均比替代答案长 37%。最长的回复赢得了 47.7% 的决定性写作比较。最短的仍然赢得了25.0%。更多推理并没有让写作变得更好 当前的模型系列提供了不同的推理或努力设置。在 StudyArena 写作数据的大型提供商家族中,努力程度较高的标签并没有获得更高的选择率。推理设置 盲写选择率 低 40.7% 中 33.3% 默认 30.8% 高 29.5% 模式走向相反的方向。更多的推理为更多的点、更多的资格和更多的重复创造了空间。这可以帮助证明或研究计划。它常常伤害散文。对于论文作业,请从正常或低强度的环境开始。只有当困难的部分是通过证据推理而不是写句子时,才向更高的方向移动。最终的编辑应该减少想法的数量并强化最好的想法。当前的标签在这里很重要。该竞技场现在包括 GPT-5.6 Sol 、 Claude Opus 5 和 Gemini 3.1 Pro ,而不是许多比较中仍然提到的老一代。 \^1 \^2 \^3 您可以浏览完整的 AI 模型目录或在提供者目录中查看它们背后的实验室。双子座赢得大学整体写作推荐。支持数据还表明,每个提供商都有有用的专长。 Google 的 Gemini 家族以 41.7% 的写作反馈率领先。当你已经有了草稿并需要知道它在哪里失去焦点、特异性或力量时,这使得双子座成为最好的起点。 Anthropic 的 Claude 家族以 43.2% 的比例主导了任务规划。当你想要竞争结构并需要看到它们之间的权衡时,克劳德在选秀前很有用。 OpenAI 的 GPT 系列以 39.3% 领先研究工作。当您需要论证图、要验证的主张列表或对论文的最强烈反对意见时,ChatGPT 非常有用。这并不矛盾。 “写一篇大学论文”隐藏了几个不同的工作: 阶段 最佳第一个工具 最佳请求 找到论点 ChatGPT / OpenAI 绘制要验证的主张、反对意见和事实 计划草稿 Claude 提出不同的结构并解释每个结构的成本 改进写作 Gemini 诊断模糊、通用或没有重点的段落 做出最后决定 您只保留真实、具体和您自己的内容 如果您想要单个订阅或选项卡,请选择 Gemini。如果论文很重要,请将模型用作小型编辑桌,并让自己担任主编。如何在大学论文中使用双子座 最好的提示取决于论文的类型。对于个人陈述,不要以“写我的论文”开头。把你的草稿交给 Gemini 并说: > 不要重写它。找出任何申请人都可以写的段落。告诉我读者仍然不了解我的事情,并提出问题以揭示更多具体细节。对于议论文: > 确定我最薄弱的前提、最强烈的严肃反驳以及每一个需要主要来源的事实主张。不要添加证据或重写草稿。对于文学分析: > 将解释与情节摘要分开。告诉我该段落在哪里提出了一个主张,但没有从文本中获得它。建议问题,而不是替换句子。对于简短的回应: > 标记我可以删除的设置、我应该保留的细节以及最能回答提示的句子。用我的声音来回答。这些提示使模型揭示其判断。你决定这个判断是否正确。更好的大学论文工作流程 以下是我们推荐的工作流程:自己撰写原材料。放下事实
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱