拓冰建站拓冰建站
首页 / 资讯中心 / 正文

DeepSeek给AI装上了手和脚——论文写作终于从“帮我写“变成“帮我做“

这两天被DeepSeek刷屏了。V4 Pro正式版发布Harness开源两个东西同一天上。技术圈讨论得很热闹1.6万亿参数、100万上下文、插件架构、峰谷定价。但这些对写论文的人来说都太远了。真正值得关注的信号大部分人都忽略了DeepSeek给AI装上了手和脚。V4 Pro是更强的脑子——三档思考模式、Agent能力逼近顶级闭源模型。Harness是手和脚——让AI能联网搜索、读写文件、运行代码、调用工具。官方有一句概括Model Harness Agent。翻译成大白话模型负责想Harness负责做。我试用了一天对论文写作有三个判断。一、AI终于能查文献了不只是编文献前几天我写过一篇踩坑记录让ChatGPT帮我写引言15条引用里6条捏造、3条张冠李戴。那篇的结论是——AI推荐给你的每一篇文献在被你亲手核验之前都是幻影。原因很简单模型在说话不在查资料。它根据训练数据中的语言模式来预测最合理的下一段文字而不是去数据库里检索真实文献。Harness改变的就是这件事。它支持联网搜索和Skill扩展AI可以直接查询知网、arXiv、PubMed、Crossref这些真实文献库而不是靠自己猜。更关键的是它有全流程日志——每一步操作都可回查。如果某条文献是它检索来的你能看到它从哪个数据库、用什么关键词查到的。如果是它编的日志里找不到来源。以前用AI写文献综述你要花大量时间核验每条引用是真是假。现在你可以让AI去查真实文献它给你的每一条引用都有来源记录可追溯。当然Harness目前还是v0.1开发者预览版官方自己也说还很不完善。把它当作让AI学会查资料的工具而不是自动防造假的保险——这个定位更准确。但方向是对的让AI从编文献变成查文献。二、三档思考不同环节用不同档V4 Pro的思考模式分三档low、high、max。官方的建议是简单任务用low日常Agent任务用high高度复杂的任务用max。我试了一天对论文写作各环节摸索出一个粗略分配思考档位适合的论文写作环节为什么low格式整理、摘要润色、参考文献排版不需要深度推理low档够用速度快成本低high文献综述初稿、方法章写作、讨论部分组织需要理解上下文、保持逻辑一致high档是默认选择max研究问题收敛、论证逻辑审查、审稿意见回复论文里最需要深度推理的环节值得花max档的思考时间有个细节值得注意官方文档说思考模式下temperature、top_p等参数不生效。你不能再通过调温度来控制输出的创造力——思考档位本身决定了推理深度。这意味着用max档跑格式整理和用low档跑研究问题分析都是错配。过度推理有时让模型在简单任务上想多了反而出错。这和我们之前讨论ChatGPT思考按钮时的结论一致拉满思考强度的人论文反而可能更差。关键在于匹配不是拉满。三、全流程日志你用AI的过程可以交代清楚了上周我们聊过Claude的隐形水印——你用Claude润色过的论文会被自动标记。那是一种被动留痕不管你愿不愿意痕迹都在。Harness的日志是另一种方向你主动留的痕。它有一个设计叫append-only session log——所有与模型的交互包括系统提示、推理过程、工具调用和结果、子Agent调度全部按顺序记录。模型看到的任何内容都能从日志中重建。这个特性对学术诚信声明有直接价值。越来越多期刊要求作者披露AI使用情况用了什么工具、在哪些环节用、AI做了什么、作者做了什么。以前这些披露全靠手动回忆写论文的时候谁还记得三周前让AI改了哪段话有了全流程日志你可以导出完整的操作记录哪一步是你写的初稿哪一步是AI润色的哪一步是AI联网查的文献哪一步是你自己修改的。每一步都有时间戳。这不是为了自证清白而是让你的论文经得起审稿人和期刊的追问。当期刊问你AI在论文中扮演了什么角色的时候你能拿出一份操作日志而不是凭记忆写一段模糊的声明。所以变了什么以前用AI辅助论文写作本质是请了一个会说话的顾问——你问它问题它给你建议但活还是你自己干。V4 Pro Harness的组合让AI从顾问变成了助手——你说需求它去查文献、跑数据、生成图表、整理报告你负责判断和决策。DeepSeek V4 Pro Harness 对论文写作的三个改变这个变化的边界也很清楚AI能帮你查资料、整理格式、生成初稿但研究问题值不值得做、结论怎么解读、论文署名谁该在上面——这些判断工具替不了你。DeepSeek这一波刷屏技术圈在比参数和分数。但对写论文的人来说真正值得关注的只有一句AI终于能帮你做了而不只是帮你写。而做的每一步都能交代清楚。
分享:

看完干货,该让你的企业上线了

免费需求沟通 · 48 小时内出具建站方案 · 河南本地可上门