你在豆包里让它推导了一段公式,点了回答下方的复制按钮,粘贴到编辑器里一看:
设总成本为 \(C_{\text{总成本}}C_{总成本}\),其中 \(p_ip_i\) 表示单价……
公式的内容出现了两遍,中间还夹着中文和全角标点。有的地方甚至套了好几层括号,看上去像编码坏了。
这不是编码问题,也不是你的编辑器出错。 它是复制这一步对公式做了文本替换之后留下的产物。
这段"乱码"是怎么来的
网页上的公式是渲染出来的。同一条公式在页面里同时存在两份信息:
-
源码:
C_{\text{总成本}},机器要用的; - 显示文本:浏览器渲染后能被选中的那些字符,人眼看到的。
当复制功能试图把"页面上看到的东西"转成"可以粘贴的纯文本"时,需要把渲染出来的显示部分换回 LaTeX 源码。如果这个替换是按文本匹配做的,就会有一个麻烦:公式的显示文本里那些普通字符——中文、全角标点、常规数字——在正文里也大量存在。
替换的边界一旦没卡准,就会出现两类残留:
- 内容重复:源码替换进去了,但原本的显示文本没被完全清掉,于是同一条公式出现两遍;
-
层层嵌套:替换后的结果又被下一轮匹配命中,
\(里面再套一个\(。
留在最后的往往就是"LaTeX 源码 + 中文和标点碎片"交错在一起的样子。这也解释了为什么纯英文纯数字的公式反而经常是好的——它们的显示文本和正文重合度低,替换边界不容易出错。
为什么手工清理不划算
有人会想,无非是把多余的部分删掉。公式只有两三条时确实可以。但真实的推导过程动辄十几二十条公式,而且:
- 你得逐条判断哪一段是源码、哪一段是残渣,两者混在一起时肉眼很难分辨;
- 删错一个花括号,整条公式的结构就破了,转换出来是错的;
- 就算这次清干净了,下次复制还得再来一遍。
清理的时间成本远高于换一条路径。
三种能拿到干净原文的方法
方法一:分享链接提取(最省事)
豆包的分享链接指向的是这次对话的原始内容,不经过页面复制这一步,所以不会有残渣。
- 在豆包对话页点分享,生成链接并复制;
- 打开 AI 链接提取,把链接粘进去;
- 内容提取出来后直接导出 Word / PDF / Excel。
这条路除了豆包,同样适用于 DeepSeek、Kimi、腾讯元宝、千问、智谱清言、文心一言、腾讯 ima、夸克等平台的分享链接。
方法二:浏览器插件(适合长对话和批量)
装上 DS随心转浏览器插件后,在豆包页面上会多出导出入口。它读取的是对话的数据层而不是渲染层,绕开了复制环节,公式源码是完整的。
插件还能勾选多条问答一次性导出,长对话留档比一条条复制现实得多。目前覆盖豆包、DeepSeek、Kimi、腾讯元宝、千问、智谱清言、文心一言、ChatGPT、Claude、Gemini 等主流平台。
方法三:还是要复制的话,先自检一遍
如果场景不允许装插件、也不方便生成分享链接,那就复制完之后先做一次快速检查:
- 在编辑器里搜
\(,看数量和\)是否对得上; - 抽查两三条公式,确认花括号成对、没有同一串内容出现两遍;
- 特别留意带中文的公式,它们最容易出问题。
确认没问题再往下走。发现有重复的,直接改走前两种方法,比修快。
修完之后:把公式变成 Word 能编辑的对象
拿到干净的 LaTeX 只是第一步。直接把 \(C = \sum p_i q_i\) 粘进 Word,得到的仍然是一串代码——Word 不认识它是数学。
用 DS随心转导出 Word 时,公式会被转换成 Word 原生的公式对象,双击就能改,放大也不糊。这部分的原理和其他两种粘贴结果的区别,写在了这篇里。
一句话总结
看到公式内容重复、括号套括号,不要试图去修那段文本,去换取原文的方式。分享链接和插件都绕开了页面复制这一步,从源头上就不会有这个问题。
常见问题
为什么豆包复制出来的公式是 \(...\) 而不是 $...$?
\( \) 和 $ $ 都是 LaTeX 行内公式的合法定界符,只是不同产品选择的写法不同。它本身不是错误,问题在于替换过程中混入了公式的显示文本残渣,导致同一条公式的内容出现两次或嵌套。
手工把多余的反斜杠删掉行不行?
公式少可以,公式多不现实。残缺文本往往是"LaTeX 源码 + 显示文本碎片"交错在一起,肉眼很难判断哪一段该留哪一段该删,删错一个花括号整条公式就废了。更省事的做法是换一条取原文的路径。
用分享链接提取会不会看到我别的对话?
不会。分享链接是你主动为某一次对话生成的公开地址,提取只读取这一个链接对应的内容。
豆包的表格和流程图会不会有同样的问题?
表格一般不会,因为表格在复制时输出的就是 Markdown 竖线表格。Mermaid 流程图取决于当时的渲染方式,如果复制到的是渲染后的图形描述而非源码,同样建议改走分享链接或插件。
DS随心转