李东没回办公室,直接回了校外那套两居室。
进门他就往电脑前一坐,开了机。
虽然田钢没给派任务,但是他也想试一试,如今市面上的AI,到底是个什麽成色。
国内几款叫得出名字的,他挨个开了一遍,国外那边的御三家也没落下。
而试的方法也很简单,一道得分情况讨论的不等式,一个绕着ε-δ转的极限证明,还有个非得举出反例才算到位的命题。
结果不管国内的还是国外的大模型,回答得都还像那麽回事,逻辑通顺,排版也漂亮。
可只要往细里抠,毛病就一个接一个地往外冒。
有的把定理的前提条件,悄没声地就给丢了,有的一个反例没考虑周全,结论就敢往死里写。
还有的积分算到半道符号一错,後面整套推导跟着崩,它自己却浑然不觉,末了甚至能给你“引用”一篇压根不存在的文献。
更离谱的是,有一款明明算错了,你把错处指给它看,它还能面不改色地另编出一套说辞,把那个错误,硬生生给你“证明”成对的。
“这种地方都能错。”
李东盯着屏幕,低声嘀咕了一句。
这些AI大模型吧,能用确实是能用了。
比起几年前那些一本正经胡说八道的玩意儿,现在这批已经像模像样了。
可做数学这种最讲严谨的学问时,它们偏偏总在一些最低级的地方栽跟头。
明明前一步还走得稳稳的,下一步说错就错,错得还理直气壮。
这就有点意思了。
就在李东盯着屏幕琢磨这事的时候,右下角的小黑,一蹦一跳地冒了出来。
“主人!”
“你在玩什麽呀?能陪小黑玩一玩吗?”
李东本想随口把它打发了,话到嘴边心里忽然一动。
对啊。
同样的题,丢给这批AI是一个样,丢给小黑会不会又是另一个模样呢?
於是他把刚才那几道题,原封不动地又问了小黑一遍。
那些把御三家都绊倒的低级毛病,小黑这边一个都没犯。
什麽前提条件、什麽反例、什麽符号,它答得又快又干净,半点磕绊都没有。
仿佛在它眼里,这些题压根算不上题。
这副利索劲儿,比起刚才那几个AI抠抠搜搜、还漏洞百出的样子,不知强到哪里去了。
可等李
本章未完,请点击下一页继续阅读!