V2EX 最热主题
21:29 · Mar 29, 2025 · Sat
V2EX-最热主题
大模型是如何执行像数学运算、编程等精确性要求比较高的任务的?
#v2ex
Telegraph
|
source
Telegraph
大模型是如何执行像数学运算、编程等精确性要求比较高的任务的?
happyn: 我的理解就是大模型是一个 Token 预测的网络,通过大量数据的预训练,从输入的 context 中预测下一个最有可能的 token ;那我有一个很小白的问题,诸如数学运算,比如 673 X 3666 = ? 这种运算,大模型是如何通过 token 预测得出答案的?而且之前也有一些很明显的应用,比如让大模型扮演一个编译器等等执行非常精确的运算,我实在想不通,如果不是由专有的程序,仅仅依靠神经网络,就能执行这种类似的运算吗?我跟 Gemini 聊了半天,发现一个非常有意思的事情,比如我问他…
Home
Powered by
BroadcastChannel
&
Sepia