我发现最近的大模型空间理解能力越来越差了,大家有没有这种感觉?
比如根据照片推断地址,目前这两个都说的不对,就 gpt-5.6 sol 说对了
比如根据照片推断地址,目前这两个都说的不对,就 gpt-5.6 sol 说对了
1
keshawnvan 18h 52m ago
现在重心在 Coding
|
2
yulon 18h 45m ago
现在多模态基本没有空间想象能力,多模态还会分走智商,我做 AI 视频的,如果要 LLM 帮忙自动生成构图,不如给瞎子模型配个识图 tool
|
4
longaiwp 18h 29m ago
我感觉是因为如果混入太多这类数据,它整个参数会变大,训练难度会增加,并且这类数据还会影响整体的智能水平,所以都没有往多模态去做。
|
5
oky 18h 22m ago
以前他们的多模态也是远不如 gpt 的,感觉识别能力差很多
|
9
mingtdlb 16h 8m ago
我感觉只有 chatgpt 的靠谱,其他的糊一点就识别不到
|
10
clemente 15h 14m ago
多模态都是胶水 vision 层模型 做的
现在的模型都是胶合板 没有原生的多模态 |