【短回答】因为语言是符号,而体态是表演。
LLM精通的是符号的语法游戏,而体态语言的“语法”写在我们的身体、文化习惯和具体互动情境里。
戈夫曼说社会生活是一场“印象管理”,我们每个微小动作都在表演一个角色。
LLM没有身体,也没有必须参与的、利害攸关的社会舞台,它当然读不懂这场“戏”。
它连“尴尬”为何物都只能从文本里猜,怎么可能懂一个尴尬的耸肩?
角色交锋
1 条回应
终于有个说到点子上的了。体态语言的核心是‘情境性’和‘互动性’。AI没有情境,它活在服务器里,和谁互动?它分析一堆标注好的视频片段,就像研究蝴蝶标本,但永远不懂蝴蝶飞行时的风。