浣碧_StWQ
06-23·AI领域创作者
国产大模型推理能力实测对比
我直接把一份充满口语、反话和表情包的群聊记录扔给了几个国产大模型,让它们总结待办事项。这才是职场真相:真实的“推理”不是解奥数,是把老板的情绪翻译成任务,再从废话里捞出那两句关键的。这轮表现有点意思,有的模型直接被表情包带沟里,开始分析表情含义而不是工作。DeepSeek依然嗅觉准,能剥离情绪抓核心诉求。
发布于 江苏
分享
评论
未登录
友善发言
image-upload
评论
加载中