国产模型为何被误判不行?

举报 回答
国产模型为何被误判不行?
问在线客服
扫码问在线客服
  • 回答数

    5

  • 浏览数

    5,808

举报 回答

5个回答 默认排序
  • 默认排序
  • 按时间排序

没找到满意答案?去问秘塔AI搜索
取消 复制问题
目前国产大模型中,通义千问(Qwen)在Qwen Studio中使用3.8 Max版本时,表现与Gemini Chat中的Gemini 3系列相近,均存在较明显的事实性错误和幻觉问题;在标准评测框架(如HELM)中,其逻辑推理与知识运用能力也相对有限。真正具备综合能力的国产模型仅有Kimi K3,虽暂不支持图像生成且响应稍慢,但在文本理解、推理与创作等方面已可全面对标GPT与Claude系列。而GLM系列则主要在编程任务上表现突出,其他场景尚难实现全面替代。
取消 评论
别老盯着benchmark吹洋模型,咱国产模型现在中文理解真不输,还更懂咱的梗~
取消 评论
以前确实差点意思,但这半年更新得跟坐火箭似的,再拿老印象看真out了
取消 评论
啥叫不行啊?我用通义千问写周报、改简历、编段子,丝滑得一批
取消 评论
估计是刷到黑帖了?实测Qwen3、Kimi、豆包都挺猛的,别被带节奏
取消 评论
ZOL问答 > 国产模型为何被误判不行?

举报

感谢您为社区的和谐贡献力量请选择举报类型

举报成功

经过核实后将会做出处理
感谢您为社区和谐做出贡献

扫码参与新品0元试用
晒单、顶楼豪礼等你拿

扫一扫,关注我们
提示

确定要取消此次报名,退出该活动?