因为下棋通常需要两个人进行,而甲、丙、丁都有明确的单人活动,所以戊是乙的对手。”
这名博主在截图上方配了一段评价:
“能力边界很明显,它现在还无法处理极其复杂的长文本嵌套,但对于这种简短的常识推理,它展现出了让人后背发凉的思考能力。它不仅读懂了字面意思,还补全了人类没有写出来的隐性条件。”
评论区没有因为问题简短而冷下来。
【终于看到正常的硬核评测了,前面那些全在写情书。】
【这才是最恐怖的,它知道下棋需要两个人,它具备了人类社会的常识!】
【现在就开始担心人类智力被取代是不是太早了?】
【不早,先担心自己的饭碗吧。】
然而,天问登上热搜不到一个小时,质疑内容也开始集中出现。
数十个账号同时发布长文,标题几乎一个风格。
《所谓大语言模型,不过是一场精心准备的科技魔术》
《十五亿参数制造出来的资本神话》
《回响天问疑似后台真人回复,现场测试全是托》
文章提出了几项证据。
体验区只开放十台电脑,所有设备必须连接雅安服务器,外界无法获得模型文件。展示现场也没有公开完整技术报告,更没有第三方机构进行独立验证。
还有文章声称,所谓生成内容只是大型模板库的组合,后台通过关键词匹配,再由人工进行快速修改。
一张模糊的后台机房照片也被转发出来。
照片里坐着几十名工作人员,标题写着“天问人工回答团队疑似曝光”。
水军很快涌入热门帖子。
【十台机器,几十个后台员工,一人盯一台都绰绰有余。】
【提前准备几百套脑筋急转弯答案,现场换几个关键词,有什么技术含量?】
【回响很会做营销,先是超充,现在又是人工智能。】
【模型文件为什么不公开?不敢让第三方测试吧。】
【写几封信猜个谜语就叫思考,那自动回复客服也能叫科学家。】
争吵很快蔓延到各个平台。
支持者开始翻找不同角度的现场照片和文字记录。
有人上传排队全程,证明问题由体验者临时输入。还有记者公开自己的采访证件和原始拍摄文件,表示自己没有收到回响的测试脚本。
一名大学教师
本章未完,请点击下一页继续阅读!