然会承认错误?】
【先别吹,财务问题错一处都可能出大事,目前只能辅助,不能直接使用。】
【没人说现在就让它当财务总监。十五亿参数的早期版本,能看懂账目已经很吓人了。】
【我更关心它为什么懂合同日期和发票日期的关系。】
【九天实验室到底给它喂了多少资料?】
现场还有人测试古文翻译、邮件润色、商品标题生成、简单代码纠错。
其中一名学生输入了一段语病很多的社团申请书。
天问不仅修改了语句,还主动删除了三段重复内容,将两千多字压缩到八百字。
学生随后要求保留原本的口吻,不要写得过于正式。
第二版很快生成,甚至保留了两处年轻人常用的口语表达。
这条视频被大量高校账号转发。
【学生会宣传部连夜申请封禁天问。】
【以后写活动总结终于不用凑字数了。】
到了晚上八点,相关视频的累计播放量已经过亿。
引力热搜榜上,前十名被天问占了四个。
【天问大语言模型】
【机器也会写故事】
【回响十五亿参数模型开放测试】
【程序员现场考天问】
回音平台上,大量数码博主开始逐帧分析现场视频。
有人统计了天问的响应时间。
普通文字任务通常在三到六秒内开始输出,涉及长文本分析时,等待时间会增加到十秒以上。
也有人发现,十台体验设备同时工作后,生成速度出现过明显下降。
这些细节反而增加了可信度。
如果只是提前录制好的展示程序,不该出现算力占用升高、回答质量波动和上下文遗忘等问题。
一名参加大会的硬核科普博主,在引力社区上传了一张现场测试的对话截图。
截图里,他没有让天问长篇大论,而是输入了一个简短却暗藏逻辑陷阱的纯文本问题。
“房间里有五个人。甲在看书,乙在下棋,丙在睡觉,丁在写字。请问戊在干什么?”
这是一个经典的隐性条件推理题。
传统的搜索引擎遇到这种问题,只会抓取这几个动作的关键词,给出一堆毫不相干的网页链接。
但天问在停顿了四秒后,在屏幕上逐字给出了回复。
“戊在和乙下棋。
本章未完,请点击下一页继续阅读!