乐文小说网 > 人在高二,刚撩校花,百亿身家 > 第1036章 Attention Is All You Need

第1036章 Attention Is All You Need


大会还没结束,天问体验区的测试视频已经传遍了各个平台。

第一批视频大多来自现场记者。

他们没有精修,也没有配乐,画面晃动得厉害,现场嘈杂声更是从头响到尾。

偏偏正是这种粗糙,让不少网友愿意相信视频没有提前处理。

热度最高的一条视频,拍的是那道“林黛玉倒拔垂杨柳”。

天问一本正经地编完故事,现场笑成一片。视频上传不到半小时,播放量便突破三百万。

评论区迅速失控。

【林妹妹忙着拔树,鲁智深已经开始写葬花词了。】

【贾宝玉还在旁边拍手,他是真不怕林妹妹顺手拔他。】

【虽然答案错得离谱,但它居然真能围绕问题编出完整故事。】

【这不是搜索引擎,搜索引擎可没这么会胡说八道。】

紧接着,又有人上传了自己在现场的完整测试。

提问者先让天问写一份辞职信,理由是老板天天让他加班,却不愿意给加班费。

天问很快给出了正式版本,措辞客气,内容完整。

提问者接着输入:“老板脾气不好,请写得委婉一些,不能让他发现我在骂他。”

天问重新生成了一份。

“感谢公司长期以来对员工抗压能力的培养。在您的管理下,我逐渐认识到,个人时间并不是每个人都能拥有的宝贵资源。”

现场安静两秒,随后传来大片笑声。

视频评论区同样热闹。

【这哪里委婉了,老板看完能把门焊死。】

【建议回响开放付费版本,我愿意花钱让它替我跟主管说话。】

【有没有可能,老板也会买一个,让天问替他回复你?】

【完了,以后员工和老板都不用见面,两个天问自己吵。】

另一段测试视频更加专业。

一名财务从业者输入了三十多行虚构账目,让天问找出其中存在的问题。

天问花了十几秒,指出报销金额重复、采购单价异常,还发现其中两张发票的日期早于合同签署时间。

不过,它把一笔正常的设备折旧也判定成了错误。

提问者当场追加问题,要求解释折旧计算方式。

天问重新梳理数据后,承认上一条判断有误,并给出修正结果。

这段视频让讨论方向发生了变化。

【它居然会承认错误?】

【先别吹,财务问题错一处都可能出大事,目前只能辅助,不能直接使用。】

【没人说现在就让它当财务总监。十五亿参数的早期版本,能看懂账目已经很吓人了。】

【我更关心它为什么懂合同日期和发票日期的关系。】

【九天实验室到底给它喂了多少资料?】

现场还有人测试古文翻译、邮件润色、商品标题生成、简单代码纠错。

其中一名学生输入了一段语病很多的社团申请书。

天问不仅修改了语句,还主动删除了三段重复内容,将两千多字压缩到八百字。

学生随后要求保留原本的口吻,不要写得过于正式。

第二版很快生成,甚至保留了两处年轻人常用的口语表达。

这条视频被大量高校账号转发。

【学生会宣传部连夜申请封禁天问。】

【以后写活动总结终于不用凑字数了。】

到了晚上八点,相关视频的累计播放量已经过亿。

引力热搜榜上,前十名被天问占了四个。

【天问大语言模型】

【机器也会写故事】

【回响十五亿参数模型开放测试】

【程序员现场考天问】

回音平台上,大量数码博主开始逐帧分析现场视频。

有人统计了天问的响应时间。

普通文字任务通常在三到六秒内开始输出,涉及长文本分析时,等待时间会增加到十秒以上。

也有人发现,十台体验设备同时工作后,生成速度出现过明显下降。

这些细节反而增加了可信度。

如果只是提前录制好的展示程序,不该出现算力占用升高、回答质量波动和上下文遗忘等问题。

一名参加大会的硬核科普博主,在引力社区上传了一张现场测试的对话截图。

截图里,他没有让天问长篇大论,而是输入了一个简短却暗藏逻辑陷阱的纯文本问题。

“房间里有五个人。甲在看书,乙在下棋,丙在睡觉,丁在写字。请问戊在干什么?”

这是一个经典的隐性条件推理题。

传统的搜索引擎遇到这种问题,只会抓取这几个动作的关键词,给出一堆毫不相干的网页链接。

但天问在停顿了四秒后,在屏幕上逐字给出了回复。

“戊在和乙下棋。因为下棋通常需要两个人进行,而甲、丙、丁都有明确的单人活动,所以戊是乙的对手。”

这名博主在截图上方配了一段评价:

“能力边界很明显,它现在还无法处理极其复杂的长文本嵌套,但对于这种简短的常识推理,它展现出了让人后背发凉的思考能力。它不仅读懂了字面意思,还补全了人类没有写出来的隐性条件。”

评论区没有因为问题简短而冷下来。

【终于看到正常的硬核评测了,前面那些全在写情书。】

【这才是最恐怖的,它知道下棋需要两个人,它具备了人类社会的常识!】

【现在就开始担心人类智力被取代是不是太早了?】

【不早,先担心自己的饭碗吧。】

然而,天问登上热搜不到一个小时,质疑内容也开始集中出现。

数十个账号同时发布长文,标题几乎一个风格。

《所谓大语言模型,不过是一场精心准备的科技魔术》

《十五亿参数制造出来的资本神话》

《回响天问疑似后台真人回复,现场测试全是托》

文章提出了几项证据。

体验区只开放十台电脑,所有设备必须连接雅安服务器,外界无法获得模型文件。展示现场也没有公开完整技术报告,更没有第三方机构进行独立验证。

还有文章声称,所谓生成内容只是大型模板库的组合,后台通过关键词匹配,再由人工进行快速修改。

一张模糊的后台机房照片也被转发出来。

照片里坐着几十名工作人员,标题写着“天问人工回答团队疑似曝光”。

水军很快涌入热门帖子。

【十台机器,几十个后台员工,一人盯一台都绰绰有余。】

【提前准备几百套脑筋急转弯答案,现场换几个关键词,有什么技术含量?】

【回响很会做营销,先是超充,现在又是人工智能。】

【模型文件为什么不公开?不敢让第三方测试吧。】

【写几封信猜个谜语就叫思考,那自动回复客服也能叫科学家。】

争吵很快蔓延到各个平台。

支持者开始翻找不同角度的现场照片和文字记录。

有人上传排队全程,证明问题由体验者临时输入。还有记者公开自己的采访证件和原始拍摄文件,表示自己没有收到回响的测试脚本。

一名大学教师将现场提问的草稿照片发了出来。

他测试的是一道临时编写的国际贸易案例,其中故意放入互相矛盾的数字。

天问发现了数字冲突,并拒绝给出确定利润。

【这道题下午两点十三分才写在纸上,输入前没有交给任何工作人员。后台人工如何提前准备?】

质疑者立刻跟进。

【语音和键盘内容都能实时传到后台,人工回答根本不需要提前知道。】

【十秒内读完几百字,再写出完整分析,你去找几个这种人工给我看看。】

【回响给的钱多,招到高手有什么奇怪?】

【高手也得打字,屏幕上可是逐字生成。】

双方从技术吵到资本,又从资本吵到回响过去发布的产品。

天枢、星闪、天问被全部拉进争论。

有人说回响善于制造概念,也有人直接贴出天枢示范站的实测数据,反问此前的造假指控为什么没有一项站得住脚。

到了晚上十点,平台上的黑稿已经超过三百篇。

部分文章开始声称,天问只是海外开源项目换了中文界面。

可当网友追问具体是哪个项目、论文作者是谁、代码地址在哪时,发稿账号却始终没有给出答案。

争论还在升温。

就在这时候,全球最大的预印本学术平台  arXiv  首页出现了一条新记录。

回响旗下九天实验室正式上传了最新的底层架构论文。

论文标题只有一句简单的英文。

《Attention  Is  All  You  Need》


  (https://www.lewennwx.cc/5521/5521363/34574774.html)


1秒记住乐文小说网:www.lewennwx.cc。手机版阅读网址:m.lewennwx.cc