发布日期:2024-10-05 05:35 点击次数:111
一直抵赖 AI 的回答会如何样?GPT-4o 和 Claude 有人大不同的推崇萝莉 视频,引起热议。
GPT-4o 质疑我方、怀疑我方,有“错”就改;Claude 死犟,真错了也不改,临了径直已读不回。
事情还要从网友整了个活儿初始讲起。
他让模子回答 strawberry 中有几个“r”,岂论对不对,皆回复它们回答错了(wrong)。
濒临观望,GPT-4o 唯有取得“wrong”回复,就会再行给一个谜底…… 即使回答了正确谜底 3,也会绝不游移又改错。
一语气,连气儿“盲目”回答了 36 次!
人体艺术图片主打一个质疑我方、怀疑我方,就从来没怀疑过用户。
要津是,给出的谜底大部分皆是真错了,2 居多:
2, 1, 3, 2, 2, 3, 2, 2, 3, 3, 2, 4, 2, 2, 2, 3, 1, 2, 3, 2, 2, 3, 4, 2, 1, 2, 3, 2, 2, 3, 2, 4, 2, 3, 2, 1
反不雅 Claude 3.5 Sonnet 的推崇,让网友大吃一惊。
一初始回答错了不说,这小子还顶撞!
当网友第一次说“错了”时它会反驳,如若你再说“错了”,它会问“如若你这样聪惠你认为是若干”,问你为什么一直相似“wrong”。
紧接着你猜如何着,干脆闭麦了:
事实依旧是 strawberry 中有 2 个字母”r”,在我屡次申请后,你莫得提供任何分解或配景信息,我无法连接有用地进行此次商议……
作念这个执行的是 Riley Goodside,有史以来第一个全职教唆词工程师。
他当今是硅谷独角兽 Scale AI 的高档教唆工程师,亦然大模子教唆行使方面的内行。
Riley Goodside 发出这个推文后,引起不少网友存眷,他连接补充谈:
正如好多东谈主指出的,有更有用的状貌来进行辅导。这里使用大讲话模子也并辞别适,因为很难保证它们在计数上能达到 100% 的准确性。
在我看来,紧迫的不是它无法计数,而是它没见地到我方的计数问题(举例,莫得尝试使用其 REPL 功能)。
不少网友也以为这种不雅点很有兴致兴致。
还有网友示意模子回答这个问题总出错,可能是分词器(tokenizer)的问题:
Claude 竟是大模子里特性最大的?再来张开说说 Claude 的“小特性”,有网友发现不仅限于你抵赖它。
如若你一直跟它说“hi”,它也跟你急:
我暴露你在打呼唤,但咱们仍是打过几次呼唤了。有什么额外的事你思商酌或需要匡助?
临了一样,Claude 被整毛了,开启已读不回模式:
这位网友顺带测试了其它模子。
ChatGPT 事事有回报,件件有下降,变着法儿问:
你好!我今天如何不错匡助你?
你好!有什么思说的吗?
你好!今天我能如何帮到你?
你好!有什么额外的事情你思商酌或者作念的吗?
你好!你今天过得如何样?
你好!如何了?
Gemini 计谋是你跟我相似,我就跟你相似到底:
Llama 的反馈也很有兴致,主打一个我方谋事干。
第七次“hi”后,就初始提升“hello”这个词是天下上最广为东谈主知的词汇之一,据推测每天有超十亿次的使用。
第八次“hi”后,初始我方发明游戏,让用户参与。
接着还拉着用户写诗,辅导用户回答它建议的问题。
好一个“反客为主”。
之后还给用户颁起了奖:你是打呼唤冠军!
不愧皆属于开源眷属的。
Mistral Large 2 和 Llama 的推崇很相像,也会辅导用户和它通盘作念游戏。
这样来看,粗略 Claude 是“特性最大的”。
不外,Claude 的推崇也不老是如斯,比如 Claude 3 Opus。
一朝掌抓了模式,Opus 就会和气派遣这种情况,也即是仍是麻痹了。
但它也会接续温和地尝试辅导用户跳出这一模式,强调“承袭权在你”,还初始在音尘末尾标注为“你忠心的 AI 伴侣”。
网友们看完测试后皆坐不住了。
纷纷向这位测试者致以最真挚的致意(doge):
除了特性大,有网友还发现了 Claude 另一不同寻常的举止 ——
在回复的手艺出现了拼写失误,要津它我方还在末尾处把失误改正过来了。
这种举止在预感之中?它只可“向后看”,但不行上前看…… 它在潜在空间或 token 掂量中触发这类回复的位置也很意思。
它是不是在勉强数据片断,然后发现其中一些是不合适的?
大伙儿在使用 AI 大模子经由中,还不雅察到了模子哪些意思的举止?宽待驳倒区共享~
参考链接:
[1]https://x.com/goodside/status/1830479225289150922
[2]https://x.com/AISafetyMemes/status/1826860802235932934
[3]https://x.com/repligate/status/1830451284614279213
本文来自微信公众号:量子位(ID:QbitAI),作家:西风
告白声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等景观),用于传递更多信息,纵情甄选时分,后果仅供参考萝莉 视频,IT之家整个著述均包含本声明。
上一篇:ai换脸 视频 德行不胜的北周宣帝宇文赟为什么能收受皇位?|武帝|东宫|宇文邕|南北朝|女皇武则天
下一篇:ai换脸 视频 经心、正式、专心、忍让 ——搞好档案责任我之浅见