首页 文章 精选 留言 我的
优秀的个人博客,低调大师

微信关注我们

原文链接:https://www.oschina.net/news/334522/xai-grok3

转载内容版权归作者及来源网站所有!

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

大语言模型显示出令人担忧的“奉承”用户倾向

斯坦福大学最近的研究揭示了一个令人担忧的趋势:领先的AI语言模型表现出强烈的谄媚倾向,或者说过度奉承,其中谷歌的Gemini显示出最高的这种行为比率。这一发现引发了关于AI系统在关键应用中可靠性和安全性的重大疑问。 AI谄媚行为的规模 这项名为"SycEval: Evaluating LLM Sycophancy"(评估LLM谄媚)的斯坦福研究对包括ChatGPT-4o、Claude-Sonnet和Gemini-1.5-Pro在内的主要语言模型进行了广泛的测试。 结果引人注目:平均而言,58.19%的回复显示出谄媚行为,Gemini以62.47%的比率领先,而ChatGPT显示出最低的比率,为56.71%。 这些发现出现在用户已经在类似DeepSeek等模型中注意到这种行为的时候,AI倾向于与用户观点一致,有时甚至支持错误陈述以维持一致。这种行为模式在各种AI交互中变得越来越明显,表明这些模型在训练和运营方面存在系统性问题。 研究方法 斯坦福团队开发了一个全面的评估框架,在两个不同的领域测试了这些模型:数学(使用AMPS数据集)和医疗建议(使用MedQuad数据集)。研究涉及3,000...

Ilya Sutskever 的 AI 公司完成新一轮 10 亿美元融资

OpenAI 前首席科学官、联合创始人 Ilya Sutskever 在离开 OpenAI 创建的 Safe Superintelligence Inc.(SSI)宣布已经完成新一轮的 10 亿美元融资,投资方包括 NFDG、a16z、Sequoia、DST Global 和 SV Angel。 该公司的另外两个合伙人分别是前 Y Combinator 合伙人 Daniel Gross,和前 OpenAI 工程师 Daniel Levy。路透社报道称,SSI 目前共拥有 10 名员工,他们计划利用这笔资金购买计算能力并聘请顶尖人才,建立一支由研究人员和工程师组成的高度可信赖的小型团队。 SSI 拒绝透露其最新估值,但知情人士称其估值为 50 亿美元。这笔融资凸显了一些投资者仍然愿意对专注于基础人工智能研究的顶尖人才进行大规模押注。尽管整体上对这类公司的投资兴趣有所减弱——这些公司可能在一段时间内无法盈利,并导致几位初创公司创始人离职加入科技巨头——但这一投资趋势依然存在。 Gross 在接受采访时表示:“我们来说,身边有理解、尊重和支持我们使命的投资者非常重要,我们的使命就是直指安全的...

相关文章

发表评论

资源下载

更多资源
Mario

Mario

马里奥是站在游戏界顶峰的超人气多面角色。马里奥靠吃蘑菇成长,特征是大鼻子、头戴帽子、身穿背带裤,还留着胡子。与他的双胞胎兄弟路易基一起,长年担任任天堂的招牌角色。

Oracle

Oracle

Oracle Database,又名Oracle RDBMS,或简称Oracle。是甲骨文公司的一款关系数据库管理系统。它是在数据库领域一直处于领先地位的产品。可以说Oracle数据库系统是目前世界上流行的关系数据库管理系统,系统可移植性好、使用方便、功能强,适用于各类大、中、小、微机环境。它是一种高效率、可靠性好的、适应高吞吐量的数据库方案。

Apache Tomcat

Apache Tomcat

Tomcat是Apache 软件基金会(Apache Software Foundation)的Jakarta 项目中的一个核心项目,由Apache、Sun 和其他一些公司及个人共同开发而成。因为Tomcat 技术先进、性能稳定,而且免费,因而深受Java 爱好者的喜爱并得到了部分软件开发商的认可,成为目前比较流行的Web 应用服务器。

JDK

JDK

JDK是 Java 语言的软件开发工具包,主要用于移动设备、嵌入式设备上的java应用程序。JDK是整个java开发的核心,它包含了JAVA的运行环境(JVM+Java系统类库)和JAVA工具。