苏姿丰:AMD RX 9070 XT 显卡首周销量历史最佳,比上代增长 10 倍库克再次现身苹果三里屯零售店阿里蔡崇信:数据中心建设领域需警惕可能正在形成潜在的泡沫苹果首席运营官杰夫.威廉姆斯:中国是特别重要的市场,将继续进行大规模投资美团 CEO 王兴再次减持理想汽车股权,四个交易日套现约 7 亿港元云服务商 GoDaddy 曝光黑客利用 DollyWay 恶意软件劫持 WordPress 站点,波及 2 万网站中消协建议消费者“非必要不开启免密支付”,易成不法分子盗刷漏洞比亚迪2024年收入7771亿元,已布局AI机器人业务透视地平线2024财报:业绩高增长,智驾平权的“幕后推手”日本七大车企业绩持续下滑?日系车这到底是怎么了?“最强”小米,不够“惊喜”快手公布2024年成绩单:全年经调整净利润同比增长72.5%积木易搭携智慧文博整体解决方案亮相2025新疆旅交会暨第二届新疆博博会,全面助力文博机构数字化升级突破大厂封锁,中小游戏团队靠AI逆袭?Cloudflare 推出 AI Labyrinth 功能:以 AI 生成内容对抗 AI 爬虫福州地铁联合支付宝推出同行乘车码服务,1 部手机同一账号可供 3 人刷码过闸首款天玑9400+高性价比机型!真我GT7最快4月登场OPPO Find X8 Ultra参数出炉:最强2K直屏Ultra手机勇闯电竞圈,小红书急于拓宽的边界格力称从未生产和销售999元电动车 目前没有相关业务规划
  • 首页 > 产经新闻频道 > 业界新闻

    GPT-4在图灵测试中成功率超过41%,人类保持在63%

    2023年11月27日 15:02:36   来源:中文科技资讯

      近期,Jones和Bergen进行了一项关于GPT-4在图灵测试中的研究,结果显示其成功率超过41%。

      这一数字相比于传统的人工智能模型,如ELIZA的27%和GPT-3.5的14%,表现出明显的优势。研究设计了25个不同的语言模型,涵盖了各种GPT的版本,其中包括GPT-4。这些模型使用类似于手机消息应用的界面,并在拼写错误、大小写、延迟等方面引入了小的随机变化。

      图灵测试是通过与人类进行对话,然后判断对方是人类还是人工智能的测试。与原始的图灵测试不同,这项研究的测试设计更简化,要求参与者在最多5分钟的时间内进行对话,每条消息不超过300字符。共有652名人类参与者完成了1810次测试。

      1950年,艾伦·图灵曾预测,到了他认为的未来50年,计算机将具备足够的存储能力,以70%的概率“欺骗”人类。然而,研究表明,即使到了现在,GPT-4等模型也未达到这一水平,最高成功率仅为41%。

      有趣的是,研究指出GPT-4是付费版本,而GPT-3.5则是免费版本。这表明,付费版本在测试中表现更好,凸显了技术进步对结果质量的影响。

      人工智能在图灵测试中取得的进展令人印象深刻,但与人类63%的成功率相比,仍有改进的空间。这一研究进一步探讨了人工智能的发展趋势,揭示了技术的潜在局限性。

      文章内容仅供阅读,不构成投资建议,请谨慎对待。投资者据此操作,风险自担。

    [No. H002]
    分享到微信

    即时

    新闻

    明火炊具市场:三季度健康属性贯穿全类目

    奥维云网(AVC)推总数据显示,2024年1-9月明火炊具线上零售额94.2亿元,同比增加3.1%,其中抖音渠道表现优异,同比有14%的涨幅,传统电商略有下滑,同比降低2.3%。

    企业IT

    重庆创新公积金应用,“区块链+政务服务”显成效

    “以前都要去窗口办,一套流程下来都要半个月了,现在方便多了!”打开“重庆公积金”微信小程序,按照提示流程提交相关材料,仅几秒钟,重庆市民曾某的账户就打进了21600元。

    3C消费

    华硕ProArt创艺27 Pro PA279CRV显示器,高能实力,创

    华硕ProArt创艺27 Pro PA279CRV显示器,凭借其优秀的性能配置和精准的色彩呈现能力,为您的创作工作带来实质性的帮助,双十一期间低至2799元,性价比很高,简直是创作者们的首选。