首页 > 新车性能 > 新车性能 > 测了8款AI搜索后,发现真实与谬误只有一线之隔

测了8款AI搜索后,发现真实与谬误只有一线之隔

发布时间:2024-05-29 17:09:37来源: 15210273549

怎么不让芝士从披萨上滑落?——在酱汁中加入1/8杯无毒胶水。”“怀孕时抽烟怎么样?——医生建议怀孕期间每天抽2-3根烟。” 就在最近的开发者大会上发布AI Overviews搜索功能后,谷歌再次翻车了。上一次Bard大模型聊天问答出错,端掉了谷歌近1000亿美元的市值;这一次争议,恐怕会给近期热火朝天的AI搜索市场泼下一场冷雨。

过去几周,搜索成为行业口中的生态入口。非凡产研今年3月的报告显示,AI搜索产品的访问量占据了24.2%的全球市场份额,仅次于AI聊天机器人。赛道领头羊Perplexity的月访问量已经突破六千万,国内的秘塔AI、天工AI以669万和184万的访问量领先。

不过在21世纪经济报道对秘塔AI、天工AI、360AI、百度简单搜索、Perplexity、Bing Copilot、YouAI、Phind 8款AI搜索产品的测试中,尽管它们很少出现“幻觉”,但一旦面对各说各话的搜索结果,输出答案会陷入混乱,并且让人更加难以分辨真实性。在一位负责AI搜索的大厂开发人员看来,AI搜索的瓶颈并不在于大模型,而在于投喂的搜索结果。AI搜索能提供多大程度的更优质回答,成长性有多高,或许需要打上一个问号。

专补大模型短板
一位从事行业研究工作的人士表示,天下“苦中文搜索引擎久矣”,结果相关度低、弹窗广告多、被诱导下载其他软件……根据该行研人士的体验,目前的AI搜索产品能够筛选互联网信息,自动生成思维大纲,适合用来完成复杂且而且一定发散性的工作。

早期许多人也想把ChatGPT当搜索引擎用,但劝退之处是ChatGPT容易“不懂装懂”,而AI搜索一定程度上克服了这一点。

譬如,21世纪经济报道向ChatGPT和AI搜索产品同时抛出一个问题,“意大利作家埃莱娜·费兰特为什么离婚?”这是一个注定没有答案的问题,埃莱娜·费兰特是目前文坛最神秘的作家,真名、婚姻、照片没有公开说明。

对于这条提问,GPT-3.5的回答真假参半:先是编造了费兰特与一名不存在的作家达尔波的婚姻史,然后再解释自己不知道离婚原因。

而测试的8款AI搜索产品均直接承认,没有相关的搜索结果,并以角标的形式在结尾附上参考信源,可以点进原链接核查真实性。信源数量上,以Perplexity为代表的国外AI搜索产品大多在终端呈现5~6条信源,而以360AI搜索为例的国内AI搜索通常会附加20~30条信源链接。


一位负责AI搜索的大厂开发人员向记者解释,之所以不会“胡说八道”,主要因为大模型被严格限制,只能基于搜索结果生成回答。此外,大模型每一轮训练周期长,注定没法动态更新数据,结合搜索结果相当于外挂了一个知识库,提供额外的信息输入。

从技术角度看,该开发人员表示,本质上AI搜索相当于能联网的AI,核心技术架构都是RAG技术(检索增强生成)。这一技术的精髓在于将信息检索和内容生成两个步骤巧妙结合:首先访问特定的数据库,检索与用户问题相关的最新信息;随后,将检索信息和用户问题一同作为提示词(Prompt),引导大模型生成回答。业内不少声音认为这是缓解大模型幻觉的最优解,过去一年里,除了GPT3.5,主流的通用大模型基本都开放了联网搜索功能。

“但也不等于能解决幻觉问题。”前述开发人员说,由于AI搜索非常依赖搜索结果,仍然有很大的不可控性。

传言、玩梗、洋葱新闻,AI搜索怎么看?
AI生成虚假信息问题已不是新鲜事。但在AI搜索的场景下,用户明确期待获得可靠信息,并且AI搜索筛选掉了一部分信源、提供看似权威的出处,一旦出错,影响可能更致命。

记者在5月22日用前段时间众说纷纭的一条传言,尝试测试AI搜索的时效性和准确性。“OpenAI什么时候推出了AI搜索?”秘塔AI回答有矛盾的5月9日、5月13日两个发布时间,但没有点出两个日期其实都不对。

天工AI、360AI搜索、简单搜索、Perplexity指出OpenAI没有官方发布AI搜索产品。其中,只有Perplexity引用到了最直接的信息,即Sam Altman在发布会前夕发布的那条推文,“不会发布GPT-5,也不会发布AI搜索引擎。”

新车性能更多>>

连续4个月夺冠的上汽集团,到底有多少含金量? 金标大众如何诠释智能电动时代的“金标准” 销量持续火爆!宝马在欧洲举办新世代iX3大型试驾活动 德国汽车管理中心(CAM)发布《2026年汽车创新报告》,中国车企比亚迪以157分的成绩强势夺魁 汉EV闪充版上市:比亚迪打响中大型轿车“闪充普及战” 2026年北京国际车展的展馆内,当享界S9与S9T两款旗舰车型身披璀璨华彩,以焕然一新的姿态缓缓驶入众人视野时,瞬间点燃了全场的热情。现场的喧嚣与热度,不仅是对这两款重磅新车的聚焦,更是对一个正在悄然改写的豪华车时代的深情见证。 “国家队出线” 岚图央企造车转型案例可圈可点 二代哈弗H9 2026款上市,不是所有越野车都叫“一家人的越野车” “五界”协同发展,为高端智能车发展打了个样 越野驾控升级,二代哈弗 H9 2026款限时17.49万起 左握温暖科技右持卓越品质,传祺要做“家庭美好出行的守护者” 星光730尊享型:8.78万起标配双电门,人民的MPV 向“尚”而行 体系制胜 尚界破局智能电动车下半场 15.49万元起,别克至境E7用42项标配重划家用SUV的价值底线 全链减碳,新世代BMW iX3长轴距版诠释“可持续的豪华” 东风汽车发布“东方风起2030”战略 焕新出发 广汽发布五大核心技术:昊铂GT攀登版5月上市,全车1004颗芯片100%国产 五座新王已就位,岚图泰山X8重新立下大五座的规矩 42.8万元起 坦克700正式上市 主打全域豪华与双动力越野 深蓝 L06 增程版上市,以高性价比破局同级新能源市场 老外开比亚迪车,实用语音控制,被强制学会中文了 奇瑞新燃油战略重磅落子!新瑞虎9上市,限时14.69万元起 红旗天工05/06 800V超充破局补能焦虑,国风美学+全场景智驾,15-20万级纯电标杆实至名归 17.18万元起 红旗天工05/06 800V超充版正式上市 新增云梦银车色 魏牌V9X正式开启预售 预售价区间37.18万-41.18万元 方程豹的 “多元宇宙”大概率会搭载 800V 高压平台与 4C 闪充技术,成为方程豹高性能基因的新载体 大众CEA量产实测车队解析 消费者视角评论 预售11.28-14.28万的银河星耀7,一篇文章搞懂核心竞争力 奥迪A6L e-tron与Q6L e-tron家族携手亮相,豪华电动时代正当时 宝马中国一季度再跌10%,从降价到换帅,新世代车型能否扭转乾坤?