谷歌的下一款ChatGPT竞品,是它

2023-06-28 08:56:49 | 来源:AppSo

ChatGPT 的大火,可把 Google 急坏了。


(资料图片)

要知道 ChatGPT 中的“T”表示的是 Transformer 模型,出自于 Google 研究团队,而现在这一技术在竞争对手 OpenAI 的手上发光发热,这令 Google 颇感尴尬。

为应对这一挑战,Google 迅速推出了自己的聊天机器人Bard,并且开始整合 AI 资源,合并了两大研究团队 Google Brain 和 DeepMind,创建了 Google DeepMind,由 DeepMind 原 CEO Demis Hassabis 领导。

Hassabis 表示 Google 有 80% 或 90% 的 AI 创新都出自于这两个团队。

在 上个月的 Google I/O 大会上,Google CEO Sundar Pichai 官宣了一个重磅消息:Google DeepMind 正在研究一个全新的大语言模型,代号为 Gemini,这也是这两只团队合并后首次合作的项目。

近日,Demis Hassabis 在接受 Wired 的采访了透露了更多与 Gemini 有关的消息,这可能是 Google 向 OpenAI 反击的关键战役。

正在追赶的 Google

此前大家猜测,Gemini 和 GPT 模型类似,都是有着出色文本处理能力的大语言模型,两者的差异可能会体现在训练参数的规模上,模型规模越大,处理能力可能就会越强。

然而 Hassabis 表示,Gemini 有很多不太一样的地方,例如 Google DeepMind 团队正在将 AlphaGo 中使用的技术结合语言模型,以赋予更强的规划或解决问题能力等等。这可能会成为 Gemini 的“杀手锏”技能。

抽象点说,你可以将 Gemini 看作是将 AlphaGo 型系统的一些优点与大模型的语言能力相结合。我们还有一些新的创新,这将非常有趣。

2016 年,横空出世的 AlphaGo 击败了围棋冠军李世石,让全世界第一次真切地感受到 AI 技术的震撼。

AlphaGo 的技术基于一种名为“强化学习”的训练方法,通过反复试验和反馈来学习如何解决问题,它还使用了一种称为树搜索的方法,探索并记住可能的走法。

Google DeepMind 团队希望将这些技术应用到语言模型中,使它们能够在互联网和计算机上执行更多任务。

DeepMind 在机器学习和强化学习有着丰富的经验,开展过多项重要的研究,包括:

AlphaGo:第一个击败人类世界冠军的围棋程序。AlphaGo的成功标志着AI在处理复杂策略游戏方面的重大突破。

AlphaZero:AlphaZero 是一个通用的强化学习算法,可以在没有任何先验知识的情况下,仅通过自我对弈学习如何玩棋类游戏。AlphaZero已经证明了其在国际象棋、将棋和围棋等游戏中的超强实力。

AlphaFold:AlphaFold 是一个可以预测蛋白质结构的深度学习系统。这个系统的准确性在生物学领域引起了广泛关注,因为它可以帮助科学家更好地理解疾病,并加速药物的发现和开发。

WaveNet:WaveNet 是一个深度生成模型,用于生成自然 sounding 的语音。它已经被广泛应用于语音合成和音乐生成等领域。

MuZero:MuZero 是一个无模型强化学习算法,它可以在没有环境模型的情况下,通过预测其动作的结果来学习策略和价值函数。MuZero 已经在多个任务和游戏中表现出了超强的性能。

DeepMind 在强化学习方面的深厚经验,可能会为 Gemini 带来超越 ChatGPT 的新能力。

Hassabis 表示,Gemini 模型仍在开发中,这个过程将需要几个月的时间,可能花费数千万或者上亿美元。作为对比 OpenAI CEO Sam Altman 在四月份表示,创建 GPT-4 的成本超过了 1 亿美元。

Gemini 不仅仅是对 ChatGPT 做出的防御之举,还将是 Google 未来部署搜索等产品的技术基础。

Hassabis 表示,AI 的非凡潜在益处,例如健康或气候等领域的科学发展,人类必须不停地发展这项技术。如果运用恰当的话,AI 将是对人类最有益的技术。

“我们必须大胆且勇敢地去追求那些东西。”他说。

Google 不为人知的“护城河”

在 AI 研究方面,Google 还有一张盖住的王牌——全球最大的视频网站 YouTube。

视频是个非常多元的内容载体,我们可以把它分解成图像、音频和文字记录。Google 拥有 YouTube,也就意味着拥有最丰富的图像、音频训练内容。

根据 The information 报道,有内部人士透露 OpenAI 早已经悄悄地使用 YouTube 上的内容来训练其人工智能模型。

Google 自然不会忽视这座“金山”,The Information 继续爆料称 Google 的研究团队也在利用 YouTube 训练 Gemini 模型,并且 Google 能够比竞争对手们获得更完整的内容数据。

对于大语言模型来说,高质量的训练数据比黄金还要宝贵。

由于 YouTube 很多都是真实的对话,Google 可以利用 YouTube 视频的音频文本或描述作为训练 Gemini 的另一个文本来源,从而提高它的语言理解能力,并产生更加真实的对话反馈。

利用 YouTube 的视频内容,Google 还可以开发出类似于 Runway 用文本生成视频的多模态功能,用户只需要输入他们的描述就能生成出一条精美的视频。

除了制作视频,多模态模型还可以有更多的可能性,例如可以根据 YouTube 视频直接总结出球赛的亮点,或者根据视频帮助机械师诊断汽车修理问题。

OpenAI 在发布 GPT-4 模型时,曾展示过从草图生成网站代码的功能,这也是多模态模型的一个重要应用领域。

前 YouTube 高管 Shishir Mehrotra 表示,对 Google 来说,YouTube 视频简直就是一座数据金矿。

这不仅仅是因为视频的存在,而是因为视频存在于一个生态系统中。

YouTube 上的视频向 AI 展现了人类是如何进行对话,这和书面化的文本有很大的不同,可以帮助模型更好的理解人类对话的逻辑,并生成更恰当的反馈。

不仅如此,Google 还收集大量的用户互动数据,清楚用户对视频的哪些部分最感兴趣、哪些部分容易跳出、哪些内容会吸引用户评论等等。

据统计,YouTube 每分钟就有 500 小时的视频上传到网站上,Google 可以说是坐在了一座会源源不断生产金子的金山上,这或许会成为 Google 真正的护城河。

多模态才是未来

随着多模态模型越来越受到重视,未来会有更多的开发人员选择用视频训练语言模型。AI 教父、Meta AI 首席研究员 Yann LeCun 在近日一条推文中称:“通过视觉学习世界如何运转的系统,将对现实有更深刻的理解”,并称赞了 Meta 在这一领域的研究成果。

著名风投机构 A16Z 在最近采访了四家明星 AI 公司 AnthropicAI、Cohere、Character AI、AI21Labs 的 CEO 和创始人,探讨出生成式 AI 当前最需要突破的四个方向,分别是操控、记忆、四肢和多模态。

这四项关键创新将主导 AI 在未来 6-12 个月的发展,这也会影响公司和开发者改变构建产品的方式。

Cohere 的 CEO Aidan Gomez表示,AI 系统的能力终究是有限的,因为并非所有的内容都是文本形式,因此多模态能力对于大语言模型来说是个重要的发展方向,像 GPT-4、 Character.AI 和 Meta 的 ImageBind 等模型已经在处理和生成图像、音频等内容。

“我们现在的模型确实是字面意义上的‘盲人’,这需要改变。”Aidan Gomez 在采访中总结道。

多模态模型能够极大地拓宽 AI 的应用场景,例如可以用在自动驾驶汽车或其他需要与物理世界实时交互的场景上。此前,Google 在 I/O 大会发布的 Med-PalM-2 模型便展示过可以分析 X 光照片的能力。

这也让人更加期待,更强大的 Gemini 能在多模态领域给我们带来多大的惊喜。现在看来,暂时取得领先的 OpenAI,远没有到停下来休息的时刻。

上一篇 下一篇

相关新闻

谷歌的下一款ChatGPT竞品,是它

完美世界83集预告,石昊第二块至尊骨生,神秘美女登场官方已打码

聚焦全域党建引领高效能治理 松江九里亭发布三年行动方案

ET5 Touring引人瞩目 可蔚来还是更需要一款“Model Y”|每日短讯

当前关注:宿迁筑梦文化传媒有限公司(关于宿迁筑梦文化传媒有限公司介绍)

湖南省卫健委健教中心:夏季防暑常识请查收_天天讯息

国内废钢价格稳中窄幅上行|环球微动态

钱江摩托:6月26日融券卖出金额2.84万元,占当日流出金额的0.07%_全球短讯

电磁炉上市公司龙头名单是哪些?(2023/6/27)

父母失信孩子不能上大学?权威回复:假的 只限制上贵族学校 要闻

最新资讯:iPhone15Plus提前了解,大屏灵动岛,影像对标iPhone14Pro Max

2022年以来内蒙古共破获毒品刑事案件389起-天天快播

国铁集团:端午5天全国铁路送客逾7000万

每日观察!助力粤港澳大湾区建设 乌东德水电站累计发电量破1000亿千瓦时

今日看点:工行淮安洪泽人民路支行:钱断服务不断 饱受客户称赞

最新新闻

谷歌的下一款ChatGPT竞品,是它

两融余额三连降 累计缩水182.38亿元

万马股份临安基地年产16000公里电线电缆项目开工

环球即时看!R7-5800H加持!大唐迷你电脑主机低至1499元

7月3日~7月7日有7只新股将公布中签结果

焦点资讯:影石推出新款Insta360 GO 3相机:35g、2.7K广角拍摄,2298元起

完美世界83集预告,石昊第二块至尊骨生,神秘美女登场官方已打码

西藏东财基金管理有限公司关于西藏东财中证500指数型发起式证券投资基金所持停牌股票估值调整情况的公告

安阳美食餐馆推荐_安阳美食

天天滚动:高招宣讲会上 清华北大“无人问津”:因为成才率中国最差?

留队多赚1.9亿欧!姆巴佩拒绝离开大巴黎,皇马1亿欧签字费拿定了 全球新资讯

【当前独家】预算员的主要工作内容 预算员的工作职责是什么

父子内斗以实控人去世结束?募投项目延期四次仍“难产”,电科院发展面考验|观速讯

聚焦全域党建引领高效能治理 松江九里亭发布三年行动方案

当前快讯:东吴证券:给予领益智造买入评级,目标价位9.3元

2年6000万,加盟勇士!保留仅剩的自尊,但你的争冠之旅依旧艰险

华丰科技上市!长虹控股集团第7家上市公司,绵阳首只科创板股

央行:5月份债券市场共发行各类债券54561.6亿元 当前快讯

今年快递业务量已达600亿件(新数据 新看点)|天天观焦点

每日速看!中国第10批赴马里维和工兵分队通过联合国装备核查

ET5 Touring引人瞩目 可蔚来还是更需要一款“Model Y”|每日短讯

美国货运“龙”飞船将运送科学样本返回地球|环球新动态

仪美医科:智能医疗空间整体解决方案提供商

【透视】美国财政部前高官:维系美国经济强韧的四大支柱,三根已动摇|天天快讯

第12批援巴布亚新几内亚中国医疗队获当地政府表彰-世界时快讯

合金装备:大师合集 Vol.1 实体版公布 环球热文

“爱上北京的100个理由”短视频大赛颁奖典礼在京举行 国际在线《一支画笔绘北京》荣获特等奖_焦点消息

微软考虑收购 Bungie 和世嘉以支持 Xbox Game Pass

特斯拉(TSLA.US)涨势太疯狂 高盛加入泼冷水行列|全球今日报

成“视后”却反被骂上热搜,这一次,51岁不婚不育的吴越,有点冤 焦点速递