火星链 火星链
Ctrl+D收藏火星链
首页 > 加密货币 > 正文

DAM:阿里AI专家交流实录

作者:

时间:1900/1/1 0:00:00

问:阿里大模型的发布节奏,以及大致水平?

答:阿里巴巴达摩院主要来牵头去做大模型的相关的研究和进展,大概是在22年的时候,我们其实就已经发布了我们自己的这种自然语言理解的大模型,一个叫m6,一个叫plug。M6的话基本是能够支持多模态的这种AI模型,比如说文字生成图片,文字生成语音,文字生成视频这种模型,但是我们大模型相比来讲,GPT3.5这种水平在参数量和整体规模上其实还是要小一点。所以在大模型目前我们这种模型可能也就叫做中模型。

达摩院顶层的领导下达了命令,整个团队约有100个人去开始去做相关大模型的迭代和升级,一方面是自己在复现GPT的水平,一方面是要迭代把我们的m6和plug迭代到能够对标到GPT的水平。目前来看根据我们得到的一些反馈,我们自己的这种m6的一些自然语言理解的能力,目前还不能对标到GPT3.5与GPT3.5大约还得有个一年半左右差距。

所以在我们预计今年在下半年云栖大会上的时候,应该会有m6的一些最新的模型的发布或者是进展,可能大概在GPT2.5左右的水平。

语料积累不足。现有的大型语言模型在文本清洗和筛选方面存在一些限制,因此需要对现有模型进行升级和迭代,以适应不同领域的数据需求。例如,要将模型应用于军事、旅游文化、等领域,需要进行更多的数据收集和人工标注,以达到更高的准确性和效率。同时,大型语言模型的成熟也将带来更多的商业机会,例如在天猫淘宝、高德地图等应用中的搜索和客服机器人等领域。此外,如果大型语言模型足够成熟,可能会释放出API,由合作伙伴接入,从而实现生态层面的垄断。

Lido:以太坊测试网Goerli上第二轮Lido节点运营商基于Obol的分布式验证器测试成功完成:金色财经报道,Lido在其官推宣布以太坊测试网Goerli上Lido节点运营商注册运行基于Obol的分布式验证器第二轮测试成功完成,42 名新的节点运营商参与了本轮测试,其中包括个人质押者、社区质押者和其他专业节点运营商,以及当前精选节点运营商集中的12个节点运营商,据悉本轮测试是在第一个Obol测试网试点计划之后进行的,首轮测试中包括了参与Lido的11个现有节点运营商。第二轮测试的目标是通过 Lido 注册中心与社区质押者一起试运行分布式验证器,并模拟利用Obol技术实际小规模初始实施分布式验证器的情况,此外本次参与试验的集群包括:Quadforce、Group2 Guardians、Dvt2-g3、Group 4、Group 5 Rangers、SevenNodes、Group 7、Clustery McClusterfaces、Group9 Hunter和Mostly Harmless。[2023/7/9 22:26:22]

问:预计阿里大模型与文心一言对比?同时您认为制约我们大模型发展的是最主要是这个语料,还是模型一开始的这种路径偏离,您认为哪一个是制约我们发展的一个最重要的原因??

苹果公司:Damus调整zaps功能后可留在App Store:6月14日消息,苹果公司表示,它与基于Nostr协议的开放社交应用Damus进行了交谈,并就Damus的zaps功能如何在该平台上生存达成了共识。苹果公司称,“我们已经与该开发人员交谈,解释他们如何解决这个问题,并确认他们可以在下一次更新中解决这个问题。”

Damus创作者William Casarin也在Damus应用程序上发布了消息,解释了zaps将如何改变。Casarin称,“目前,用户可以通过‘note’底部的闪电按钮给其他人打赏,苹果希望取消这一功能,但它将允许Damus用户在他们的个人资料上相互打赏。Damus可以在个人资料上保留zap按钮,但不能保留‘note’。如果它在‘note’上,会被认为是“销售数字内容”。Damus随后在推特上发布了另一条推文,称这一变化“削弱”了平台优势。

此前消息,Damus发推称,将在14天内从苹果App Store下架。Apple表示不允许在其平台上出现zaps功能,因为zaps“可能”会被内容创作者用来销售数字内容。[2023/6/14 21:35:36]

答:我们认为百度做得虽然不是那么智能,但还是相当不错的。在国内,它可能算是第一名。我们认为它还有很大的提升空间。文心一言虽然有一定的实用性,但离达到GPT-3水平还有一定差距。不过,我们觉得它至少可以达到GPT-2.5水平,如果未来能够持续迭代和优化,可能会达到GPT-3.5的水平。数据积累对于百度来说是一个优势,尤其是在搜索领域。百度在知识库方面有很多年的积累,包括百度知道等。与文心一言不同,其模型架构基于Transformer,而文心一言则基于Bert。如何在文心一言的基础上实现更智能的迭代,可能是一个挑战,需要达摩院的同学来解决。

比特币矿工日均费用收入升至70 BTC,约合180万美元:金色财经报道,区块链分析公司Glassnode最新数据显示,Ordinals NFT协议和BRC-20代币对比特币矿工费用和收入增长的影响仍在继续,比特币矿工费用仍在继续上涨,目前支付给矿工的日均总费用已经达到70 BTC,约合180万美元,而在Ordinals和BRC-20代币出现之前矿工日均收入仅约为20 BTC。不过,目前来自手续费的矿工收入占比约为8%,出现了较大幅度下降,因为此前在BRC-20代币需求高峰期这一比例数字曾达到50%。(cryptoslate)[2023/6/5 21:15:24]

问:阿里如何后发追上?会采取怎样的打法?

答:我们可以提供的方案主要有两种,一种是我们推出的模型效果相对较好,可以与集团内部的产品结合,例如天猫、淘宝和高德地图的搜索业务。这将为搜索引擎带来更新的商业模式,并取代以前的商业模式。此外,我们还可以输出我们自己的API,并向合作伙伴或渠道商收费。这些合作伙伴将使用我们的API,并体现出他们的客户,这些客户是从ToC端产生的。大多数客户都有自己的APP和网站,这些客户可以通过他们的APP和网站获取流量。不同的客户可以使用不同的API,这意味着厂商可以在生态系统中形成垄断。目前,已有一些厂商尝试将我们的API集成到他们的产品中,但进展不如预期快。对于我们的API,它们可能会在特定领域上有所帮助,例如电商、搜索和推荐,并带来更好的商业模式。

Web3初创公司zbyte完成1000万美元私募融资:7月12日消息,Web3初创公司zbyte宣布完成1000万美元私募融资,具体融资信息暂未披露。该公司计划利用这笔融资构建基于低代码、无代码(low-code, no-code)接口的去中心化区块链平台,并推出Dapp应用商店。

此外,zbyte还将在今年第四季度推出公共Token ZBYT,加速推动开发人员社区和企业对区块链技术的采用。(Inc42)[2022/7/12 2:08:25]

问:阿里目前AI算力储备情况?

答:阿里国内AI算力储备最多,然后以次为:字节、百度、腾讯。

阿里云现在云上至少应该有上万片的A100了,整体至少能够达到10万片,集团的话应该会是阿里云5倍的这样的一个量级。

达摩院、天猫、淘宝的算力资源都是集团内资源使用。

阿里云这块今年增速会有30-50%。有个别8-9个客户会有复现GPT的需求,提出了大规模AI算力需求,我们以云的方式给。

百度年初紧急下单3000台8卡的A800服务器,2.4万张卡,我预计全年百度会有A-H800共5万张的需求。

阿里云需求不会这么多,去年采购2万多,今年可能采购量会下降。预计云上就1万张左右,其中6000张是H800。此外阿里云也会用到平头哥这种自研的,每年大概3000张去采购。

First Digital Trust完成2000万美元融资,Nogle等参投:5月30日消息,金融服务公司Legacy Trust旗下数字资产托管机构First Digital Trust宣布完成2000万美元融资,Nogle和Kenetic Capital参投。First Digital Trust将利用部分新资金向新加坡、英国和加拿大市场扩张,并为私募股权和数字资产开发二级市场。[2022/5/30 3:50:41]

从除此之外,阿里云也会选择国产芯片的一家,看是否在云上商业化。

问:阿里云采购的哪家国产芯片,为何选择?

答:选择的是寒武纪MLU370,主要是性能基本过关(A100的60-70%),检测合格,态度积极,愿意对接,服务贴身。今年会采购大概2000张的水平,主要用在一些CV等小模型的训练或推理上。寒武纪MLU370没有供货的风险,后续的MLU590也许就会有了。

对于壁仞等,宣传上不错,但拿不到实测的卡,流片大约都是今年4-6月,量产半年后。而且壁仞4月要流片的卡,不能支持FP64,互通带宽不支持8卡,支持最多4卡,采用NVbridge方式,达到180GB水平。8卡用PCIe方式只能做到32GB,弱点显著。

针对海光,我们技术人员也有看好的,参数也足够支撑训练,但可能由于海光因产能等因素,可能更侧重满足国有算力那边的需求。同时,集团层面是否对接,不清楚。

问:海光为何会不给样片测试?出于什么考虑?海光DCU的量应该是够的。

答:海光的话,我们确实没有拿到他的样卡,就是不知道为什么,我们也得知很多国产化的订单他们都中标且供货,但我们跟他对接的时候,好像反正是各种各样的问题,就是没有测起来。

我们内部其实也有一些同学是支持海光深算1号的,但是一方面当时寒武纪还没被拉入黑名单,而海光被拉入了黑名单,然后我们其实也有一定的担心,就是在阿里云上了之后,可能会给自己引火烧身,所以这方面也是我们考量的一个因素。最后反正就没采海光后期的供货,可能也会成问题,这也是我们考量的原因之一。

不知道他们是手头是不是比较重要的这种国产化的项目,或者订单的交付还是没有人力来支持。我们也不是特别知道,可能他们团队也就几百个人吧,就是没有这个时间周期。

总体上,在其他国产AI芯片竞争上,海光好像不是很在意这个云上的这个市场。

问:腾讯大模型的进展?

答:有听到是混元这个模型继续迭代,有大概100人左右做GPT复现以及自我模型迭代。应该会比我们的早,猜测大概8月份会出。但应该只是支持文生文的场景。

问:目前降低算力成本的方式?

答:除了大模型,即使stablediffusion这种文生图模型,也消耗较小。stablediffusion模型一直在优化,以前一个推理任务一张A100、现在降级到一个推理任务一张V100。对于阿里这种巨头而言,V100的存货还是很多的。

同时,还会有一些针对模型的优化,或者加速软件,加快模型训练与推理。

最后,也可以对模型进行降级,降低精准度要求,比如从FP16降级为FP8,。

问:阿里目前对于AI大模型是不计成本的大力投入,还是考虑商业落地稳扎稳打?

答:大概率是稳扎稳打,现在拆分后,都要自负盈亏,压力蛮大的。

ChatGPT的一个推理的任务,大概所需要消耗的这个能力是5张A100在2秒钟之内做一次推理,大规模应用起来成本很高,冲击也很大。

问:华为盘古与昇腾如何看?

答:盘古大模型效果有待考证,并没有明确对标GPT,而是往B端去做。

同时因为受限制,只能用自己的昇腾,虽然昇腾910大概也有A100的70%水平,但算力的限制可能会制约大模型发展。

问:从CUDA兼容性角度,海光与寒武纪如何对比?

答:海光的CUDA兼容性更好,除了海光,其实阿里云产的PPU其实也在一定程度上能够做到CUDA兼容,与NV做绑定。

问:360的大模型如何看?

答:我们了解到,最近360向NV下了上千块A800的货。360语料可能比我们强,但最后能做出什么效果,需要时间验证。

问:目前跑在大模型上面的光模块架构会向英伟达推荐的方向去迭代吗?

答:我们不太会去走英伟达的架构,我们有自己的路线,其他大厂可能会走英伟达路线。

阿里云的公有云的层级上面,目前都是采用了阿里云自研的产品叫做DPU。我们自研的DPU其实现在已经迭代了几乎3.0或4.0的状态,支持双口100GB的水平。

那DPU的功能是用于在云上开发弹性裸金属,因为我们要把服务器做成云上的云服务器中间是有一层虚拟化的开发,那虚拟化之后这个物理机上的资源其实是有一定的损耗,CPU的核心数、内存的容量以及网络的带宽、硬盘的这个存储容量都会有所影响。那之所以搞DPU,是为了把这些虚拟化的资源都ofload到DPU上去,使得我们云上的这种云服务器的资源和线下的这种物理机的资源是整体的资源数量是一模一样的,是没有任何变化的。

那DPU的主要功能是在这里,那我们现在研发的第四代的这个DPU,它里面主要集成了ERDMA的这个能力,这个RDMA就是远程内存直接访问的意思,然后其实是主要应用在HPC的这个场景,然后这个E代表的是elastic,我们叫做弹性RDMA这个东西,那它其实是在以太网的架构下去跑ERDMA。也就是说我们希望在以太网的这个网卡、渲染交换机以及这种集群架构上去跑,类似于高性能计算的这种协议,能够把一些高性能计算的场景支持起来。所以我们大概率在公有云的这个场景,不太会去考量像Nvidia提供的这种集群架构,这是公有云的这个方式,从云上讲不支持,光模块数量没有明显增长,阿里网络架构不会改,光模块的规格也不太会改。

但百度云字节火山云可能会采纳英伟达的架构,取决于数量,目前只采纳300台H800,对应每台服务器9张网卡,每个卡一个线,一个线两个光模块,9张网卡一台服务器是18个光模块,300台是5400个光模块,如果集成架构往上扩,扩1000个节点的话,大概是3倍的增长。

问:看好BAT、字节等哪一个大模型?

答:第一还是百度文心,先发优势,其次可能是字节,因为有数据、有算力、有场景。

标签:GPTDAMAPIUSTCHGPTddam币行情apix币未来能涨到多少钱trustwalletcrypto

加密货币热门资讯
ROOK:利益冲突、项目停滞,ROOK DAO要解散?

ROOKDAO正在讨论解散DAO。用户对项目停滞和缺乏透明度表示担忧。这个提案是将DAO国库资产分配给ROOK持有人,并可能会产生250%的回报.

1900/1/1 0:00:00
BTC:比特币一季度表现远超以太坊,以太坊会补涨吗?

一季度行情即将接近尾声,比特币和以太坊的走势越来越趋同,几乎完全相关。比推终端数据显示,以太坊年初至今(YTD)上涨了50.02%,但比特币却飙升了72.30%,有望创下两年来最佳的季度表现.

1900/1/1 0:00:00
ORBI:长推:关于 Web3 未来三年的想象

注:本文来自@Real_Maxlion推特,MarsBit整理如下:随着zkr/模块化区块链、合约钱包的发展,加上社会传播以及经济发展,几年后.

1900/1/1 0:00:00
ANC:速读美国 CFTC 起诉币安及赵长鹏诉讼要点

原告商品期货交易委员会,一个独立的联邦机构,就其针对被告ChangpengZhao、BinanceHoldingsLimited、BinanceHoldings(IE)Limited、Binan.

1900/1/1 0:00:00
Bixin Ventures: 我们为什么投资 EigenLayer?

区块链被称之为“信任机器”,用户构建网络无需中心化监管机构许可——比特币是一切的起点,它通过PoW共识机制帮助矿工就价值分配达成共识从而创建了一个信任层,一切价值传输发生在这个信任层之上.

1900/1/1 0:00:00
COM:全链之王LayerZero攻略

LayerZero是一种全链互操作性协议,专为跨链传递轻量级消息而设计。LayerZero通过可配置的不信任提供真实且有保证的消息传递.

1900/1/1 0:00:00