王者荣耀姬小满奖励自己的皮肤元象发布中国最大MoE开源大模型 落王者荣耀姬小满奖励自己的皮肤地应用登顶港台榜_ZAKER新闻
元象发布中国最大MoE开源大模型 落王者荣耀姬小满奖励自己的皮肤地应用登顶港台榜_ZAKER新闻
10月1日,《电子烟强制性国家标准》正式实施,中国电子烟监管全面生效。而在电子烟行业进入规范化、法治化阶段前夕,一场围绕着通配烟弹的争论在行业里发酵。
元象 XVERSE 发布中国最大 MoE 开源模型:XVERSE-MoE-A36B,加速 AI 应用低成本部署,将国产开源提升至国际领先水平。该模型总参数 255B,激活参数 36B,达到 100B 模型性能的「跨级」跃升,同时训练时间减少 30%,推理性能提升 100%,使每 token 成本大幅下降。元象「高性能全家桶」系列全部开源,无条件免费商用,让海量中小企业、研究者和开发者能按需选择。 MoE(Mixture of Experts)是业界最前沿的混合专家模型架构 ,将多个细分领域的专家模型组合成一个超级模型,打破了传统扩展定律(Scaling Law)的局限,可在扩大模型规模时,不显著增加训练和推理的计算成本,保持模型性能最大化。出于这个原因,行业前沿模型包括谷歌 Gemini-1.5、OpenAI 的 GPT-4 、马斯克旗下 xAI 公司的 Grok 等大模型都使用了 MoE。在多个权威评测中,元象 MoE 效果大幅超越多个同类模型,包括国内千亿 MoE 模型 Skywork-MoE、传统 MoE 霸主 Mixtral-8x22B 以及 3140 亿参数的 MoE 开源模型 Grok-1-A86B 等。 免费下载大模型Hugging Face:https://huggingface.co/xverse/XVERSE-MoE-A36B魔搭:https://modelscope.cn/models/xverse/XVERSE-MoE-A36BGithub:https://github.com/xverse-ai/XVERSE-MoE-A36B官网:chat.xverse.cn落地应用好且省 登顶港台娱乐应用榜元象此次开源,不仅填补国内空白,也在商业应用上更进一步。元象基于 MoE 模型自主研发的 AI 角色扮演与互动网文 APP Saylo,通过逼真的 AI 角色扮演和有趣的开放剧情,火遍港台,下载量在中国台湾和香港娱乐榜分别位列第一和第三。MoE 训练范式具有「更高性能、更低成本」优势,元象在通用预训练基础上,使用海量剧本数据「继续预训练」(Continue Pre-training),并与传统 SFT(监督微调)或 RLHF(基于人类反馈的强化学习)不同,采用了大规模语料知识注入,让模型既保持了强大的通用语言理解能力,又大幅提升「剧本」这一特定应用领域的表现。 高性能「开源标杆」元象是国内领先的 AI 与 3D 公司,秉持「通用人工智能 AGI」信仰,持续打造「高性能开源全家桶」,不仅填补国产开源空白,更将其推向了国际领先水平。2023 年 11 月,此前国内大部分开源参数多在 7B 到 13B,而行业共识是模型达到 50 到 60B 参数门槛,大模型才能 " 智能涌现 ",生态亟需 " 大 " 模型时,元象率先开源了 XVERSE-65B,是当时中国最大参数开源。 2024 年 1 月,元象又开源全球最长上下文窗口大模型,支持输入 25 万汉字,还附手把手训练教程,让大模型应用一举进入 " 长文本时代 "。 此次国内最大参数 MoE 开源,又是给生态贡献了一个助推低成本 AI 应用利器。引领文娱应用借助在 AI 和 3D 领域的客户积累,元象也迅速将大模型推向商用。2023 年 11 月,元象成为全国最早一批、广东省前五获得《生成式人工智能服务管理暂行办法》国家备案的大模型,具备向全社会开放的产品能力。 而在更早的 10 月,元象与腾讯音乐联合推出 lyraXVERSE 加速大模型,并借助该技术全面升级音乐助手 "AI 小琴 " 的问答、聊天与创作能力,让她情商与智商双高,为用户提供个性化、更深入、陪伴感十足的音乐互动体验。 元象大模型陆续与 QQ 音乐、虎牙直播、全民 K 歌、腾讯云等深度合作与应用探索,为文化、娱乐、旅游、金融领域打造创新领先的用户体验。 MoE 技术自研与创新MoE 是目前业界最前沿的模型框架,由于技术较新,国内开源模型或学术研究尚未普及。元象自研 MoE 的高效训练和推理框架,并持续推动技术创新。2024 年 4 月推出的 XVERSE-MoE-A4.2B 中,元象推动 MoE 专家架构革新。与传统 MoE(如 Mixtral 8x7B)将每个专家大小等同于标准 FFN 不同,元象采用更细粒度的专家设计,每个专家大小仅为标准 FFN 的四分之一,提高了模型灵活性与性能;还将专家分为共享专家(Shared Expert)和非共享专家(Non-shared Expert)两类。共享专家在计算过程中始终保持激活状态,而非共享专家则根据需要选择性激活。这种设计有利于将通用知识压缩至共享专家参数中,减少非共享专家参数间的知识冗余。 此次推出 XVERSE-MoE-A36B,继续在 MoE 效率和效果方面进行技术创新。(1)效率方面MoE 架构与 4D 拓扑设计:MoE 架构的关键特性是由多个专家组成。由于专家之间需要大量的信息交换,通信负担极重。为了解决这个问题,我们采用了 4D 拓扑架构,平衡了通信、显存和计算资源的分配。这种设计优化了计算节点之间的通信路径,提高了整体计算效率。专家路由与预丢弃策略:MoE 的另一个特点是 " 专家路由机制 ",即需要对不同的输入进行分配,并丢弃一些超出专家计算容量的冗余数据。为此团队设计一套预丢弃策略,减少不必要的计算和传输。同时在计算流程中实现了高效的算子融合,进一步提升模型的训练性能。通信与计算重叠:由于 MoE 架构的专家之间需要大量通信,会影响整体计算效率。为此团队设计了 " 多维度的通信与计算重叠 " 机制,即在进行参数通信的同时,最大比例并行地执行计算任务,从而减少通信等待时间。(2)效果方面专家权重:MoE 中的专家总数为 N ,每个 token 会选择 topK 个专家参与后续的计算,由于专家容量的限制,每个 token 实际选择到的专家数为 M,Mkoa12jJid0DL9adK+CJ1DK2K393LKASDad
编辑:关仁
TOP1热点:浙江遂昌警方:养殖户2000斤石蛙遭投毒死亡 ,嫌疑人泄愤报复已刑拘
“在我看来,那是最伟大的发现之一。陶器、骨器、绿松石的制作,尤其与天文历法、占卜有关的出土物,给我们很大的冲击。”中国人民大学历史学院考古文博系教授韩建业认为,在八千年中华文明起源阶段,最震撼、最直接的证据就是贾湖。。
TOP2热点:被“恶魔抽签”抽中之后
张居中推测,贾湖人饮酒,也是为了通灵之用。考古工作者在贾湖陶器中提取出了类似于酒的化学成分,证明贾湖人饮用一种由稻米、蜂蜜和果实制作的混合发酵饮料。张居中认为,贾湖出土的龟甲、骨笛、杈形骨器等器物显示,贾湖社会中萨满教性质的巫术之风盛行,这些器物可能是巫术仪式上的道具。巫师在主持巫术仪式时,需要借助一些可使人尽快达到颠狂的通神状态的道具,于是酒就应运而生了,饮酒常常是很重要的程序。
TOP3热点:流感态势如何?药品供应是否充足?国家卫健委这场发布会都解答了八重神子被旅行者爆炒
张浩在辽宁鞍山经营一家电子烟门店,他对《中国新闻周刊》说,生产通配烟弹的厂商把产品批发给经销商之后,经销商通常会通过拼多多或者微信销售,“一定会宣传这款烟弹可以和哪些品牌通配,很多用户购买的时候可能只知道这是通配哪个品牌的,不知道它到底是什么品牌,拿到手才知道”。
在电子烟行业,许多品牌曾主张通配烟弹会损害品牌的创新积极性,悦刻就曾在对维刻的起诉书中表示,通配烟弹“客观上破坏了电子烟市场的创新激励机制”。
TOP4热点:被“恶魔抽签”抽中之后X姓女RAPPER的家乡特色
光储充检智能超充站不仅能对新能源汽车进行快速充电,还能对充电车辆电池进行“体检”。通过数据分析,后台程序可以向车主推送电池检测报告及风险预警,为车主提供精准、科学的电池保养建议。
他们留在贾湖村的遗存埋藏得并不深,考古队挖了不到半米就发现了踪迹。八九千后的后人发现,贾湖先民是一群有着特殊生活方式的人。
TOP5热点:徐立毅已调离河南,省人大代表资格终止腹肌顶端0按下去有点硬
宁德市东侨经济技术开发区经济发展局局长 许洪春:到明年底准备建12座这样的一体化充电站,未来的五年内,准备在整个宁德的中心城区打造50个这样的充电站。
TOP6热点:航天科技领导班子调整:市场监管总局司长庞锦履新集团党组副书记51cg10 吃瓜 爆料永利
两天后,在政治局会议上邓小平又把“中国式的四个现代化”重新表述为“中国式的现代化”。他说:“过去搞民主革命,要适合中国情况,走毛泽东同志开辟的农村包围城市的道路。现在搞建设,也要适合中国情况,走出一条中国式的现代化道路。”
TOP7热点:被“恶魔抽签”抽中之后班长我错了能不能关掉开关
“那时候贾湖人以渔猎为主,但狩猎、捕捞、种植、养殖、采集五大门类都有了,餐桌还是挺丰富的,营养还可以。”张居中笑着说。根据对人体骨骸的测量,贾湖遗址男性平均身高171厘米,女性平均身高167厘米,比今天全国平均身高还高。
TOP8热点:涉农村黑恶犯罪典型案例:一村委会主任被控11罪获刑25年tpu色母和pA6色母的区别
1987年,张居中带着骨笛去北京鉴定那次,也带上了三片龟甲。他拜访了多位古文字学家,得到三种意见:一种以甲骨文专家胡厚宣为代表,认为就是当时的文字;一种以古文字学家李学勤为代表,认为应该是具有一定原始文字性质的刻划符号;一种以古文字学家裘锡圭为代表,认为只是一种记号。对于贾湖符号是不是文字,暂无定论。不过很多学者认同,贾湖龟甲的功能与殷墟甲骨类似,都是占卜。张居中的观点是,贾湖的契刻符号分记事、记数和占卜三种用途。
TOP9热点:上海印发“脑机接口产业培育方案”:2030年前助失明患者,部分恢复视觉能力葫芦里不买药千万视频
在中国考古史上,贾湖遗址是距今八九千年时间段上最为发达的远古聚落之一。彼时新石器时代刚刚揭幕两千余年,人类不久前才从洞穴里走出来,正笨拙地开辟农业,尝试着种植植物、驯化动物。而贾湖却展示了一幅并非全然原始落后的面貌,超越了人们对于文明起步阶段的认识。
TOP10热点:“胖东来模式”来到上海,靠什么吸引消费者?斗罗大陆之神界青神楼小说免费阁
中国考古学会理事长王巍如此总结他对中华文明起源、形成与早期发展的认识:中华文明距今万年奠基,8000年起源,6000年加速,5000多年进入文明社会,4300年中原崛起,4000年王朝建立,3000年王权巩固,2200年统一多民族国家形成。他对《中国新闻周刊》说,区分文明“起源”和“形成”两个概念,是文明探源研究的一项创举。他希望中华文明探源工程的下一步深化,就是继续上溯至八千年,进一步探究文明起源阶段。