我国科研人员研发出类脑脉冲大模型
记者今天(9月8日)从中国科学院自动化研究所获悉,近日,该研究所李国齐、徐波团队与相关单位合作,成功研发出类脑脉冲大模型“瞬悉1.0”(SpikingBrain-1.0)。
该模型基于团队原创的“内生复杂性”理论构建,在国产GPU平台上完成了全流程训练与推理,显著提升了大模型高效处理极长文本或数据序列的效率和速度,展示了构建国产自主可控的新型(非Transformer)大模型架构生态的可行性。
当前主流的Transformer模型,在处理超长文章或对话时速度会非常慢且成本极高,造成了巨大的资源消耗。可以说,当前大模型的飞速发展,背后是由巨大的资源消耗驱动的。因此,亟须发展一条低功耗高效率的新型大模型路线。
与当前主流大模型架构(Transformer架构)不同,“瞬悉1.0”借鉴大脑神经元内部工作机制,清晰地展示了一条不断提升模型复杂度和性能的新型可行路径。该模型仅需约主流模型2%的数据量,就能在多项语言理解和推理任务中达到媲美众多主流模型的性能。
这是我国首次提出大规模类脑线性基础模型架构,并首次在国产GPU算力集群上构建类脑脉冲大模型的训练和推理框架。其超长序列处理能力在法律与医学文档分析、复杂多智能体模拟、高能粒子物理实验、DNA序列分析、分子动力学轨迹等超长序列任务建模场景中具有显著的潜在效率优势。本次发布的大模型为新一代人工智能发展提供了非Transformer架构的新技术路线,并将启迪更低功耗的下一代神经形态计算理论和芯片设计。
(总台央视记者 帅俊全 褚尔嘉)
关注公众号:拾黑(shiheibook)了解更多
[广告]赞助链接:
四季很好,只要有你,文娱排行榜:https://www.yaopaiming.com/
让资讯触达的更精准有趣:https://www.0xu.cn/

随时掌握互联网精彩
- 1 胜利日的难忘瞬间 7904191
- 2 于朦胧 7809465
- 3 直击河南大暴雨 7712944
- 4 运-20阅兵后再出发!接英雄回家 7617018
- 5 117名韩国女性首次直接起诉美军 7521570
- 6 女子高铁站捡到20万元 7424282
- 7 特朗普盟友遭枪杀 拜登奥巴马发声 7333084
- 8 烧烤店凌晨2点客人满座 老板却睡了 7232638
- 9 结婚22年两子非亲生 男子喊话大儿子 7136005
- 10 女子点的外卖蒸蛋上被写侮辱字母 7043148