首创AI芯片新架构 中星微成功实现单芯片运行通用大模型

【导语】4月30日,中星微在数字中国建设峰会上宣布,其最新AI芯片“星光智能五号”成功运行DeepSeek大模型,成为首款全自主可控、能同时运行通用语言和多模态大模型的AI芯片。该芯片支持本地化部署和嵌入式应用,突破算力瓶颈,可更好地服务于数字(zì)中(zhōng)国(guó)建(jiàn)设(shè)和新质生产力发展。通过采用多核异构GP-XPU新架构,“星光智能五号”实现了算力与存储资源的高效利用,推动端侧、边缘侧智能化升级,大幅减少对云端算力资源的依赖,并保障数据安全。

首创AI芯片新架构 中星微成功实现单芯片运行通用大模型

4月30日,中星微在第八届数字中国建设峰会上宣布,采用其首创多核异构GP-XPU新架构的最新AI芯片“星光智能五号”已成功运行DeepSeek 7B/8B/16B大模型,成为首款全自主可控、可单芯片同时运行通用语言大模型和“万物识别”多模态大模型的AI芯片。该芯片可支持本地化部署和嵌入式应用,通过8颗芯片级联并行计算,可支持“满血版”671B参数DeepSeek大模型及其它多模态大模型运行,突破本地化端侧算力瓶颈限制,可更好服务于数字中国建设和新质生产力发展。

据介绍(shào),“星(xīng)光(guāng)智(zhì)能五号”通过采用GP-XPU架构,集成高性能的RISC-V CPU、GP-GPU、NPU,以及面向智能感知领域的图像信号处理器(ISP)、视频编解码器(VPU)、加解密处理器(ECU)等多核心模块,通过专用的HCP(异构计算池)任务调度单元和安全内存管理系统,实现多异构内核之间的算力与存储资源的实时调度与动态共享,大幅提升了算力利用效率和数据吞吐率,从而首次实现了在单芯片上部署运行DeepSeek 1.5B、7B、8B、16B等通用大模型及视觉大模型的能力。

在仅约一张名片大小的处理板中,单颗“星光智能五号”既满足复杂场景下的视频实时检测、识别与跟踪需求,又能实现自然语言处理、任务规划、知识管理、自动控制等(děng)智(zhì)能(néng)体(tǐ)功(gōng)能(néng);通过8颗芯片联合部署,能够支持“满(mǎn)血(xuè)版(bǎn)”671B参(cān)数(shù)DeepSeek大(dà)模(mó)型(xíng)和(hé)视(shì)觉(jué)大(dà)模(mó)型(xíng)运(yùn)行(xíng),彻(chè)底(dǐ)打(dǎ)破(pò)边(biān)缘(yuán)端(duān)算(suàn)力(lì)瓶(píng)颈(jǐng)。

中(zhōng)星(xīng)微(wēi)技(jì)术(shù)CEO张(zhāng)韵(yùn)东(dōng)介(jiè)绍(shào),“星(xīng)光(guāng)智(zhì)能(néng)五(wǔ)号(hào)”将(jiāng)推(tuī)动(dòng)端(duān)侧(cè)、边(biān)缘(yuán)侧(cè)智(zhì)能(néng)化(huà)升(shēng)级(jí),大(dà)幅(fú)减(jiǎn)少(shǎo)对(duì)云(yún)端(duān)算(suàn)力(lì)资(zī)源(yuán)的(de)依(yī)赖(lài),节(jié)省(shěng)系(xì)统(tǒng)建(jiàn)设(shè)成(chéng)本(běn),探(tàn)索(suǒ)了(le)一条符合中国国情的人工智能技术路线。

据了解,传统依赖云端的AI推理流程常面临响应延迟大、成本高、受制于网络环境等问题,而该芯片通过本地化算力与内生安全机制,使大模型推理可直接在边端侧内完成闭环,既节省了云端传输与存储成本,同时极大提升了响应速度,可实现毫秒级响应,同时以信源级密码机制保障数据全生命周期安全。

邮箱:sales@sannengdianqi.com

电话:021-2658 3069

友情链接 集成电路有限公司 - 官方网站入口