模型
-
昇腾赋能 TransMLA:无需重训突破架构壁垒,助力主流大模型高效适配 MLA
MLA(Multi-head Latent Attention多头潜在注意力架构)凭借低秩压缩KV缓存设计,实现长上下文推理的显存与带宽双重优化,其有效性已在 DeepSeek-V2 等模型中得到了验证。但主流预训练模型如LLaMA、Qwen千问等多基于GQA构建,企业已投入大量工程优化,复用MLA需重训,成本极高。为
-
昇思人工智能框架峰会| MindSpore Transformers套件架构升级,实现LLM模型天级迁移,工作量降低85%+
据悉,昇思MindSpore开源社区将于 2025 年 12 月 25日在杭州举办昇思人工智能框架峰会。本次峰会的昇思人工智能框架技术发展与行业实践论坛将讨论到昇思MindSpore大模型套件技术进展与实践,MindSpore Transformers SIG的核心贡献者将在昇思开发者动手实践workshop设立开发者
-
Trainium3 UltraServers正式发布,助力客户更快更省地训练和部署AI模型
北京——2025年12月4日 亚马逊云科技在2025 re:Invent全球大会上,宣布Amazon EC2 Trainium3 UltraServers(下称Trn3 UltraServers)现已正式可用,由亚马逊云科技首款3nm AI芯片驱动,为不同规模的企业提供运行高强度AI训练与推理工作负载的能力,帮助客户更
-
闪迪参展CPSE2025:破解智能家居、无人机与大模型训练的存储密码
CPSE(China Public Security Expo)安防展会,作为全球领先的安防行业盛会之一,每次举办都吸引着全球数以千计的安防科技企业与行业精英。自创办以来,CPSE已成为展示最新安防技术和产品的平台,涵盖了智慧视频、智能安防、公共安全、大数据分析、人工智能等多个领域。展会吸引了来自全球的专业观众和媒体,
-
京东11.11直播技术全面升级,立影3D技术、JoyAI大模型重构沉浸式购物体验
随着京东 11.11 大促的火热进行,京东直播再度升级技术布局,以 “立影 3D 技术”“JoyAI大模型”等创新技术,打破传统直播边界,为用户带来更具沉浸感、趣味性的购物体验,引领直播电商技术创新新方向。 立影 3D 技术:在直播间360° 还原实体货架体验 作为京东全球首发的裸眼 3D 商品营销方案,“
-
人工智能拥抱稀疏化:DeepSeek v3.2-Exp & UCM先后开源助力大模型“轻装上阵”
DeepSeek于9月29日发布V3.2-Exp最新版本,介绍了其稀疏化技术的应用效果,而同样应用稀疏化技术的华为Unified Cache Manager(简称UCM),也在9月30日正式开源上线。稀疏化趋势正从技术探索演变为产业刚需,助力大模型“轻装上阵”。 DeepSeek V3.2-Exp最重要的更新是提
-
亚信科技、阿里云达成“能力中心”合作,联办大模型论坛
9月25日,2025阿里云栖大会期间,亚信科技与阿里云签署合作协议,亚信科技正式成为阿里云“能力中心”。双方共同举办了“打造可持续运营的大模型交付体系”专题论坛,亚信科技执行董事、首席执行官高念书,阿里云智能集团政企事业部副总裁李力,中国经济改革研究基金会理事长石明磊,中国通信标准化协会副秘书长王雪飞,中国信通院云计算
-
破解 AI “安全与性能” 难题!DeepSeek-R1-Safe 基础大模型在华为全联接大会2025正式发布
9 月 18 日,华为全联接大会 2025 在上海盛大开幕。会上,华为技术有限公司与浙江大学联合发布了国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型。在中国工程院院士陈纯、华为昇腾计算业务总裁张迪煊的见证下,浙江大学计算机科学与技术学院院长、区块链与数据安全全国重点实验室常务副主任任奎携手华为
-
小度智能摄像机C800:AI大模型加持,开启“超能感知”新时代
在AI大模型与智能硬件深度融合的趋势下,小度科技持续拓展产品边界。9月17日,小度旗下首款多模态智能摄像机——小度智能摄像机C800 视频通话版正式开售。作为小度在家庭陪伴与看护场景的产品矩阵延伸,该新品不仅是“以AI为核心,硬件为载体”战略的进一步开拓,也标志着小度从语音交互到多模态交互的系统性落地应用。
-
大模型正在为产业发展提供有力支撑
大模型正在为产业发展提供有力支撑
-
昇腾助力中科大团队实现MoE 稀疏大模型并行推理提速超30%
随着人工智能技术的飞速发展,大模型参数量激增。MoE 稀疏大模型因能在提升容量的同时保持训练计算量,成为了当下的研究热点,但推理时的性能瓶颈仍制约着其进一步发展。在此背景下,中国科学技术大学人工智能与数据科学学院执行院长张燕咏率领团队,在中国科学技术大学 鲲鹏昇腾科教创新卓越中心的算力支持下,成功研发出了基于专家选择分
-
腾讯混元3D世界模型1.0-Lite发布:显存降35%,助力开发者轻松构建虚拟世界
8 月 15 日,腾讯宣布推出并开源混元3D世界模型1.0 Lite版,大幅降低显存需求,仅需消费级显卡即可流畅运行,为广大开发者及个人用户带来更便捷易用的3D世界生成体验。 作为业界首个开源且兼容传统CG管线的可漫游3D世界生成模型,混元3D世界模型自7月开源以来备受关注,此次Lite版更新进一步突破显存瓶颈,
-
英伟达新发布Omniverse 库、Cosmos 物理 AI 模型及 AI 计算基础设施,瞄准物理AI的万亿市场
2025 年 8 月12日消息:英伟达宣布推出全新 NVIDIA Omniverse 库和 NVIDIA Cosmos世界基础模型 (WFM),加速机器人解决方案的开发和部署。 这些库和模型由全新 NVIDIA RTX PRO 服务器和 NVIDIA DGX Cloud 提供支持,可帮助开发者在任何地方开
-
手机也能跑大模型,腾讯混元推出多款小尺寸开源模型
8月 4 日,腾讯混元宣布开源四款小尺寸模型,参数分别为 0.5B、1.8B、4B、7B,消费级显卡即可运行,适用于笔记本电脑、手机、智能座舱、智能家居等低功耗场景,且支持垂直领域低成本微调。这四款模型的推出,是腾讯混元大模型持续开源的一大举措,也进一步丰富了混元开源模型体系,可为开发者和企业提供更多尺寸的模型选择。目
-
聚焦大模型训练效率提升 北大依托昇腾突破细粒度混合并行技术
在人工智能大模型迅猛发展的当下,大模型参数和计算量呈指数级增长,大规模深度学习模型的训练离不开多硬件设备的分布式计算。在鲲鹏昇腾科教创新卓越中心的算力支持下,北京大学计算机学院崔斌教授团队创新研发了面向大模型的高效分布式训练框架,大幅提升了大规模分布式训练模型的效率。 针对模型训练任务的多样性和复杂性所带来的负载






