推理
-
用动画解锁推理新玩法
导演程腾耗时六年打磨的动画新作《大唐妖探》将于8月22日上映,电影创新性地打造了一座由精妙机关驱动、人妖共存的长安城,讲述天才神探狄少和狼妖捕快阿萨这对“不靠谱”搭档,因一桩离奇命案被迫组队,在笑
-
应对异构芯片部署下的AI挑战,F5助企业推理服务更快、更省、更承压
随着人工智能(AI)大模型及智能体应用在企业端的全面落地,产业竞争的核心维度正发生深刻演变。据统计,截至2026年3月,中国日均词元(Token)调用量已超过140万亿,相比2024年初的1000亿增长超过千倍。这意味着AI已经从早期的模型展示、能力验证,走向以实际调用、成本控制与产业落地为导向的新阶段。 但与此
-
超擎数智获授“ODCC AI存储实验室”, 创新引领大规模推理应用新纪元
4月2日上午,在备受瞩目的2026 ODCC春季全会上,ODCC AI存储实验室授牌仪式正式举行。凭借在AI应用全栈方案领域的技术积累与实践能力,超擎数智获授“ODCC AI存储实验室”,标志着AI存储产业迈向标准化、规模化发展的新阶段。超擎数智总经理唐春峰与中国信通院云大所总工程师、ODCC AI存储实验室联合主任郭
-
华为存储携手中科弘云发布AI推理加速方案破解长序列推理难题
2025 年 12 月 23 日,华为数据存储与中科弘云在上海练秋湖联合举办发布仪式,正式推出 AI推理加速联合解决方案。该方案以华为 OceanStor A 系列存储为数据底座,深度结合中科弘云 HyperCN 智算互联网云服务平台,通过软硬件协同创新,有效提升算力资源利用率、优化长序列推理体验,为 AI推理应用的规
-
国产万卡训练!推理性能突破!摩尔线程新架构“花港”与路线图重磅亮相
2025年12月20日,摩尔线程首届MUSA开发者大会在北京中关村国际创新中心正式开幕。作为国内首个聚焦全功能GPU的开发者技术盛会,大会系统展示了摩尔线程以自主MUSA统一架构为核心的全栈技术成果,全面展现公司在高端全功能GPU领域的关键突破与前瞻布局。本次发布的核心成果包括: 1、新架构“花港”亮相:全功能G
-
昇腾助力中科大团队实现MoE 稀疏大模型并行推理提速超30%
随着人工智能技术的飞速发展,大模型参数量激增。MoE 稀疏大模型因能在提升容量的同时保持训练计算量,成为了当下的研究热点,但推理时的性能瓶颈仍制约着其进一步发展。在此背景下,中国科学技术大学人工智能与数据科学学院执行院长张燕咏率领团队,在中国科学技术大学 鲲鹏昇腾科教创新卓越中心的算力支持下,成功研发出了基于专家选择分
-
北大张牧涵团队依托昇腾突破推理效率瓶颈 大模型推理百万tokens 成本仅 1 元
在人工智能领域,大语言模型的训练与推理成本一直是限制技术普及的关键因素之一。近日,北京大学人工智能研究院助理教授张牧涵团队在鲲鹏昇腾科教创新卓越中心(简称“卓越中心”)提供的算力支持下,成功研发出一套高效的大模型训练推理架构,实现了百万tokens输入成本低至1元,为产业提供了高效能、低成本的解决方案。 此研究成
-
Akamai的Akamai Cloud Inference 将吞吐提升三倍,成本锐减86%
近日,Akamai 宣布推出战略级解决方案Akamai Cloud Inference。这款基于其全球分布式云平台打造的AI推理解决方案,以突破性的性能指标引发行业关注——与传统超大规模云架构相比,其吞吐量提升3倍、延迟降低60%,成本更是锐减86%。 边缘计算重构AI推理范式 在生成式AI应用爆发的
-
推理性能提升13倍,延时缩短超4倍丨实测焱融YRCloudFile KVCache
DeepSeek 引爆大模型在千行百业落地的背景下,存储与计算的协同优化正成为企业提升 AI 推理效率、降低运营成本的关键。KVCache 技术通过“以存换算”的创新模式,显著提升了推理性能,成为企业构建大模型基础设施的必要选择。此前,焱融科技率先推出 YRCloudFile 分布式文件系统的 KVCache 特性,支
-
昇腾大规模跨节点专家并行(大EP)集群推理方案之低时延通信解密
昇腾联合科大讯飞推出业界首个自研算力的推理集群解决方案,使用大规模跨节点专家并行(大EP)策略,将庞大的专家模型拆解为多个子专家,并分配到不同计算节点上独立执行,有效降低了单节点内存要求,实现了更低时延下的更大吞吐量。 然而,这种大EP并行策略,带来了更复杂的推理系统,并对通信时延提出更高要求,尤其表现在跨节点A
-
行业首批!腾讯云TI平台支持DeepSeek全系模型精调与推理
近日,DeepSeek全系列模型在腾讯云TI平台上第一时间上架,并在业内率先实现企业级精调与推理全链路功能。此次支持精调的模型涵盖了满血版DeepSeek V3、R1以及六款蒸馏版模型,为金融、医疗、制造、零售等多个行业提供了更高效、便捷的AI模型构建及应用方案,进一步降低企业在大模型应用中的技术门槛和研发成本。
-
DeepSeek推理型AI尽显高效训练的小模型之威
——在IBM院士Kush Varshney看来,全球AI竞赛中的地缘政治差异,可能没有人们想象的那么重要,他说:
-
英特尔Gaudi 2D可推理DeepSeek Janus Pro模型
近日,DeepSeek发布Janus Pro模型,其超强性能和高精度引起业界关注。英特尔 Gaudi 2D AI加速器现已针对该模型进行优化,这使得AI开发者能够以更低成本、更高效率实现复杂任务的部署与优化,有效满足行业应用对于推理算力的需求,为AI应用的落地和规模化发展提供强有力的支持。 作为一款创新性
-
英伟达将打造桌面级超级电脑,可推理2000亿参数大模型
CES上,英伟达宣布将打造桌面级的个人超级计算机,让AI研发者,数据科学家,学生和开发者都可以在桌子上摆放一台超级计算机。一台这样的个人超级计算机可以推理2000亿参数的大语言模型。 英伟达宣布启动名为DIGITS(Deep learning gpu intelligence training syste
-
陆烨华:阿加莎于我是一位跨越时空的老友
陆烨华:阿加莎于我是一位跨越时空的老友



