模型

  • VAST Data:客户在用对象存储训练模型

    VAST Data 联合创始人 Jeff Denworth 在 X上发文表示: “AI 训练根本不需要文件系统……更具体地说,没有人需要一个仅仅是文件系统的系统。当 HPC 存储行业向世界宣称并行文件系统对 AI 至关重要时,客户实际上已经开始在训练环境中部署 S3 检查点和 S3 数据加载器(这些也可以

    2025-02-11
  • 腾讯云上线DeepSeek模型API接口,率先支持联网搜索!

    2月8日,腾讯云宣布上线DeepSeek-R1及V3原版模型API接口,通过强大的公有云服务,腾讯云可以为用户提供稳定优质的服务。同时,腾讯云旗下大模型知识应用开发平台知识引擎也接入了这两款模型,并率先支持联网搜索,结合知识库和RAG能力,开发者可以借助该平台实现分钟级搭建基于DeepSeek大模型的联网应用。腾讯云成

    2025-02-10
  • DeepSeek 大模型 API 硬盘缓存技术对存储系统的挑战

    随着网络带宽和存储性能的不断提升,数据中心的资源利用模式正面临新 的挑战。传统的以 CPU 为中心的处理架构在处理网络和存储协议时,需要占用 服务器主机约 30%的资源。这种资源占用被形象地称为“数据中心税”,它不仅 增加了存储服务器的资源开销,还限制了存储系统的整体性能表现。 此外,随着 CP

    2025-02-08
  • 中国电子云上线DeepSeek-R1/V3全量模型 开启私有化部署新篇

    近日,中国电子云CECSTACK智算云平台正式上线MoE架构的671B全量DeepSeek-R1/V3模型,以及DeepSeek-R1的蒸馏系列Qwen/Llama模型,并提供私有化部署方案,为党政、央国企以及关键行业用户提供安全可靠、智能集约的智能化解决方案。 DeepSeek系列大模型凭借其国产、开源

    2025-02-08
  • 腾讯云TI平台上架DeepSeek系列模型,支持免费体验和一键部署 

    近日,腾讯云TI平台宣布上架DeepSeek系列模型,包括“满血”的V3、R1原版模型,参数量达到671B;以及基于DeepSeek-R1蒸馏得到的系列模型,参数规模从70B到1.5B不等。 TI平台全面支持DeepSeek系列模型的一键部署。此外,为便于开发者零门槛开箱,TI平台也限时开放了R1 模型的免费在线

    2025-02-04
  • 英特尔Gaudi 2D可推理DeepSeek Janus Pro模型

    近日,DeepSeek发布Janus Pro模型,其超强性能和高精度引起业界关注。英特尔 Gaudi 2D AI加速器现已针对该模型进行优化,这使得AI开发者能够以更低成本、更高效率实现复杂任务的部署与优化,有效满足行业应用对于推理算力的需求,为AI应用的落地和规模化发展提供强有力的支持。 作为一款创新性

    2025-02-02
  • 英特尔Gaudi 2D AI加速器深度优化,高效运行DeepSeek Janus Pro模型

    近日,DeepSeek发布Janus Pro模型,其超强性能和高精度引起业界关注。英特尔® Gaudi 2D AI加速器现已针对该模型进行优化,这使得AI开发者能够以更低成本、更高效率实现复杂任务的部署与优化,有效满足行业应用对于推理算力的需求,为AI应用的落地和规模化发展提供强有力的支持。 作为一款创新

    2025-02-02
  • 蚂蚁集团:构筑完善的安全治理体系,推进模型能力快速提升

    1月8日,北京智源人工智能研究院从Scaling Law、基础模型、具身智能、超级应用、AI安全等关键方向发布了覆盖从基础设施到产品应用场景的“2025十大AI技术趋势”,针对每个趋势观点,给出其可成为2025年度趋势的论证逻辑。其中在AI安全趋势方面,智源研究院认为,模型能力提升与风险预防并重,AI安全治理体系持续完

    2025-01-13
  • 英伟达将打造桌面级超级电脑,可推理2000亿参数大模型

    CES上,英伟达宣布将打造桌面级的个人超级计算机,让AI研发者,数据科学家,学生和开发者都可以在桌子上摆放一台超级计算机。一台这样的个人超级计算机可以推理2000亿参数的大语言模型。 英伟达宣布启动名为DIGITS(Deep learning gpu intelligence training syste

    2025-01-08
  • Meta AI推出LIGER混合检索AI模型,计算效率与推荐精度兼得

    Meta AI 的研究人员提出了一种名为 LIGER 的新型 AI 模型,巧妙地结合密集检索和生成检索的优势,显著提升了生成式推荐系统的性能。 LIGER 有效地解决了传统推荐系统在计算资源、存储需求和冷启动项目处理上的难题,为构建更高效、更精准的推荐系统提供了新的思路。 项目背景 想要把用户与相关内

    2025-01-04
  • 智源发布FlagEval“百模”评测结果 丈量模型生态变局

    2024年12月19日,智源研究院发布并解读国内外100余个开源和商业闭源的语言、视觉语言、文生图、文生视频、语音语言大模型综合及专项评测结果。 相较于今年5月的模型能力全方位评估,本次智源评测扩展、丰富、细化了任务解决能力内涵,新增了数据处理、高级编程和工具调用的相关能力与任务;首次增加了面向真实金融量化交易场

    2024-12-20
  • 腾讯云发布数据智能平台TCHouse-X,面向大模型等应用提供一站式数据处理能力

    大模型时代,大数据技术发展也迎来了全新的构建范式。 12月12日,腾讯云宣布发布全新一代数据智能平台TCHouse-X。该平台采用一体化、智能化、高性能、云原生等理念打造,大幅简化了传统数据平台的复杂架构,并引入了智能化系统交互、资源管理与运维管理能力,能够为大模型时代的应用创新提供一站式数据处理能力,助力企业高

    2024-12-18
  • 一张图读懂大模型技术与应用的最新进展

    中关村科金总裁喻友平在“2024 大模型技术与应用创新论坛”重磅发布中关村科金大模型时代的“三级引擎战略”,推出得助大模型平台 2.0,以及面向千行百业的大模型应用,下面通过一张图了解当前大模型技术与应用发展情况。

    2024-12-13
  • 阿里云首次公开展示Flink2.0细节,将全面拥抱大模型技术

    11月29日,在Flink Forword Asia 2024上,阿里云表示正主导研发Flink2.0,并首次公开展示其技术细节,Flink2.0将全面拥抱大模型,同时新增云原生存算分离、流批一体、兼容流式湖仓等特点,是该技术诞生十年以来最大的升级之一。会上,阿里云还宣布开源下一代流存储 Fluss 项目,可为Flin

    2024-12-01
  • 沙利文报告:华为云登顶工业大模型市场份额第一,助推新型工业化

    进入新型工业化时代,AI大模型已成为工业领域变革的关键力量。近日,国际权威分析机构沙利文(Frost & Sullivan)发布《中国行业大模型市场报告,2024》,全面分析了包括工业大模型在内的多个领域中国行业大模型发展态势。报告显示,华为云盘古大模型在政务、汽车、金融等7个领域获得领先地位。其中,面向工业大

    2024-11-24