登录社区云,与社区用户共同成长
邀请您加入社区
国内工业AI视觉质检技术成熟,但在海外推广时面临算力部署与跨境传输的挑战。企业尝试将模型部署到海外工厂时,常因当地数据中心资源有限、跨国时延高、IT采购困难而受阻。边缘推理成为解决方案,通过本地部署消除跨境时延,但需专业服务商协助完成设备采购、物流和调试。OgCloud提供一体化供应链服务,帮助企业快速部署,将推理时延降至毫秒级,满足产线需求,同时节省运维成本。这种“算力前置、服务跟进”的模式为制
当别人还在为抢GPU打架,Nvidia和Span已经把AI数据中心挂你家墙上了!液冷Blackwell、零噪音、还能帮你省电费——这波不是科幻,是2024年真实发生的“住宅边缘计算革命”。
最近,关于GPT-6将支持200万Token超长上下文的消息在AI圈掀起巨浪。算力稀缺且昂贵。然而,多数人只盯着H100、B200的算力翻倍,却忽略了另一个更隐蔽的瓶颈——通信。在万卡乃至十万卡集群中,通信已经从辅助设施变成了“AI算力的主动脉”。1.6T/3.2T光模块、NPO/CPO共封装光学、卫星激光链路……这些原本“遥不可及”的技术,正被200万Token上下文的需求硬生生拉入快车道。
AI 算力竞争,正式从“拼性能”转向“拼落地”。
AI时代,机房里的每一度电、每一U空间,都应该服务于能直接创造价值的业务——模型训练、推理服务、数据分析。而安全设备属于“必要但不产生价值”的消耗项。
算力正成为AI时代可被感知的“新国力”
Z-Image是一款功能强大的基础生成模型,具备高质量输出、多样风格覆盖和精准提示响应能力。作为完整容量的Transformer模型,它支持无分类器引导控制,提供丰富的视觉表达,从写实摄影到动漫插画。该模型特别适合创意探索,能显著提升输出多样性,并支持LoRA微调和ControlNet集成。现已上线趋动云平台,用户可一键部署体验,同时平台提供新客专享150元算力金活动。模型支持开发者快速构建细分领
2026年,尽管AI技术成熟,企业级AIAgent项目失败率仍超60%,核心问题从技术瓶颈转向产品管理的系统性断层。传统PM的确定性思维与Agent的概率性黑盒特性冲突,需构建“动态耦合模型”,涵盖六维知识模块: 领域基础层:重构Agent认知框架(目标-约束-进化); 平台硬件层:算力成本与商业模型的平衡; AI核心技术层:理解记忆、规划与工具使用的工程边界; 应用场景层:从Copilot到自主
AI应用春节流量大考:Remy与共绩科技的成功案例揭示算力弹性调度重要性。3D内容平台Remy在华为发布会后遭遇50万用户集中访问,共绩科技通过秒级扩容至1900张GPU卡确保流畅体验。该案例凸显AI企业在节日流量洪峰中面临的算力挑战,以及弹性算力调度系统的关键作用——实现秒级扩缩容、99.99%稳定性,避免资源浪费。共绩科技的"智能算力电网"解决方案,已为5000+团队提供支
OpenCSG 不止是代码托管平台,而是面向 AI 时代的开源生态中枢:支持本土算力与私有化部署、数据资产治理、产业场景落地与国际化社区结构,天然契合中国开源路径。
摘要:随着AI算力需求爆发式增长,服务器供电系统面临严峻挑战。本文深入分析交错并联Buck技术在AI服务器电源中的核心价值:通过多相纹波抵消实现亚毫伏级噪声控制,分散热源提升功率密度,以及优化动态响应满足AI芯片瞬态需求。文章构建了包含四象限分析、MECE原则和SMART目标的系统设计框架,并以NVIDIA DGX系统为例,展示了从12相交错设计到自适应相位管理的演进路径。最后探讨了3D集成供电和
Youtu-LLM是一款19.6亿参数的高效大语言模型,具备128k长文本处理能力和原生智能体功能。其在常识推理、STEM、编程等任务上超越同规模模型,并能胜任合同分析、代码调试等专业场景。该模型已上线趋动云平台,支持一键部署,用户可通过GitHub获取资源或观看B站视频教程快速上手。使用后需注意及时关闭环境以避免额外费用。
从“企业AI”到“AI企业”,这场会议把AI落地路径讲透了
第五届AIGC开发者大会年度对话:超级算力如何打造超级产品?
本文对比了国内外主流免费算力平台,涵盖百度飞桨、阿里天池、Google Colab等。国内平台网络友好、中文生态完善,适合深度学习入门;国外平台资源丰富、多框架兼容。各平台提供免配置GPU环境,支持直接运行代码,并详细说明了资源限制、适用场景及快速上手指南。文末提供通用PyTorch示例代码和平台选择建议,帮助开发者高效利用免费资源进行AI开发与实验。
AI眼镜正从单一功能穿戴设备向"全天候AI助手"演进,2025年前三季度全球市场规模同比增长119%,其中多模态产品占比达64%。作为设备"大脑"的MCU(微控制单元),直接决定了AI眼镜的功耗、算力、成本、体积等核心指标,是产品成功的关键因素。本攻略将从需求分析出发,系统讲解MCU选型的核心指标、方案对比、型号推荐及实施步骤,帮助开发者快速找到最适合的解决方案。
当技术发展到一定阶段,决定胜负的不再是算法,而是供应链的掌控力。从“独家绑定”转向“多云互联”——单一云依赖已成过去式,算力自主才是生存底线;从“技术竞赛”升级为“供应链战争”——芯片、电力、数据中心,成为AI巨头的必争之地;从“模型为王”进化为“算力霸权”——谁掌握了稳定、低成本的算力供应链,谁就掌握了AGI的未来。在AI重塑世界的时代,算力就是新的“石油”,而供应链,就是开采石油的“钻井平台”
GPU资源利用率低下已成为AI创新的主要瓶颈。趋动科技OrionXAI算力池化软件社区版通过三大核心技术(显存超分、算力切分、智能调度),可将单卡利用率从30%提升至90%以上,实现硬件资源的最大化利用。该方案特别适合初创企业、开发者和科研机构,能显著降低硬件成本、提升研发效率。目前全球已有500多家机构采用,现提供永久免费的社区版本,助力AI从业者突破算力限制,专注于核心创新。
【摘要】AI走出软件栈并接管物理世界后,增长、成本、就业、分配与治理都会被改写。
CANN作为昇腾AI芯片的核心软件栈,在国产AI生态中扮演关键角色。它通过跨框架适配、算力优化和全流程开发工具三大核心能力,解决了AI模型与芯片硬件间的适配难题,显著提升算力利用率。相比CUDA,CANN在自主可控、大模型调度、开源生态和产业适配等方面更具优势。文章详细解析了CANN的分层架构、发展历程及战略价值,指出其已成为国产AI从技术突破走向产业落地的核心引擎,并正在推动国产AI生态的自主创
400G 类InfiniBand的原生RDMA网卡与交换芯片,可实现400Gb/s超高带宽、低于1微秒端侧通信延迟,充分释放万卡超集群算力,并可将超集群规模轻松扩展至10 万卡以上,相比传统IB网络提升2.33倍,同时网络总体成本降低 30%。,相比业界同类产品,scaleX640单机柜算力密度提升20倍,可实现MoE万亿参数大模型训练推理场景高达30%~40%的性能提升,并保障10万卡级超大规模
通常以每秒执行的浮点运算次数(FLOPS)来衡量。它反映了GPU算力资源的利用率。指单位时间内GPU从显存中读取或写入数据的能力,单位通常为GB/s。AI计算操作数 (FLOP)内存访问量 (Byte)AI = \frac{\text{计算操作数 (FLOP)}}{\text{内存访问量 (Byte)}}AI内存访问量(Byte)计算操作数(FLOP)它决定了程序是受限于算力还是受限于带宽。测量
openFuyao是“云原生+AI原生”时代的多样化算力集群开源社区,核心优势在于统一抽象的池化架构与多场景适配的调度策略,为硬件厂商、互联网算力平台提供标准化接入、高效可靠的算力管理方案,打破异构算力壁垒,释放算力价值。提升超大规模集群调度性能、深化AI原生调度能力、完善硬件生态适配。依托开源特性,华为、工行等核心成员共建技术标准与创新平台,开发者接入可降低研发成本、提升算力释放效率,在数字经济
在 AI 算力时代,很多人以为“有 GPU 就有算力”,以为看参数表就能做决策。但真实情况是:算力从来不是一个数字,而是一套能被稳定交付的系统能力。计算峰值之外,显存结构、带宽、网络、机房电力与散热、以及软件栈与运维体系,都会决定你最终拿到的是“速度”还是“焦虑”。本文作为专栏开篇,用尽量不工程化、但足够专业的方式,建立一个“从使用到退役”的算力全生命周期视角:先把算力用明白,才能把服务器资产管明
数据:万亿级文本语料提供 “知识来源”(类似大数据平台的数据湖);架构:Transformer 提供 “高效学习骨架”(类似分布式系统的基础架构);训练:预训练 + 微调实现 “通用能力→专业能力”(类似系统从基础版到定制版的迭代);推理:向量映射 + 概率预测实现 “理解→生成”(类似模型的推理与输出过程)。
研发环境的高算力需求与数据泄露风险的矛盾,本质上是数字化转型过程中“效率与安全”的平衡问题。零信任架构通过重构安全信任模型,实现了对研发环境的全局安全管控;安全本地沙箱技术通过构建隔离防护环境,实现了对敏感数据与研发过程的精准防护。二者的深度融合,打破了传统安全架构的局限性,构建起“全局管控+局部隔离”的安全算力生态,既满足了AI大模型训练、跨地域协同研发等场景的高算力需求,又筑牢了数据安全的“防
如果说推理能力是Gemini 3的“硬实力”,那么原生多模态能力就是它的“杀手锏”——不仅能处理文本、图像、视频等单一模态信息,更能实现跨模态的深度理解与转化,在Video-MMMU测试中拿下87.6%的史诗级高分。当Gemini 3在Humanity’s Last Exam测试中冲破40%大关时,AI行业其实已触摸到AGI(通用人工智能)的临界点——要知道,人类博士在该测试中的平均得分也不过56
据说算力高达1000 TOPS,华硕Ascent GX10深度评测—多模态AI创作
从底层算力芯片到上层应用系统,从数据加密技术到运维管理工具,我国已构建起 “硬件 - 系统 - 场景” 全链条自主可控的技术体系,不仅是科技自强的关键标志,更成为破解国产 AI 落地难题的重要支撑。近年来,国产大模型技术突飞猛进,DeepSeek-R1、阿里巴巴通义千问 Qwen3-32B 等模型在多项评测中展现出全球顶尖水平,但 AI 从实验室走向生产场景时,却面临适配瓶颈、成本高企、安全风险三
这些延续百年的医疗“死结”:影像诊断的“视觉疲劳盲区”、基层诊疗的“知识孤岛”、新药研发的“高耗低效”,正被AI技术以摧枯拉朽之势逐个破解。而AI视觉检测系统的出现,掀起了一场“毫米级革命”。基层医院医生面对疑难病例时,常陷入“知识孤岛”困境——某县医院心内科主任回忆:“遇到罕见心肌病,我们要连夜翻教科书、查文献,还得请教上级医院专家,现在AI系统能秒级推送最新诊疗方案。就像撕包装袋从“两刀切”升
你的 LLM 推理慢,不是因为 GPU 不行,而是因为 96% 的算力在发呆。英伟达华人团队提出 TiDAR 架构,利用“空闲 Token 槽”在一次前向中并行生成多个 token,吞吐提升近 6 倍且质量无损。本文深入剖析其原理、优势、限制及对推理系统架构的颠覆性影响,为大模型落地提供新思路。
青云AI Infra 3.0以“统一架构”为核心,在技术形态、能力覆盖、交付模式上实现了重大突破,同时坚守了青云多年来的核心战略与技术初心。这种“变与不变”的平衡,构成了其独特的核心竞争力。
摘要:在碳中和目标下,嵌入式AI正成为能源管理转型的核心驱动力。文章指出传统能源模式面临可再生能源并网、用户侧能效和碳管理三大短板,而嵌入式AI通过三大应用场景重构能源生态:1)电网稳定性方面,实现毫秒级负荷调度,使德国试点项目调峰成本降低60%;2)用户侧能效方面,三星智能家居系统通过设备级建模使家电节能达25%;3)能源民主化方面,西门子虚拟电厂聚合5000户资源,调频响应时间<2秒。同时面临
第二十届中国IDC产业年度大典(IDCC2025)暨数字基础设施科技展(DITExpo)将于12月10日到11日在北京首钢园正式召开,届时将有超过15场平行论坛同期举行,包括DIFGC全球数字基础设施合作发展北京论坛、2025算力产业生态高质量发展大会、万卡AI集群建设论坛、算力国产化论坛、智能制造高质量发展论坛、智慧医疗论坛、算电协同发展论坛、Green AI Infra论坛、自主可信计算创新论
8 卡则是算力的 "平衡线":单卡 500TOPS 的算力,8 卡聚合就是 4000TOPS,刚好能扛住 70B 参数大模型推理、120 路 4K 监控分析这类中高负载任务,既不会像 6 卡那样 "力不从心",也不会像 10 卡那样造成 30% 的算力冗余。散热系统的好坏,得看 "风扇 + 风道 + 间隙" 的组合拳。GPU 是 4U8 卡的 "核心引擎",但很多人只盯着 "8 块 GPU" 这个
在AI边缘计算与视频处理需求日益精细化的当下,视程空间(北京)科技有限公司推出EDG SC6N0-S T5X AI视频处理平台,以NVIDIA Jetson AGX Thor™为核心动力,构建起高算力、高扩展性的边缘智能处理架构,为多领域技术落地提供坚实支撑。在AI边缘计算架构迭代与视频处理需求精细化升级的双重驱动下,视程空间(北京)科技有限公司基于NVIDIA Jetson AGX Thor™核
大模型之所以能实现突破性的性能(如自然语言理解、生成能力),并非单一技术的作用,而是四大维度协同演进的结果。
国产算力为科研装上聪明的“耳朵”,通过融合AI与强大算力,声学等基础研究能够“听”得更准、更快,重塑科学发现范式。
在人工智能技术快速发展的今天,我们往往被其强大的能力所震撼,却忽视了这些系统背后隐藏的脆弱性和潜在危险。最新研究表明,AI不仅可能被轻易欺骗,甚至已经学会主动欺骗,这为技术安全敲响了警钟。
本文提供完整版报告下载,请查看文后提示。
过去几年伟大的AI模型诞生于庞大的数据中心。但下一代模型——那些真正个性化、真正互动、真正具有突破性的模型——将不会如此。它们将由像你一样的人,在车库、家庭办公室、小型创业空间中创造出来。它们将在像DGX Spark这样的机器上诞生。革命已经到来。你的办公桌,就是新的数据中心。你,将创造什么?
在日前举行的2025华为中国数字能源数据中心碳索峰会上,我们获悉,华为数字能源希望通过其所提出的数据中心创新理念——“安全可靠、弹性敏捷、绿色低碳”(RAS),基于一套覆盖全生命周期的技术体系,以软硬件协同的运维范式升级,重构智算底座的可靠性。
【摘要】系统解析AI产品四层架构,为产品经理提供从底层技术到顶层商业价值的完整构建蓝图。
AI算力与数据库形成协同闭环:数据库为AI提供海量数据存储、预处理和实时查询能力,支撑模型训练和推理;同时AI算力高效处理数据库输出的数据,实现价值转化。优质数据库需具备高扩展性、低延迟和多模态支持能力,而向量数据库因其高效处理AI特征向量的特性成为热门选择。两者缺一不可,共同构成AI系统的核心基础设施。
突破经典算力墙已进入“多技术共振”阶段:量子计算打破算法复杂度壁垒,存算一体重构架构范式,光子计算开启超高速通道,先进封装破解物理限制。未来五年,随着级联玻色编码、3D-CIM、光子神经网络等技术的规模化应用,经典算力墙将被逐步瓦解,人类算力将进入“量子-经典-光子”三元协同的新纪元。正如浙大“悟空”类脑计算机所展示的,新型计算范式正在重新定义算力边界,为AI、材料科学、生物医药等领域带来颠覆性突
9月19日,在第十届华为全联接大会(HUAWEI CONNECT 2025)上,华为常务董事、华为云计算CEO张平安分享了华为云在AI云服务、大模型、具身智能、AI Agent等领域的技术创新与落地实践。华为高级副总裁、华为云全球Marketing与销售服务总裁杨友桂分享了数智化时代下,华为云帮助企业实现全球业务成功的创新技术和经验思考。
很多行业虽然核心部件CPU/GPU已实现国产化,但仍有部分关键部件依赖国外技术。这种现状下,关键行业对AI算力的核心需求值得关注