位置:首页 > 技术资讯 > 此芯科技发布AGX战略 桌面超算原生跑通150亿大模型

此芯科技发布AGX战略 桌面超算原生跑通150亿大模型

时间:2026-07-21  |  作者:318050  |  阅读:0

此芯科技发布AGX战略,推动智能体计算落地

近期,此芯科技正式发布AGX Agentic Compute智能体计算战略,并推出全新硬件AGX Station以及全栈智能体算力产品系列。

产品线覆盖端、边、云全场景,旨在打造全域算力底座,赋能AGI发展。这一战略标志着智能体计算从概念阶段走向真正落地。尤其是对于AI大模型在桌面端的原生部署,以及多智能体协同计算,它提供了全新的硬件基础设施。

此芯科技发布AGX战略,桌面超算原生跑通150B大模型

AI行业转向智能体应用,传统架构面临挑战

当前AI行业正加速从“大模型训练”转向“智能体应用”深水区。Agent、多智能体协作、自主决策等场景对算力要求远超以往。

传统PC和服务器架构在设计之初并未考虑AI大模型推理需求。面对70B以上参数规模的大模型,很多场景只能依赖云端API调用,导致延迟高、成本贵、数据隐私泄露风险大。

此芯科技此次发布AGX Agentic Compute战略,正是瞄准这一核心痛点——从底层硬件架构到上层软件生态,重新构建专门为智能体计算优化的全栈算力方案。

AGX Station:桌面端原生推理70B-150B大模型

核心硬件产品AGX Station采用模组化、可扩展开放式硬件架构,支持M.2、MXM、PCIe等多种AI算力卡形态。用户可根据实际需求灵活配置算力规模。

在推理能力上,AGX Station可实现70B到150B参数规模大模型的原生推理,所有计算在本地完成,彻底告别云端API依赖。这意味着运行Llama 3.1 70B、Qwen3.8 72B等主流大模型,都能在桌面上获得流畅的本地推理体验,让桌面端拥有云端级的AI算力。

开放硬件架构,兼容国产AI芯片与旗舰显卡

AGX Station深度适配天数、后摩、原粒、智辰、光羽等多家国产存算一体AI芯片,同时兼容半高旗舰显卡,提供丰富的算力选择。

这种开放式架构打破了传统AI算力设备对单一芯片厂商的依赖。用户可根据应用场景、预算和性能需求灵活选择最合适的算力卡,降低采购成本和供应链风险。从市场角度看,这是一个务实的策略。

多智能体协同计算:分布式并行与智能调度

针对多智能体协同计算场景,AGX Station基于分布式架构实现多智能体并行计算与智能调度。多个AI Agent需同时运行、相互通信、协同完成复杂任务,对并行计算能力与通信带宽要求极高。

AGX Station通过内置智能调度引擎,可同时运行多个大模型实例,每个实例独立处理不同Agent任务,并通过高速内部总线实现实时通信与数据共享。此外,支持2×10G RDMA多机级联,多台AGX Station可组成桌面集群,算力规模线性扩展,满足更大规模多智能体系统部署需求。

全栈软件生态:统一API,推理效率提升2-3倍

此芯科技同步发布AGX Agentic Compute软件栈,包含模型部署工具、Agent编排框架、性能监控平台等核心组件。开发者可通过统一API接口快速完成大模型在AGX Station上的部署与优化,无需关注底层硬件差异。

软件栈内置模型量化、算子融合、内存优化等性能加速工具,可将大模型推理效率提升2到3倍。同时支持PyTorch、TensorFlow、ONNX Runtime等主流AI框架无缝迁移,大幅降低开发者迁移成本。

端、边、云全场景覆盖,AGX Station已开启预售

此芯科技AGX Agentic Compute战略还涵盖端侧与云侧全场景算力产品:

  • 端侧:面向智能终端设备的轻量级AI推理芯片,支持端侧大模型轻量化部署。
  • 云侧:面向数据中心的高密度AI算力服务器,满足大规模训练与推理需求。

端、边、云三侧产品通过统一的AGX软件栈实现算力协同,用户可根据任务需求灵活调度资源,实现成本与效率的最佳平衡。

目前AGX Station已开启预售,首批用户覆盖AI科研机构、智能体应用开发商、高校实验室等群体。未来此芯科技将持续迭代AGX Agentic Compute产品线,推出更多面向不同场景的智能体算力方案,为AGI时代提供坚实的硬件底座。

来源:整理自互联网
免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。

相关文章

更多

精选合集

更多

大家都在玩

热门话题

大家都在看

更多