首页 文章 精选 留言 我的
优秀的个人博客,低调大师

微信关注我们

原文链接:https://www.oschina.net/news/394169

转载内容版权归作者及来源网站所有!

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

Volcano 社区发布 Kthena 子项目

Volcano 是 CNCF 首个云原生智能调度引擎,由华为云发起开源并深度参与贡献。12月29日,Volcano 宣布社区迎来了一个新的子项目 Kthena! Kthena 是一个专为 Kubernetes 设计的云原生、高性能的 LLM 推理路由和编排、调度系统。它旨在解决在生产环境中大规模编排、部署和服务 LLM 所面临的核心挑战,通过其独特的 超节点拓扑感知的亲和性调度,KV Cache 感知的流量调度、Prefill/Decode 分离路由等高级功能,显著提升 GPU/NPU 资源利用率和吞吐,降低推理延迟,并赋予企业前所未有的灵活性和控制力。作为 Volcano 的子项目,Kthena将致力于帮助 Volcano 扩展除 AI 训练之外的边界,打造训推一体的完整解决方案。 LLM 服务化的“最后一公里”困境 大语言模型(LLM)正在以前所未有的速度重塑各行各业,但将其高效、经济地部署在生产环境中,特别是基于 Kubernetes 的云原生平台上,仍然困难重重。开发者们普遍面临以下挑战: 资源利用率低:LLM 推理,尤其是其独特的 KV Cache 机制,对 GPU、NPU ...

Anthropic 将从博通采购近百万颗 TPUv7

半导体与AI行业研究机构SemiAnalysis近日披露,AI公司Anthropic将直接向博通采购近100万颗TPU v7p Ironwood AI芯片,并在其自控数据中心本地部署。 此举意味着博通将绕过谷歌,直接向Anthropic提供基于TPU v7p的机架级AI系统。尽管如此,谷歌预计仍将从该交易中获得IP授权收入。 博通CEO陈福阳此前于2025年12月确认,Anthropic已累计下达价值210亿美元的AI系统订单。其自有TPU算力基础设施由TeraWulf等三家企业提供,现场部署由Fluidstack负责。 目前外界仍关注这批TPU的交付周期、部署地点及投产时间,部分分析人士认为其投运时间将直接影响Anthropic在AI模型竞争中的算力优势。

相关文章

发表评论

资源下载

更多资源
优质分享App

优质分享App

近一个月的开发和优化,本站点的第一个app全新上线。该app采用极致压缩,本体才4.36MB。系统里面做了大量数据访问、缓存优化。方便用户在手机上查看文章。后续会推出HarmonyOS的适配版本。

Mario

Mario

马里奥是站在游戏界顶峰的超人气多面角色。马里奥靠吃蘑菇成长,特征是大鼻子、头戴帽子、身穿背带裤,还留着胡子。与他的双胞胎兄弟路易基一起,长年担任任天堂的招牌角色。

Rocky Linux

Rocky Linux

Rocky Linux(中文名:洛基)是由Gregory Kurtzer于2020年12月发起的企业级Linux发行版,作为CentOS稳定版停止维护后与RHEL(Red Hat Enterprise Linux)完全兼容的开源替代方案,由社区拥有并管理,支持x86_64、aarch64等架构。其通过重新编译RHEL源代码提供长期稳定性,采用模块化包装和SELinux安全架构,默认包含GNOME桌面环境及XFS文件系统,支持十年生命周期更新。

Sublime Text

Sublime Text

Sublime Text具有漂亮的用户界面和强大的功能,例如代码缩略图,Python的插件,代码段等。还可自定义键绑定,菜单和工具栏。Sublime Text 的主要功能包括:拼写检查,书签,完整的 Python API , Goto 功能,即时项目切换,多选择,多窗口等等。Sublime Text 是一个跨平台的编辑器,同时支持Windows、Linux、Mac OS X等操作系统。

用户登录
用户注册