2026-09-13 · 17 篇 · 17 条可开原文
2026年9月13日
sogou·17 篇·当前显示 17 篇
09:00 Asia/Shanghai routine. WeRead login blocked. Sogou P0 OK. Makeup 15 + routine refresh 2.
17 / 17
非科班软件人的修养·2026-09-12
条反模式速查Kueue Gang Admission 误当 Gang Scheduling,准入但不保证同时放置,产生半死锁.正解:用 Volcano/KAI 真 gang....
飞哥AI说·2026-09-10
图:两个推理引擎在同一张对照表上的位置一、两个立足点,一条... vLLM 与 SGLang 分别站在第一轮和第三轮的中心,却又同时覆盖...
日习一技·2026-09-04
各配各的硬件,这就是 PD 分离(Prefill-Decode Disaggregation),OSDI 2024 上发表的 DistServe 是这条路线的代表作,近两年各家...
南孜 AI Lab·2026-09-01
更偏持续、低延迟地“吐”.所以有了 PD 分离:P 节点专门做 Prefill,D 节点专门做 Decode,中间通过 KV Cache / 中间状态衔接....
言和科创·2026-08-31
GPU位于算力层的核心,与CPU、NPU/TPU、FPGA、ASIC、高... ·PUE(Power Usage Effectiveness):总能耗 / IT设备能耗;·MFU(...
WebView社区·2026-09-02
当我们在讨论大语言模型(LLM)的推理成本时,目光通常聚焦在两个地方:一是云服务商按Token数量明码标价的API账单(如...
广州亿能测试技术服务有限公司·2026-09-06
我们的做法是评测数据全部写入独立的 benchmark 命名空间,清理时只清这个命名空间,绝不触碰智能体真实用户的记忆.这是存储...
JohnNotes·2026-09-06
包括SWE-bench、WebArena、OSWorld、GAIA、Terminal-Bench、FieldWorkArena、CAR-bench,结论是每一个都能被利用拿到接...
走向人工智能世界·2026-09-06
SWE-bench、WebArena、TerminalBench、AgentBench、环境交互类基准成为主流;区分离线仿真评测、Harness 回归评测、生产轨...
技术知行之路·2026-09-02
SWE-bench Pro(Agent编码)得分61.7,超过Qwen3.6-27B的53.5和Opus4.6 Max的53.4.DeepSWE 1.1得分42.2,是Qwen3.6-27B(13.3...
甲乙方AI说·2026-09-04
Day-0 原生2026 年 4 月 DeepSeek V4 发布,技术报告把华为昇腾... 要不要混插多家国产卡.要的话,重点考察跨架构调度软件栈,这...
智源研究院·2026-08-31
因此,Day0的真正价值并不只是“快一天”.它缩短的是前沿模... 华为昇腾、海光等芯片上通过不同的推理框架插件方式完成推理部...
七号驿站·2026-08-31
preview的Day 0适配.摩尔线程走的是另一套技术栈——自研... DSA压缩机制一个个拆开了重写进昇腾的CANN架构.一块国产卡...
纵观云智算·2026-09-08
年昇腾出货 81.2 万张,占国产总出货近一半(49.2%).2026 年 ... Day0 适配(同期发布的当天就能在国产芯片上跑通);华为 ...
跟沈工学AI·2026-09-09
以下是华为云矩阵384超节点(Supernode 384)与NVIDIA GB200 NVL72的架构、性能、互联、内存、功耗及能效对比:1. 对比表格...
HAMi Project·2026-09-11
Kueue、Volcano、KAI Scheduler 等选择.HAMi 的态度是协同而不是替代:• 原生 kube-scheduler:开箱即用,适合单任务独立调度...
dotNET跨平台·2026-09-13
Volcano、Kueue、KAI Scheduler 的协同;MIG、vGPU 等切分方案的选型;以及 fleet 规模的多租户 GPU 管理.观看与下载所有 ...