_2026-08-14_15:36:37_2026-08-14 15:36:37
Re_ AIA SMSIC & IMSIC MRIF Proposal of Work V3
原文链接失效了?给我留言
TAGs:处理器 risc-v 虚拟化 中断 MRIF
Summary: Anup Patel回应GUO Ren的质疑:正常OS不会将所有MSI-X向量路由到同一物理CPU,该扩展方案跨架构通用;IMSIC文件可用DRAM作为后备存储,属实现选择、无需ISA扩展,并认为SMSIC提案多数论点不切实际。
_2026-08-14_15:28:52_2026-08-14 15:28:52
Re_ AIA SMSIC & IMSIC MRIF Proposal of Work V3
原文链接失效了?给我留言
TAGs:处理器 risc-v 虚拟化 中断 MRIF
Summary: GUO Ren回应AIA扩展性讨论,指出按hart数扩展中断ID存在局限:驱动初始化即分配全部向量,CPU热插拔迁移中断困难。对比x86与Arm方案,IMSIC每文件仅2047个ID,故提出MRIF将中断状态移入内存,仅需三个小型架构扩展。
_2026-08-05_11:07:20_2026-08-05 11:07:20
Re_ [RFC] RISC-V KVM_ guest local sfence.vma may miss stale VS-stage TLB after vCPU migration - Guo Ren
原文链接失效了?给我留言
TAGs:处理器 risc-v 虚拟化 内存
Summary: Yaxing Guo报告RISC-V KVM中guest local sfence.vma在vCPU迁移后可能遗漏陈旧VS-stage TLB条目,在XiangShan系统上触发段错误。Guo Ren引用规范指出HFENCE.GVMA在双缓存设计中可能不清除VS-stage TLB。Anup Patel认为现有vCPU迁移清理机制已能处理,可能是硬件问题。
_2026-07-30_17:51:02_2026-07-30 17:51:02
[PATCH] riscv_ KVM_ Add hart-to-vCPU mapping for faster MSI injection - BillXiang
原文链接失效了?给我留言
TAGs:处理器 risc-v 虚拟化 中断 Contribute
Summary: 该 patch 为 RISC-V KVM 的 AIA 新增 hart_index 到 vCPU 的直接映射表,替代 MSI 注入路径中遍历所有 vCPU 的线性搜索,将 O(n) 扫描降为 O(1) 查表,在 vCPU 数量较大时显著提升中断注入性能。同时修改了 kvm_riscv_aia_inject_msi_by_id() 和 kvm_riscv_aia_inject_msi() 两个函数,并在 kvm_aia 结构中新增 hart_to_vcpu 字段。
_2026-07-28_16:51:03_2026-07-28 16:51:03
AIA SMSIC & IMSIC MRIF Proposal of Work V3
原文链接失效了?给我留言
TAGs:处理器 risc-v 中断
Summary: 该提案由阿里巴达摩院玄铁郭任提出,针对RISC-V AIA架构中IMSIC片上中断文件可扩展性不足的问题,提出两个补充扩展:SMSIC为软件中断(IPI)提供专用MSI路径,解耦IMSIC外部中断;IMSIC MRIF将中断位图从片上寄存器迁移至系统内存,消除片上存储对vCPU数量和中断规模的约束,满足AI Agent沙箱及高密度PCIe设备中断场景的可扩展性需求。
_2026-07-28_15:51:47_2026-07-28 15:51:47
Install Ubuntu on QEMU RISC-V - Ubuntu hardware support documentation
原文链接失效了?给我留言
TAGs:处理器 risc-v 虚拟化 qemu
Summary: 该页面介绍了如何在 QEMU 上安装 Ubuntu RISC-V 虚拟机的完整流程,包括安装 opensbi、qemu-system-riscv64 等前置依赖,使用预装服务器镜像通过 U-Boot 或 EDK II 启动,以及通过 live 服务器镜像安装系统的步骤,并说明了 QEMU 版本与 CPU 参数(RVA23S64)的兼容性限制。
_2026-07-11_11:00:44_2026-07-11 11:00:44
SPEC CPU2017 RISC-V Tracking _ SPEC CPU2017 RISC-V 平台跟踪排行榜
原文链接失效了?给我留言
TAGs:处理器 risc-v 性能
Summary: 该网页是RISC-V架构性能追踪网站,展示SPEC CPU2017基准测试结果。页面包含整体排名、平台排名、编译器排名和基准测试结果,显示不同RISC-V平台和编译器的性能对比,其中XSCC 1.1在OpenXiangShan KMHv3 RTL上表现最佳(2.14 int/GHz)。还列出了最近测试运行记录,包括日期、编译器、平台和测试状态等信息。
_2026-06-16_19:30:25_2026-06-16 19:30:25
Re_ x86 multi-msi w_o iommu - Thomas Gleixner
原文链接失效了?给我留言
TAGs:设备与驱动 PCI_PCIe 中断
Summary: Thomas Gleixner在回复Jeffrey Hugo关于x86平台无IOMMU的多MSI支持问题时,详细解释了Linux内核不支持此功能的技术原因。他指出多MSI需要连续的CPU向量空间和对齐要求,这会导致向量耗尽问题。同时,无IOMMU时改变中断亲和性存在技术复杂性,而中断重映射可以解决这些问题。他认为多MSI的收益有限,不支持是合理的技术决策,而非系统缺陷。
_2026-06-16_14:16:01_2026-06-16 14:16:01
I_O 虚拟化新纪元:vDPA 与 io_uring 如何显著缓解性能瓶颈
原文链接失效了?给我留言
TAGs:虚拟化 IO
Summary: 本文介绍vDPA与io_uring如何缓解虚拟化I/O瓶颈:vDPA将网络数据面卸载到智能网卡,直接处理virtio协议,降低延迟;io_uring以无锁环形队列和批量异步提交优化存储I/O,减少上下文切换。两者互补,可显著提升虚拟机网络与存储性能,接近裸机水平。
_2026-06-16_13:40:27_2026-06-16 13:40:27
UnixBench_ A Detailed Implementation - Alibaba Cloud Community
原文链接失效了?给我留言
TAGs:测试 性能
Summary: 本文从代码层面详细解析了UnixBench基准测试套件的各项测试实现,包括Dhrystone(整数性能)、Whetstone(浮点性能)、Execl吞吐量、文件复制、管道吞吐量与上下文切换、进程创建、Shell脚本以及系统调用开销等核心项目,并指出多进程测试是单进程测试的并行扩展。
_2026-06-16_13:39:05_2026-06-16 13:39:05
UnixBench Score_ An Introduction - Alibaba Cloud Community
原文链接失效了?给我留言
TAGs:测试 性能
Summary: 该文是阿里云关于 UnixBench 性能测试工具的简介。文章解释了 UnixBench 如何通过运行多项测试(如 Dhrystone、文件复制、进程创建等),并采用特定的对数与指数计算方法,将原始性能数据转化为单进程与多进程两种模式下的基准分数,最终得出一个代表系统整体性能的综合指数。
_2026-06-16_13:10:52_2026-06-16 13:10:52
7 Factors that Influence UnixBench Scores - Alibaba Cloud Community
原文链接失效了?给我留言
TAGs:测试 性能
Summary: 本文探讨了影响UnixBench性能评分的七个关键因素,包括CPU是否固定、时钟频率、UnixBench算法本身的缺陷(如基于管道的上下文切换和双精度Whetstone测试)、编译选项差异、内核参数调整以及其他进程的干扰。
_2026-05-25_17:17:35_2026-05-25 17:17:35
EUV被卡脖子?华为换道超车:用_韬τ定律_打破西方制程垄断
原文链接失效了?给我留言
TAGs:半导体
Summary: 华为在ISCAS 2026上提出'韬τ定律',以时间缩微替代几何缩微,通过逻辑折叠等架构创新,系统性降低信号传播时延,实现芯片性能提升。该技术已应用于381款芯片,新一代麒麟芯片将完整采用,旨在绕过EUV等先进工艺限制,重构后摩尔时代产业竞争格局。
_2026-05-25_13:24:08_2026-05-25 13:24:08
华为韬【τ】定律:后端老哥要辛苦了?
原文链接失效了?给我留言
TAGs:半导体
Summary: 华为发布韬定律(τ定律),将电路RC时间常数作为核心优化目标,通过主动降低互连延迟来提升芯片性能,而非依赖制程微缩。其关键技术“逻辑折叠”通过三维拓扑重组缩短关键路径,为受制程限制的芯片设计提供了新方向。
_2026-05-22_17:19:21_2026-05-22 17:19:21
解构LLM: 以llama.cpp分析模型推理过程 - laumy的学习笔记
原文链接失效了?给我留言
TAGs:大模型
Summary: 本文深入剖析了基于llama.cpp的大语言模型推理过程,从Transformer架构的自注意力机制到llama.cpp的实现细节,包括模型加载、分词器、推理上下文管理、Prefill和Decode阶段,以及GGML引擎的内存池、张量、计算图和量化技术,全面解析了LLM推理的软件实现机制。
_2026-05-22_14:24:21_2026-05-22 14:24:21
A survey of scheduler benchmarks [LWN.net]
原文链接失效了?给我留言
TAGs:测试 性能 调度
Summary: 本文介绍了Linux内核调度器开发中常用的四种基准测试工具:Hackbench用于测量任务间通信的平均唤醒延迟;Schbench提供详细的延迟分布统计,尤其关注尾部延迟;Adrestia是极简的微基准测试,用于获取典型最大唤醒延迟;Rt-app则是一个高度可配置的实时工作负载模拟器,用于建模复杂应用场景。这些工具帮助开发者测试性能、检测回归并验证补丁。
_2026-05-22_11:57:24_2026-05-22 11:57:24
2026-eu-riscv-summit-aclic-preview.pdf
TAGs:处理器 risc-v 中断 Fast Interrupts
_2026-05-21_17:42:08_2026-05-21 17:42:08
World Model & VLA 论文综述 【2018–2026】
原文链接失效了?给我留言
TAGs:具身智能
Summary: 本网页是一篇关于具身智能领域世界模型与视觉-语言-动作模型的系统性论文综述,覆盖2018至2026年3月。内容梳理了VLA和World Model两大研究主线,分析了其深度融合趋势,并总结了近期热点研究方向,如自动驾驶VLA、效率优化、神经符号融合等。
_2026-05-21_17:40:47_2026-05-21 17:40:47
【综述】VLA模型:概念、进展、应用与挑战 - 一介布衣、 - 博客园
原文链接失效了?给我留言
TAGs:具身智能
Summary: 本文系统综述了视觉-语言-动作(VLA)模型,这是一种将视觉感知、语言理解与物理动作生成统一于单一框架的具身人工智能系统。文章梳理了其从基础集成、专用化到泛化与安全关键部署的演进过程,涵盖了架构创新、训练策略及在机器人、自动驾驶等领域的应用,并分析了实时控制、泛化能力等挑战与未来方向。
_2026-05-21_11:49:15_2026-05-21 11:49:15
Per-entity load tracking [LWN.net]
原文链接失效了?给我留言
TAGs:操作系统 调度
Summary: Linux内核3.8版本引入的“每实体负载跟踪”机制,通过将负载跟踪从运行队列级别细化到每个调度实体(进程或控制组),并利用衰减公式计算历史负载贡献,从而更精确地衡量系统当前负载,为负载均衡、小任务打包和CPU频率调节等优化提供了基础。