今日动态

  • SLM-Arch:小型语言模型的权衡分析与优化硬件设计

    摘要AI 摘要要查看此AI生成的摘要,您需要高级访问权限。了解更多登录摘要摘要小型语言模型(SLMs)越来越多地被部署在资源受限的环境中,这推动了专用加速器的开发。然而,由于多样化的应用需求以及架构参数与工作负载特征之间复杂的交互作用,设计高效的SLM加速器仍然充满挑战。本文提出了一种闭合形式的解析模型,可精确评估SLM加速器在不同数据流和技术节点(例如28nm CMOS和7nm FinFET)下的延迟和能耗。该模型考虑了重复数据访问、处理单元(PE)之间的互连以及不同DRAM操作的能耗,从而实现了高仿真精度。验证结果表明,该模型在延迟方面的平均精度为96.0%,在处理单元阵列能耗方面为96.

    来源:ACM Transactions on Design Automation of Electronic Systems

    时间:2026-09-09

  • \(\pi\)LL:协调线性逻辑、\(\pi\)-演算及其元理论

    摘要AI摘要要查看此AI生成的摘要,您必须具有高级访问权限。了解更多登录摘要摘要Curry-Howard对应关系将自然演绎与λ-演算联系起来,这对类型化函数式语言产生了巨大的启发。这一研究由Abramsky在1994年发起,旨在为类型化并发语言寻找类似的基础,即通过线性逻辑[Girard 1987]与π-演算[Milner等人1992年]之间的联系来实现。最近的进展在类型和语法层面建立了牢固的对应关系。线性命题对应于会话类型[Caires和Pfenning 2010;Wadler 2014]——这些类型规定了进程的可观察通信行为[Honda 1993]——而π-演算的基本运算符对应于用超序列表

    来源:ACM Transactions on Computational Logic

    时间:2026-09-09

  • 一种面向热电能量收集的双触发自适应周期SIMO降压升压变换器及其混合零电流检测器

    摘要:本文提出了一种面向热电能量采集的带双触发自适应周期(DTAC)控制的降压-升压变换器。所提出的DTAC控制根据输入和输出节点的能源条件动态确定开关周期,同时根据输入能源条件自适应地调整导通时间,以将能量提取点维持在最大功率点附近。该变换器基于单电感多输出(SIMO)架构,借助储能电容 $C_{STO}$ 调节两个输出电压,该电容在放电阶段恢复残余电感能量。此外,设计了一种低功耗混合零电流检测器(H-ZCD),以准确检测电感的零电流点。该变换器采用180 nm CMOS工艺制造,有效面积为0.701 mm2。测量结果表明,该变换器的输入电压范围为0.1–0.5 V,负载功率范围为0.01–

    来源:IEEE Transactions on Circuits and Systems I: Regular Papers

    时间:2026-09-09

  • This response contains no information about the requested topic.

    摘要:本研究提出了一种节能的边缘视觉里程计加速器,可实现 130 fps 的视觉定位性能。该加速器采用具有 SIMD 计算范式的可编程近存计算架构,兼具低功耗与通用性。多精度可重构加法器和 2 的幂次位移器针对向量化的多精度处理进行了定制化设计,硬件开销较低。为了提升性能,我们对最适合该计算架构的关键算子进行了蒸馏,以实现 PicoVO 的高效部署。这些算子采用基于有限算术单元的简洁算法来实现。PicoVO 中的关键任务,即边缘检测和 Levenberg-Marquardt 求解器,均在片上完成,无需依赖外部存储器。得益于可编程性,这些任务得到了进一步优化。与 ARM Cortex-M7 处

    来源:IEEE Transactions on Circuits and Systems I: Regular Papers

    时间:2026-09-09

  • 功能性短时长轻度身体活动下儿童脑反应:来自近红外光谱(functional near-infrared spectroscopy, fNIRS)的见解

    轻度强度身体活动(light-intensity physical activity, LPA)指低努力水平、心率与呼吸轻度增加的活动,可支持儿童认知发展,尤其是负责注意与执行功能的脑区。研究人员采用功能性近红外光谱(functional near-infrared spectroscopy, fNIRS)考察短时段LPA对前额叶皮层(prefrontal cortex, PFC)活动的影响。33名10至14岁儿童完成坐姿、涉及协调与平衡的轻度强度练习,记录PFC三个亚区氧合血红蛋白(oxygenated hemoglobin, oxy-Hb)血流动力学变化。复杂任务中出现显著升高,中间PFC

    来源:Perceptual and Motor Skills

    时间:2026-09-09

  • 论命题动态逻辑与并发

    动态逻辑是一种推理程序和其执行的强有力方法,它通过对经典逻辑进行扩展,引入能够以公式形式表达程序执行的模态算子而获得。然而,在并发环境中使用动态逻辑一直存在困难,因为难以准确刻画交错(interleaving)行为。这一困难源于:传统上,程序由其迹(traces)集合表示;这些集合随后被表达为 Kleene 代数中的元素,而在需要建模交错时引入的交换律下,其相等性是不可判定的。在本工作中,我们将命题动态逻辑(PDL)推广为一个我们称之为操作性命题动态逻辑(OPDL)的逻辑框架。该框架突破了传统做法,将程序与其迹区分开来。迹由一个任意的操作语义生成,我们将该语义作为参数,从而使我们的方法适用于不

    来源:ACM Transactions on Computational Logic

    时间:2026-09-09

  • 揭示与缓解大语言模型生成内容对检索增强生成系统的影响

    在大型语言模型(LLM)时代,互联网上充斥着大量由LLM生成的内容,包括与人类撰写内容在事实上等价的对齐型LLM生成内容,以及存在事实偏差的扭曲型LLM生成内容。然而,目前对于此类内容对检索增强生成(RAG)系统的影响缺乏充分的理解和应对。RAG系统依赖于准确的检索知识来生成响应。本文全面评估了对齐型和扭曲型LLM生成内容对RAG系统检索阶段和生成阶段的影响。值得注意的是,我们发现扭曲型LLM生成内容不仅更可能被检索到,而且会显著降低生成质量,而对齐型内容在某些情况下反而可以增强生成效果。为此,我们提出了一种基于事实一致性感知的自适应过滤方法,用于从检索文档中有选择地过滤掉扭曲型LLM生成内容

    来源:ACM Transactions on Knowledge Discovery from Data

    时间:2026-09-09

  • 弹性约束固体复合材料有界载荷传递的刚度不变分数阶粘弹性模型

    摘要本文研究了一种完全粘结双相固体中的有界遗传载荷传递问题,其中弹性约束与具有蠕变活性的分数Maxwell相并联作用。相容性和平衡条件将双相问题简化为标量Caputo方程,该方程由记忆阶数α、特征时间τ和刚度不变量κ=Kv∕(Ke+Kv)支配。该简化具有分数标准线性固体的传递结构;因此,本文的贡献并非新的遗传核,而是一种分辨相的力学解释,将κ映射到几何和瞬时相刚度,并将物理总载荷与辅助有效输入区分开来。我们建立了唯一连续弱解和唯一绝对连续Caputo解,推导了Mittag–Leffler响应,并证明了有界性、凹性和单调相载荷传递。变形上限由κ决定,而趋近行为则通过τeff=τ∕(1?κ)1∕α

    来源:Mathematics and Mechanics of Solids

    时间:2026-09-09

  • ATSC 3.0 统一 SISO-MIMO 传输框架:设计、实现与验证

    摘要:高级电视系统委员会(ATSC)3.0 标准基于单输入单输出(SISO)传输,已在韩国和美国实现商业部署。对更高媒体质量和不断增长的数据流量的日益增长的需求,加上射频(RF)频谱稀缺,加剧了对多输入多输出(MIMO)技术的需求,该技术通过空间复用使单个 RF 通道内的数据速率几乎翻倍。然而,传统仅支持 SISO 接收机的广泛部署使得直接过渡到 MIMO 不可行,而巴西电视 3.0 标准最近将 MIMO 采纳为强制技术,进一步增加了对作为实用广播技术的 SISO-MIMO 频谱共享的兴趣。本文提出了一种统一的 SISO-MIMO 传输框架,使 SISO 和 MIMO 服务能够在单个 ATS

    来源:IEEE Transactions on Broadcasting

    时间:2026-09-09

  • 基于二阶采样的数据驱动控制系统稳定性保证

    本研究提出了一种基于采样的方法,用于保证含有不确定性的一般控制系统的概率鲁棒稳定性。该方法允许系统动力学和控制器由多种数据驱动模型表示,例如高斯过程和深度神经网络。对于非线性系统,稳定性条件涉及状态空间中无限多个状态上的不等式。基于采样的方法可以将这些难以验证的约束简化为在有限个状态上离散化的不等式。然而,这种简化需要余量来补偿离散化残差。较大的余量会降低稳定性评估的准确性,而为各种系统获取合适的余量具有挑战性。本研究通过推导包含数据驱动模型的各种非线性系统的二阶余量来解决这一挑战。由于所推导的余量大小随离散化间隔的减小而呈二次方减小,因此稳定性评估比使用一阶余量更为准确。此外,本研究通过将有

    来源:IEEE Transactions on Automatic Control

    时间:2026-09-09

  • 重新审视缓存淘汰机制:低开销且精确的学习型设计

    摘要AI 摘要要查看此 AI 生成的摘要,您必须拥有高级访问权限。了解更多登录摘要摘要缓存可减轻延迟和网络流量,而缓存性能在很大程度上取决于驱逐策略。驱逐效果通常通过字节和对象未命中率来衡量。尽管基于学习的驱逐策略可以减少未命中,但高昂的计算开销限制了其实际部署。本工作提出了 3L-Cache+,这是 3L-Cache 的扩展和精化版本。3L-Cache+ 是一种对象级基于学习的驱逐策略,在提供强大的整体未命中率性能的同时实现了较低的计算开销。为了降低开销,我们引入了两项关键技术。首先,我们设计了一种高效的训练数据收集方案,该方案过滤冗余请求并动态调整训练频率。其次,我们提出了一种轻量级驱逐方

    来源:ACM Transactions on Computer Systems

    时间:2026-09-09

  • 完善 Gelfond 的理性原则:迈向答案集语义更全面的基础性原则

    摘要AI 摘要要查看此 AI 生成的摘要,您必须拥有高级访问权限。了解更多信息登录摘要摘要非单调逻辑编程是声明式问题求解范式——答案集编程(ASP)的基础,其中问题的解由逻辑程序的预期模型(即答案集)编码。在 Gelfond 和 Lifschitz [45] 为简单正常逻辑程序提出的开创性定义之外,人们为扩展形式(如析取逻辑程序和认识逻辑程序)提出了各种答案集语义。在后者中,语义由称为世界视图的答案集集合构成。总体而言,似乎无法在形式上证明某个提案所定义的答案集/世界视图是否与任何由逻辑程序直观表示的问题的解完全对应。因此,有必要发展一些一般性原则,并将其作为基线,以便直观地比较和评估不同的答

    来源:ACM Transactions on Computational Logic

    时间:2026-09-09

  • 临时化难民保护:英国庇护与移民政策变化的心理健康及人权后果

    本社论考察英国工党政府继《2025年移民白皮书》与《2025年边境安全、庇护与移民法》(Border Security, Asylum and Immigration Act 2025)之后所引入的立法与政策变化的心理健康影响。Arnell在本刊撰文指出,尽管政府更迭,该立法延续了前任以执法(enforcement)为主导的路径,将预防、威慑与惩罚置于人权保护之上。风险显著:限制权利、加深脆弱性(precarity),并损害寻求庇护者及获授难民地位者的心理健康。在已有广泛健康危害证据基础上,本社论聚焦上述变化的心理健康影响、既患精神疾病者叠加风险,以及临床实践须置于其中的人权框架;这对临床医师

    来源:Medicine, Science and the Law

    时间:2026-09-09

  • 一种具有区域高效性、可综合实现的逆变器-延迟环数字转换器,具备提升的线性度

    摘要: 本文介绍了一种可完全合成、经过面积优化的时序-数字转换器(TDC),其线性度得到了提升。该转换器的架构采用基于循环逆器的延迟线(环形结构),并通过两个交替的周期计数器进行采样。这种紧凑的延迟线结构降低了硬件成本,并实现了高效的数字后处理。通过插入可选的虚拟逆器电容负载,进一步增强了延迟线的线性度。为了估算逆器传播延迟,提出了一种简单的校准方法。这款采用180纳米CMOS工艺制造的TDC原型占用面积为4500平方微米(μm2),在1.8伏电压和室温下工作时平均功耗为2.7毫瓦(mW)。它能够在3.2纳秒的全量程内实现52皮秒(ps)的分辨率,最大失调线性度(DNL/INL)为0.38/

    来源:IEEE Transactions on Circuits and Systems I: Regular Papers

    时间:2026-09-09

  • 高速率量化矩阵乘法 II

    摘要:这是关于量化矩阵乘法(MatMul)研究的第二部分工作。在第一部分中,我们探讨了无校准量化的情况,而本文则讨论在第二个因子的列的协方差矩阵 Σ_X 可用的设置下进行研究。该设置出现在大语言模型(LLM)的仅权重训练后量化这一普遍任务中。仅权重量化与加权均方误差(WMSE)信源编码问题相关,其经典的(反向)注水解决方案规定了如何在向量的各坐标之间分配速率。我们展示了如何利用注水方法来改进实际的LLM量化算法(GPTQ),该算法目前采用均匀分配速率的方式。我们对近期提出的一个仅使用标量INT量化器的方案(称为"WaterSIC")进行了分析,并证明其高速率性能具有以下特点:(a) 与基无关,

    来源:IEEE BITS the Information Theory Magazine

    时间:2026-09-09

  • OSCAR:一个具有精确功耗模型的开源灵活分层式人工智能加速器生成器

    摘要AI 摘要要查看此 AI 生成的摘要,您必须拥有高级访问权限。了解更多登录摘要摘要随着人工智能(AI)应用需求的增长,需要高性能且节能的 AI 芯片来支持计算。然而,由于可能的设计组合呈指数级增长,且在架构设计阶段准确建模多样化的数据流和工作负载对底层硬件的影响十分困难,架构级的 AI 芯片设计、PPA 评估和功耗估算仍然具有挑战性。我们提出了一种新颖的开源框架 OSCAR,该框架在给定一组硬件和工作负载规范的情况下,可提供架构级功耗估算,并能自动生成定制 AI 芯片的 Chisel 和可综合的 RTL。我们的贡献包括:(1) 一个灵活且具有层次结构的 AI 芯片设计空间、软硬件栈以及支持

    来源:ACM Transactions on Design Automation of Electronic Systems

    时间:2026-09-09

  • 大语言模型增强的知识图谱用于语义感知推荐

    知识图谱(KG)包含丰富的真实事实和与物品相关的信息,能够显著提高推荐的准确性和可解释性。然而,现有的基于知识图谱的方法主要关注利用基于ID的结构信息,这已显示出难以突破的性能瓶颈。事实上,知识图谱中还包含大量文本信息,如何利用文本信息以获得更高性能成为一个重大挑战。近年来,大语言模型(LLMs)已被证明具有强大的语义理解能力,为增强知识图谱提供了一种新方法。为此,本文提出了一种大语言模型增强的知识图谱(LAKG)模型,用于语义感知推荐,该模型引入大语言模型从关联文本中提取语义特征,以增强语义感知能力。首先,通过大语言模型从关联文本中提取用户和物品的语义特征。其次,通过图注意力网络从结构信息中

    来源:ACM Transactions on Knowledge Discovery from Data

    时间:2026-09-09

  • 流式 ZP-OTFS 宽带信道估计器的高吞吐量 RTL 设计

    本文提出了一种面向零填充正交时频空(ZP-OTFS)系统信道估计的低复杂度、资源高效的流式架构。该工作基于已有的基于保护间隔的线性插值算法,其创新之处在于流式硬件架构:所提出的设计通过部分并行插值方案在时延-时间域中重建信道冲激响应,在连续处理的同时利用OTFS信道矩阵的稀疏性来降低计算开销。该架构在VHDL中以RTL级别进行了描述,并通过AMD ZCU111板上的FPGA在环实验进行了验证。实验结果表明,该设计的延迟为44.10 μs,动态功耗为17 mW,每帧能耗为1.45 μJ,证实了在高移动性场景下实时且低功耗OTFS信道估计的可行性。定点实现与浮点参考结果高度一致,仅在QPSK、16

    来源:IEEE Transactions on Circuits and Systems I: Regular Papers

    时间:2026-09-09

  • 一种0.024 mm2工艺容差频率基准,在-40°C至125°C范围内实现7.6 ppm/°C的温度系数,加速老化后为9.6 ppm/°C

    本文提出了一种基于频率锁定环(FLL)的鲁棒、面积高效的频率基准,采用串并联双跟踪(SPDT)技术。为了实现二阶温度补偿并增强工艺偏差容忍度,提出了一种仅使用两种类型电阻器的混合补偿结构,并对其理论设计考量进行了详细分析。所提出的SPDT技术在工艺偏差下会引发工艺跟踪温度系数(TC)的偏移,从而在无需复杂微调网络的情况下显著降低工艺敏感性。原型采用180 nm标准CMOS工艺制造,占据紧凑的有源面积为0.024 mm2。在15个样品的实验结果表明,在仅进行TC1微调后,于?40 °C至125 °C的宽温范围内,平均温度系数为7.6 ppm/°C(σ = 0.7 ppm/°C)。此外,通过加速老

    来源:IEEE Transactions on Circuits and Systems I: Regular Papers

    时间:2026-09-09

  • 莎士比亚、熵与受过教育的猴子

    摘要:人们常说,而且说得很对——一只猴子在键盘上无休止地随机敲打,最终会打出莎士比亚的全部作品。几乎与这一说法同样频繁地被指出的则是,这个"最终"远远超出了任何可想到的相关时间框架。我们指出,一只受过教育的猴子——仍然随机打字,但只被约束写出"统计上典型"的文本——会以短得多的时间产出任意给定的一段文字。信息论提供了一种极其简单的方式来估算该时间。例如,莎士比亚《温莎的风流娘儿们》中的名句"宁愿早到三小时,不愿迟到一分钟",受过教育的猴子仅需七万三千年即可产出,而完全随机打字的那只需要 2.7×10?3 年之久。尽管改进显而易见,但要产出整部《哈姆雷特》,受过教育的猴子仍然需要无法想象之久的

    来源:IEEE BITS the Information Theory Magazine

    时间:2026-09-09


高级人才招聘专区
最新招聘信息:

知名企业招聘:

    • 国外动态
    • 国内进展
    • 医药/产业
    • 生态环保
    • 科普/健康