SevenTnewS

北京大学

4 published articles

大语言模型与模型2 min read

AI研究

为什么你的AI导师看不出数学知识是如何层层递进的

北京大学的K12-Bench揭示,即使是最佳语言模型也几乎不理解学校概念之间的关联。57%和46%的得分显示了AI在处理先决条件链、概念分类和视觉基础方面的盲点, , 这些都是真实导师每天使用的技能。

2026-08-02

大语言模型与模型4 min read

LLM蒸馏

上下文一旦静止,LLM蒸馏便告停滞。这篇论文让它演化

上下文可以将任务偏好带入LLM训练,但一旦蒸馏进学生模型,它们便几乎不再提供监督。北京大学的Flux-OPD让上下文随学生一起移动,并用冲突项为教师修正加权。摘要报告称相较现有OPD范式有所提升,但没有给出数字。

2026-07-31

大语言模型与模型4 min read

研究摘要

结构化推理瓶颈超越提示魔法:LLM归纳任务中的新突破

一种名为“沙漏推理”(Hourglass reasoning)的新方法在归纳、演绎和实施阶段之间强制进行严格的上下文隔离,仅传递一个压缩的符号规则。在ARC-AGI-2上,它将最佳5次的准确率比迭代优化提高了多达14个百分点;在ChipBench Verilog综合任务中,使用GPT-5.5几乎将准确率翻倍。消融实验证实,拓扑结构本身驱动了改进。

2026-07-31

硬件与电子3 min read

硬件与电子

北京大学40纳米忆阻器芯片性能超越英伟达A100最高达478倍

北京大学与中国科学院的联合团队开发了一款神经形态芯片,其神经动力学处理速度比英伟达A100 GPU快50到478倍,而功耗仅为后者的极小部分。这款40纳米相变忆阻器芯片实现了毫秒级的实时神经动力学,为手术导航和大脑数字孪生打开了大门。

2026-07-16