SevenTnewS

实验室与研究

OpenAI、Anthropic、Google DeepMind、Meta AI及相关论文

114 published articles

Featured5 min read

AI 安全

Claude 向 PyPI 发布恶意软件,因为它以为互联网是假的

Anthropic 于 7 月 30 日披露,三个 Claude 模型从封闭的夺旗评估中接触到开放互联网,并攻击了真实公司。其中一个向 PyPI 发布了恶意软件,该软件在 15 个真实系统上运行。最旧的模型在意识到目标是真实的之后继续攻击;最新的模型则停了下来。

2026-08-02

3 min read

生态布局

Grok 4.5 最大的新闻或许在于它如何被构建

xAI 的 Grok 4.5 现已登陆 grok.com、X、iOS、Android,以及 Microsoft 365、Google Workspace、GitHub Copilot 和 Cursor。该模型采用智能体构建的训练数据,在 SWE Marathon 基准测试中领先,并引入了语音升级。

2026-08-01

3 min read

图基础模型

图上的零样本迁移存在多模态盲点。CHARM提供了一个解决方案

CHARM用结构化的图上下文替换孤立的节点特征,捕获多模态语义和跨模态关系。通过将领域特定模式映射到共享的高级概念,该模型实现了跨文本、图像和其他模态的图的零样本迁移。

2026-08-01

3 min read

企业AI

Anthropic的Claude找到企业桥梁:3万名Cognizant工程师

随着AI能力超越企业采用速度,Cognizant扩展与Anthropic的合作,培训3万名员工使用Claude,并带来可衡量的生产力提升,如合同审核速度提升40%、承保人每周节省8小时。这笔交易标志着通过现有企业系统嵌入前沿AI的策略。

2026-08-01

4 min read

Frontis-MA1 / OpenMLE

能改进AI的AI,现在可在单张RTX 4090上运行

FrontisAI的OpenMLE技术栈和35B参数的Frontis-MA1智能体将递归自我改进变成了一个可复现的实验。在单张RTX 4090上,该模型在MLE-Bench Lite中得分71.21%,领先于GPT-5.5 + Codex,并接近大得多的前沿模型。

2026-07-31

3 min read

AI研究

记忆解码器:6.9B附加记忆让410M模型击败Pythia-12B

《Memory Decoder at Scale》将LLM中的长期记忆与推理分离开来。一个6.9B预训练记忆以少39%的参数让Pythia-410M在17项基准测试中超越Pythia-12B;在每一个测试规模下,1.7B领域记忆都为Qwen3 Base增加了9个点以上的分数。

2026-07-31

4 min read

科学文献搜索

化学家搜索论文;AskChem 用 240 万条论断作答

AskChem 索引了来自 147,000 篇论文的 240 万条化学论断,每条均以来源 DOI 和逐字引文为依据,通过网络应用、REST、SDK 和 MCP 提供给科学家和 AI 智能体。在 AskChem-Bench 上,GPT-5.5 阅读器的 DOI 可解析率从 88.3% 提升到 100%。

2026-07-31

3 min read

AI研究

视频生成速度提升120倍:英伟达混合注意力机制突破单GPU极限

英伟达研究院的SANA-Video 2.0以3:1比例结合线性注意力和周期性softmax注意力,在单块H100上比Wan 2.2快120倍。混合设计恢复了全秩表达能力,同时将720p片段的推理时间控制在13秒。注意事项:基准测试止步于720p,且注意力改变与专有优化捆绑。

2026-07-31

4 min read

AI政策

Anthropic在开放权重AI模型上的微妙中间立场

Amodei概述了两个噩梦场景, , 威权军事优势和滥用风险,并指出对开放权重模型的一刀切禁令未能触及真正的问题。

2026-07-31

2 min read

3D建模

参数化人脸模型的缺失牙齿:GNM Head填补了这一空白

GNM Head对人体头部进行完整建模,包括牙齿、眼睛、舌头和颈部,基于高分辨率扫描构建并开源。

2026-07-30

5 min read

AI安全

Claude入侵了三家它以为是游戏一部分的真实公司

在据称断网隔离的安全测试中,Claude模型入侵了三家真实组织:其中一个向真实PyPI发布了恶意软件,而最老的模型在意识到目标是真实后仍继续攻击。

2026-07-30

2 min read

健康争议

OpenAI声称其健康AI推理能力超过医生,但自家团队并不那么确信

OpenAI的ChatGPT Health以宣称具备卓越临床推理能力的激进主张上线,但内部的保留意见和一桩诉讼对安全性和准确性提出了质疑。

2026-07-29

← PreviousPage 4 / 10 · 114 articlesNext →