全部安全开发新闻数码摄影汽车北京AIIT其他
  • 文章封面

    百灵Ling & Ring 2.6技术报告发布:面向真实Agent工作流的高效万亿级模型

    作者:PaperWeekly发布日期:2026-06-24 18:08:24

    不久前,我们陆续发布并开源了百灵 2.6 系列模型,包括 Ling-2.6-flash、Ling-2.6-1T 和 Ring-2.6-1T。今天,我们正式发布 Ling & Ring 2.6 Tech

    阅读全文
  • 文章封面

    蚂蚁集团邀你相聚ACL 2026,共赴AGI冲浪者之夜!

    作者:PaperWeekly发布日期:2026-06-23 12:32:13

    🌟点击「阅读原文」,一键报名!

    阅读全文
  • 文章封面

    Nature Sensors首场直播 | 编辑与知名学者共话传感新前沿

    作者:PaperWeekly发布日期:2026-06-23 12:32:13

    从传感材料、器件设计,到信号处理、系统集成与数据分析,下一代传感技术正在深刻改变医疗健康、环境监测、智能制造、基础设施等关键应用场景。面向这一快速演进的前沿领域,施普林格·自然于 2026 年推出全新

    阅读全文
  • 文章封面

    普林斯顿陈丹琦组新发现:50%枢纽+50%长尾,才是预训练甜点位

    作者:PaperWeekly发布日期:2026-06-22 21:01:53

    预训练语料的价值,可能不只取决于文本质量,还取决于它在 Web 网络里的位置。大模型预训练一直在筛数据。过去筛的是文本本身:干不干净,重复不重复,质量高不高,属于哪个领域。普林斯顿陈丹琦组这篇新作,把

    阅读全文
  • 文章封面

    ACL 2026 | 大模型不必题题深思,腾讯混元让CoT推理按需开启

    作者:PaperWeekly发布日期:2026-06-22 21:01:53

    生成式奖励模型(Generative Reward Model,GRM)通过思维链(Chain-of-Thought,CoT)提示增强大语言模型(LLM)的推理能力,但其现有实现面临效率低下与奖励信号

    阅读全文
  • 文章封面

    刷屏数周后,陈德里的AutoResearch SKILL终于开源了

    作者:PaperWeekly发布日期:2026-06-19 14:43:22

    几篇 AutoResearch 论文刷屏之后,真正值得打开的 SKILL.md 终于放出来了。过去几周,很多人都在关注陈德里的 AutoResearch SKILL。最早让它出圈的,是一篇由他和两个

    阅读全文
  • 文章封面

    ACL 2026 | 腾讯混元发现「不完全学习」,SFT仍漏学15%训练数据

    作者:PaperWeekly发布日期:2026-06-19 14:43:22

    即使 SFT(Supervised Fine-Tuning,监督微调)训练已收敛、loss 已平稳、所有超参都调无可调,你的模型在训练集上重新测试——仍然有平均 15.3% 的样本答不对。这不是过拟合

    阅读全文
  • 文章封面

    3B小模型逼近Claude Opus 4.5:基准坏了,还是后训练太强?

    作者:PaperWeekly发布日期:2026-06-17 18:00:26

    一个基于 Qwen2.5-Coder-3B 的小模型,靠后训练在 AIME26、LiveCodeBench v6 等可验证任务上冲到前沿模型附近。3B 参数,本来应该是小模型的舒适区。能本地跑,成本低

    阅读全文
  • 文章封面

    不做里程计、不规划轨迹:无人机凭「感觉-运动」本能穿过5厘米窄缝

    作者:PaperWeekly发布日期:2026-06-17 18:00:26

    无需里程计、无需轨迹规划,仅凭一台单目相机和一个端到端神经网络,把「所见」直接变成「所动」——让无人机像猛禽穿林一样,看一眼便侧身钻过比自己还窄、且朝向未知的缝隙。苍鹰俯冲穿过树干间的缝隙时,从不会在

    阅读全文
  • 文章封面

    高质量Omni训练数据如何炼成?OmniVideo-100K打造音视频理解新数据

    作者:PaperWeekly发布日期:2026-06-16 12:23:48

    采用 Gemini-2.5/3.1-Pro API,通过“结构化剧本+证据链”生成 10 万条训练数据,VITA-1.5-7B、Qwen2.5-Omni-7B、Qwen3-Omni-30B 模型在 O

    阅读全文
  • 文章封面

    ICLR 2026 | 打破Next-Token短视,唤醒大模型前瞻推理潜能

    作者:PaperWeekly发布日期:2026-06-16 12:23:48

    今天的大语言模型,可能一直活在"只顾眼前"的诅咒里。Next-Token Prediction(NTP)无疑是一个英雄。它与 Transformer 一起,开启了大模型时代。每一步只预测一个 toke

    阅读全文
  • 文章封面

    顶会开头怎么写?拆解956篇CVPR Highlight,一文搞定摘要与引言

    作者:PaperWeekly发布日期:2026-06-15 20:15:52

    956 篇 CVPR Highlight 显示,好摘要和好引言并不是凭感觉写出来的。为什么要单独研究 abstract 和 intro?因为这两段很大程度上决定了审稿人会先如何理解你的故事和亮点。这两

    阅读全文
  • 文章封面

    8B Agent追近Claude,ToolCUA让桌面Agent学会调度

    作者:PaperWeekly发布日期:2026-06-15 20:15:52

    想象一个桌面 Agent 正在替你整理表格、配置浏览器、修改 VS Code workspace。它既能像人一样点击界面,也能直接调用工具完成结构化操作。这听起来像是一个更强的 Agent:看到按钮就

    阅读全文
  • 文章封面

    大模型Agent下一站:17篇核心论文,看Harness如何自进化

    作者:PaperWeekly发布日期:2026-06-12 22:13:04

    模型权重之外,Agent 的上下文、工具、记忆、失败修复和源码更新,正在成为新的能力来源。现在看一个 Agent 强不强,已经不能只看它背后的模型。它能看到哪些上下文,能调用哪些工具,动作如何被约束,

    阅读全文
  • 文章封面

    Agent安全对齐太贵?上海AI Lab开源AgentDoG 1.5,小模型也能强防御

    作者:PaperWeekly发布日期:2026-06-12 22:13:04

    引言当 Agent 开始自主调用工具、执行多步任务,安全风险的防御就不再只是一句简单的 Prompt 拦截。工程团队面临的核心挑战是:如何高效、可控地将安全规范对齐到 Agent 的复杂执行轨迹中?传

    阅读全文
  • 文章封面

    Transformer非得凑齐QKV吗?只需共享KV,推理缓存直降50%

    作者:PaperWeekly发布日期:2026-06-11 20:04:05

    不改注意力形式、不做推理后压缩,只让 K 和 V 共享投影,KV Cache 就能少掉一半。Transformer 的 Q、K、V 三套投影,早已是注意力机制的默认配置。Q 负责发起查询,K 负责匹配

    阅读全文
  • 文章封面

    ACL 2026 | 大模型也会相互甩锅?NUS用辩证对齐缓解归因偏差

    作者:PaperWeekly发布日期:2026-06-11 20:04:05

    本文在大模型 Agent 上观察到了社会心理学中反复验证过的行动者-观察者不对称现象,并构建了 AFB 基准来量化这一偏见。我们提出 ReTAS 模型,借助费希特辩证法的「正题、反题、合题」三步推理,

    阅读全文
  • 文章封面

    绕开时间反向传播!MIT挑战30年经典,RNN一步跨入并行时代

    作者:PaperWeekly发布日期:2026-06-10 14:03:09

    Transformer 擅长并行训练,RNN 擅长固定记忆。MIT 这项工作试图把两者接到一起。RNN 真的输给 Transformer 了吗?过去几年,序列建模的主角几乎一直是 Transforme

    阅读全文
  • 文章封面

    北大×百度提出RepoZero:只给API说明,让Agent从零复现完整仓库

    作者:PaperWeekly发布日期:2026-06-10 14:03:09

    RepoZero 是首个能够全自动、可验证、可扩展评估大语言模型从零开始生成完整代码仓库能力的基准测试系统。这项由北京大学与百度合作的研究成果,重新定义了 AI 代码生成的评估标准。论文标题:Repo

    阅读全文
  • 文章封面

    直播预告 | 复旦张景锋副教授:可信机器学习的攻防与挑战

    作者:PaperWeekly发布日期:2026-06-10 14:03:09

    PaperWeekly × 星弧 STARC 科研觉醒AI前沿讲座 直播主题 从攻击机理到防御之道:一场关于"可信机器学习"的深度对话 直播嘉宾 张景锋复旦大学可信具身智能研究院副教授 直播时间 2

    阅读全文
  • 文章封面

    代码真能让大模型更会推理吗?我们重新看了一组实验

    作者:PaperWeekly发布日期:2026-06-08 22:09:14

    一组 10T tokens 控制实验显示,纯代码能稳稳提升编程能力,却不一定带来更强复杂数学推理。过去几年,大模型训练里有个很常见的判断:多喂代码,模型会更会推理。这个判断听起来很顺。代码有语法、有结

    阅读全文
  • 文章封面

    轻量×隐私友好:看骨识人,南洋理工首发「3D骨架行人重识别」全景图谱

    作者:PaperWeekly发布日期:2026-06-08 22:09:14

    从几十个 3D 关节点出发,AI 正在绕开人脸与外观,重新定义行人重识别的技术边界。在安防监控、医疗健康和具身智能等场景中,目标身份的精准识别始终是机器视觉领域的核心技术。传统方法高度依赖外观或面部特

    阅读全文
  • 文章封面

    AID | 清华刘静×南航陈森:存储器正在“变软”,开启人机融合新路径

    作者:PaperWeekly发布日期:2026-06-08 22:09:14

    当存储器“变软”:从结绳记事到液态金属,柔性存储开启人机融合新路径Flexible Memory: Progress, Challenges, and Opportunities扫描二维码阅读原文ht

    阅读全文
  • 文章封面

    Opus 才敢接的科研任务,国产大模型也能扛住吗?

    作者:PaperWeekly发布日期:2026-06-05 18:06:04

    如果一个模型能读论文、跑实验、做 Poster、处理报告视频,它离“科研助手”还有多远?现在很多自动化科研项目里,默认选择仍然是 Opus、GPT 这类闭源旗舰模型。倒不是大家迷信海外模型,而是科研任

    阅读全文
  • 文章封面

    浙大×阿里云首发Token经济学综述:重估LLM Agent的Token世界

    作者:PaperWeekly发布日期:2026-06-05 18:06:04

    近日,浙江大学计算机学院、经济学院、区块链与数据安全国家重点实验室联合阿里云发布综述论文《Token Economics for LLM Agents: A Dual-View Study from

    阅读全文
  • 文章封面

    AI科研绘图终于开窍了:出图就是可编辑SVG

    作者:PaperWeekly发布日期:2026-06-04 13:46:05

    AI 画图终于不只停在 PNG 了:生成之后,还能继续变成可编辑 SVG。现在让 AI 先画一版论文配图,已经不算难事。方法图、架构图、poster 配图,给模型一段说明文本,往往能出一张看起来不错的

    阅读全文
  • 文章封面

    连播5场!美团四大顶会32篇论文,拆解大模型与Agent前沿

    作者:PaperWeekly发布日期:2026-06-04 13:46:05

    点亮👆“☆”星标,不错过推送内容~2026年,美团技术团队数十篇论文被 ACL、SIGIR、ICML、KDD 等顶会收录,我们近期将精选 32 篇文章,分成 5 大专场进行解读。内容涵盖大模型推理、智

    阅读全文
  • 文章封面

    Anthropic参与新论文:大模型为何学得更多?答案藏在Scaling里

    作者:PaperWeekly发布日期:2026-06-03 19:19:11

    这篇论文给出一个数据中心视角:大模型更强,不只因为能表示更多,也因为更能保留长尾任务。大模型为什么比小模型强?参数更多、数据更多、算力更多,模型能力也随之提高,似乎已经成了过去几年大模型发展的稳定经验

    阅读全文
  • 文章封面

    不要再卷同源蒸馏了!简单微调分词方式,轻松实现跨架构OPD

    作者:PaperWeekly发布日期:2026-06-03 19:19:11

    不动损失函数、不加参数、不做最优传输,仅仅换掉一个集合的定义,跨分词器蒸馏在 12 个评测格子上全部刷新——中科大团队提出 SimCT,把跨分词器蒸馏的天花板抬到了新的位置。On-Policy Dis

    阅读全文
  • 文章封面

    8个Agent也能稳定收敛,信任域约束重塑多Agentic工作流 | ICML 2026

    作者:PaperWeekly发布日期:2026-06-02 21:31:11

    多 Agentic 工作流正在从推理时协作走向统一训练,TeamTR 用信任域约束给出了稳定微调方案。多智能体 LLM 系统正在从多智能体辩论(Multi-Agent Debate)走向“智能体工作流

    阅读全文
上一页下一页