全部安全开发新闻数码摄影汽车北京AIIT其他
  • 文章封面

    首个小时级实时交互的世界模型来了!无限世界,触手可及

    作者:机智流发布日期:2026-07-10 21:28:37

    当我们谈论“世界模拟”时,脑海中浮现的或许是精心设计的游戏关卡,或是影视作品中宏大的虚拟场景。然而,如果有一个系统,能够根据你的指令,实时、无限地生成一个视觉连贯、可交互的生动世界,并且这个世界能够持

    阅读全文
  • 文章封面

    刚说过的偏好,AI 转头就忘?阿里 NapMem 让AI智能体学会主动查记忆,更快更准

    作者:机智流发布日期:2026-07-09 22:29:22

    导读:刚说过的偏好,AI 下次就忘;反复强调的禁忌,它还是照犯。NapMem 的转折在于:它不再把记忆当成几条检索结果,而是让模型主动在用户画像、主题轨迹、记忆记录和原始对话之间查证。更有意思的是,拉

    阅读全文
  • 文章封面

    CSDI峰会开启:Agentic AI 落地应用的黄金期,智能系统重塑生产力

    作者:机智流发布日期:2026-07-09 22:29:22

    AI深入生产核心,用户端的发展方向已十分清晰,智能体将全面渗透产业。长远来看,智能体将演变为类似“AI操作系统”的复杂系统。用户只需下达任务,系统便能自动将任务拆解并协同多个智能体共同完成。可见技术底

    阅读全文
  • 文章封面

    机器人的“高考”来了:RoboDojo 统一评测平台,能否摸清通用机械臂的“真本事”?

    作者:机智流发布日期:2026-07-08 21:00:00

    一台机器人在厨房里准备早餐,它需要从碗中取出面包片放入烤面包机,再将两个小碗叠放到盘子上。这看似简单的任务,却要求机器人具备精准的抓取、稳定的放置、以及多步骤的逻辑规划能力。在实验室的模拟环境中,它或

    阅读全文
  • 文章封面

    WAIC 2026|嘉宾阵容公布:从模型、终端到基础设施,重新理解 AI 记忆

    作者:机智流发布日期:2026-07-08 21:00:00

    记忆张量MemTensor WAIC 2026 专题论坛嘉宾阵容正式公布。7 月 17 日,记忆张量MemTensor 将在 WAIC 2026 现场,上海世博展览馆 9 号会议室举办《从一次性 Ag

    阅读全文
  • 文章封面

    让多模态大模型“实时对话”更流畅:LiveServe如何优化交互式服务体验

    作者:机智流发布日期:2026-07-07 20:30:00

    在智能助手、实时翻译或客服对话等场景中,用户期望与多模态大模型进行如同真人般的流畅交流:用户一边说话,模型一边理解并生成语音回复,用户甚至可以在模型回复过程中随时打断。这种实时、多轮、支持打断的交互模

    阅读全文
  • 文章封面

    HAMi 晋升 CNCF 孵化项目:与全球开发者共建 AI 时代的异构算力基础设施

    作者:机智流发布日期:2026-07-07 20:30:00

    > 本文转载自「HAMi 社区」 HAMi 晋升 CNCF Incubating 项目2026 年 7 月 2 日,HAMi 正式晋升为CNCF Incubating(孵化) 项目,CNCF 技术监督

    阅读全文
  • 文章封面

    什么?!Hinton、LeCun、吴恩达、李飞飞等7位AI大佬突然合写了一篇“预算管理”论文?

    作者:机智流发布日期:2026-07-06 21:59:03

    > 作者:北辰昨天我收到一封 Google Scholar Alerts 邮件,标题是:The Effect of Forecasting and Budgeting Practices on Lon

    阅读全文
  • 文章封面

    跨越信任边界:大模型与小模型如何在医疗、金融等私域任务中协作?

    作者:机智流发布日期:2026-07-05 18:00:00

    > 本文来自社区投稿导读领域任务不只是缺一个更大的模型。在金融风控、医疗、企业知识库、城市智能和个人设备等场景中,系统既需要大模型的通用知识与推理能力,也需要小模型贴近本地数据、业务流程和部署资源。但

    阅读全文
  • 文章封面

    Claude Fable 5 不愿晚上加班干活

    作者:机智流发布日期:2026-07-04 10:52:51

    阅读全文
  • 文章封面

    技术之外,表达与思考同样重要

    作者:机智流发布日期:2026-07-02 20:00:00

    > 作者:李剑锋导读:如果你也经常需要讲课、汇报、答辩、面试,或者写一些希望别人认真读完的文章,那么 MIT 经典课程 How to Speak 就非常值得一看。它讲的并不只是“如何演讲”,而是如何把

    阅读全文
  • 文章封面

    ICML 2026 | 一个模型同时调度人、物、声、动作,多模态可控视频生成迈进工业级!

    作者:机智流发布日期:2026-07-01 20:00:00

    > 本文来自社区投稿摘要设想一条商品 AI 口播视频:主播得是指定的那张脸,手里的商品不能变形,嘴型要跟着声音走,表情和身体节奏也要自然,动作还得严格服从给定的 pose,最后整段画面还要和文本描述对

    阅读全文
  • 文章封面

    突破对话长度限制!南科大&阿里提出SwiftCache,让LLM多轮对话提速69%

    作者:机智流发布日期:2026-06-30 22:30:00

    图片由 AI 生成摘要在智能客服、多轮对话等场景中,大语言模型需要处理不断累积的对话历史。为了提升效率,系统通常会缓存历史对话对应的键值对(KV Cache),避免重复计算。然而,随着对话轮次增加,历

    阅读全文
  • 文章封面

    聊聊 Loop Engineering:如何高效可持续地构建 0-to-1 产品

    作者:机智流发布日期:2026-06-29 21:11:42

    最近 AI 编程圈里,一个词又开始刷屏了 — Loop Engineering。 Claude Code 的创始人 Boris Cherney 和 OpenClaw 之父 Peter Steinber

    阅读全文
  • 文章封面

    ACTION 2026 原力灵机开发者大会来了

    作者:机智流发布日期:2026-06-29 21:11:42

    原力灵机将于 2026.07.09 在北京召开开发者大会,届时会发布最新的模型,活动多多,欢迎具身智能开发者到现场互动!

    阅读全文
  • 文章封面

    告别千篇一律:分层记忆智能体如何打造真正懂你的PPT

    作者:机智流发布日期:2026-06-28 21:00:00

    在学术会议、商业路演或内部汇报中,一份优秀的PPT是成功沟通的关键。然而,从零开始制作一份既专业又符合个人风格的PPT,往往需要耗费大量时间和精力。尽管现有的AI工具已经能够根据文本生成幻灯片,但它们

    阅读全文
  • 文章封面

    Vibe Coding 闲谈:如何设计一套双层Loop 的 Harness系统

    作者:机智流发布日期:2026-06-27 23:27:21

    > 本文编译自外网把 SQL parser 重写一遍这种重活儿,听起来不该让 Agent 去干。因为Parser 是典型的"一个字符都不能错"的东西。PostHog 里尤其如此:用户直接写 SQL 查

    阅读全文
  • 文章封面

    ECCV 2026 | 视频生成模型,真的会「推理」吗?303 道题全面揭示世界模型的推理短板

    作者:机智流发布日期:2026-06-26 21:00:00

    > 本文来自社区投稿视频生成模型(Video Generative Models)是近年最炙手可热的方向。从 Sora、Veo 到 Kling、Seedance,它们能生成以假乱真的画面,对时间动态与

    阅读全文
  • 文章封面

    ms-swift 视觉大模型调优与部署实战(下):跑通 Qwen3-VL 微调全流程

    作者:机智流发布日期:2026-06-25 21:00:00

    > 作者:李剑锋上一篇我们已经完成了视觉大模型的基础概念、环境配置和 Qwen3-VL 调用实战。接下来这一篇会继续沿着工程落地链路往后走,重点放在数据集准备、LoRA 微调、adapter 推理、模

    阅读全文
  • 文章封面

    刚刚!OpenAI 自己造芯片了:Jalapeño 推理芯片成本省一半,剑指英伟达

    作者:机智流发布日期:2026-06-24 23:05:48

    SMARTFLOW AI · 前沿洞察OpenAI 把刀,捅向了英伟达的定价权2026 年 6 月 24 日 · OpenAI×Broadcom Jalapeño · 共 7 节一家做模型的公司,开始

    阅读全文
  • 文章封面

    重塑流式视频生成服务!生数与上交、清华联合推出TURBOSERVE:专为流式视频生成设计的首个服务系统,告别"卡顿"与"浪费"

    作者:机智流发布日期:2026-06-23 21:00:00

    在电影制作、广告创意或在线教育中,我们或许都曾有过这样的体验:输入一段文字描述,满怀期待地等待AI生成一段视频。传统的视频生成模型,如Sora、Veo等,通常以"离线、一次性"的方式工作:用户提交提示

    阅读全文
  • 文章封面

    ICML2026|多模态大模型具身能力诊断:NEU等机构提出技能级评估基准,揭示感知瓶颈与改进路径

    作者:机智流发布日期:2026-06-22 21:00:00

    当我们在家中拿起一个杯子,走向水槽并冲洗它时,这一系列看似简单的动作背后,涉及了复杂的感知、推理和规划能力。对于旨在与物理世界交互的智能体而言,这些被称为具身能力的技能至关重要。如今,多模态大语言模型

    阅读全文
  • 文章封面

    不学亏了!OAI和A社都在力荐,终于有人讲清楚了——Learn Harness Engineering

    作者:机智流发布日期:2026-06-21 21:00:00

    周末冲浪的时候,偶然发现一个开源的 Harness Engineering 教程,点进去一看——惊了。完全遵守 OpenAI 和 Anthropic 大厂的原意,没有自己胡编乱造,所有的概念、框架、实

    阅读全文
  • 文章封面

    ICML 2026|逻辑智能如何用合成数据训出 SOTA 低资源 TTS

    作者:机智流发布日期:2026-06-20 21:00:00

    > 本文来自社区投稿逻辑智能团队关于低资源语言 TTS 的研究论文被机器学习顶级会议 ICML 2026 接收。该工作证明,即使真实语音数据稀缺,合成数据也能训练出稳定、自然、可克隆的语音模型。作者丨

    阅读全文
  • 文章封面

    GTA-2: 从工具调用到真实工作流,重新定义通用智能体评测

    作者:机智流发布日期:2026-06-19 21:30:00

    > 本文来自社区投稿引言GTA-2 将智能体评测从原子级工具调用扩展到长程开放式工作流,在结果导向的评估框架下,统一衡量模型能力与执行框架(agent harness)的系统级表现。实验发现前沿模型工

    阅读全文
  • 文章封面

    ms-swift 视觉大模型调优与部署实战(上):VLM 基础与模型调用

    作者:机智流发布日期:2026-06-18 20:30:00

    > 作者:李剑锋1. 前言在前面的课程中,我们已经围绕大模型的使用与优化,学习了提示词设计、RAG 知识库问答、监督微调、模型部署以及模型测评等内容。通过这些内容,我们其实已经逐步建立起了一条比较完整

    阅读全文
  • 文章封面

    一文读懂后训练:从 RLHF 到 MOPD

    作者:机智流发布日期:2026-06-17 23:30:00

    > 作者:北辰这两天听了 Nathan Lambert 对 Finbarr Timbers 的访谈《Frontier Post-Training Recipe Review》[1],访谈中,两人一起回

    阅读全文
  • 文章封面

    EBench 最新榜单:Qwen-RobotManip 登顶,五维诊断显示更均衡的具身操作能力司南评测体系2026年6月17日 18:05 上海 听全文

    作者:机智流发布日期:2026-06-17 23:30:00

    > 本文转载自「司南评测体系」通用具身操作模型的竞争,正在从“谁的总分更高”,走向“谁的能力结构更完整”。今年 4 月,上海人工智能实验室(上海AI实验室)推出了面向具身操作模型的仿真评测框架 EBe

    阅读全文
  • 文章封面

    单核运行整个模型!AutoMegaKernel将Llama编译为持久协同内核,零手工CUDA代码

    作者:机智流发布日期:2026-06-16 21:30:00

    在当今的大语言模型推理部署领域,我们常常面临一个效率瓶颈。当你向模型输入一个提示词,等待它生成下一个词元时,传统的执行方式(如PyTorch)会为模型中的每一个算子(如线性层、注意力层、归一化层)单独

    阅读全文
  • 文章封面

    AI 写了 60% 的代码,为什么企业研发效率还是没飞起来?

    作者:机智流发布日期:2026-06-16 21:30:00

    来源 | InfoQ 作者 | AICon 全球人工智能开发与应用大会 策划 | 李忠良编辑 | 宇琪AI 代码生成率冲到 50%以上,研发周期却没变短;非研发人员开始用 Vibe Coding 写软

    阅读全文
下一页