
青年AI研究员idea加油站,AI开发者的新能源充电桩!
| 直播时间 | 主讲人 | 主题 | 直播/回放观看链接 | PPT |
|---|---|---|---|---|
| 2026.09.17 | 清华大学博士生何秉翔 | Rethinking On-Policy Distillation of Large Language Models | ||
| 2026.09.12 | 圣路易斯华盛顿大学博士生黄呈松 | EnvHarness:左脚踩右脚!让环境随着 Agent 的训练一起进化 | ||
| 2026.09.08 | 香港中文大学博士、华为莱布尼茨研究所研究员杜一鸣 | Lego-RL:面向真实 Coding Agent 的 Harness-Native 强化学习方法 | YouTube Bilibili | link |
| 2026.09.05 | 伊利诺伊大学香槟分校 (UIUC) 二年级博士生钱成 | AI4AI at Test-Time:从 Harness 看 AI4AI 如何实现以及未来 | YouTube Bilibili | link |
| 2026.09.01 | 上海人工智能实验室物理智能中心青年研究员周云松 上海人工智能实验室物理智能中心青年研究员王帅 | 从“如何生成”到“如何验证”,探讨物理一致世界模型如何实现可扩展机器人学习 | YouTube Bilibili | |
| 2026.08.29 | NUS 博士生张桂彬 | 模型的“什么经验值得被看见”?LOPD:不再手动设计 OPSD 特权信息 | ||
| 2026.08.25 | NVIDIA Research 研究科学家,前 MIT CSAIL 博士后研究员毛伟岸 | TriAttention:面向长推理的三角级数式 KV Cache 压缩 | YouTube Bilibili | link |
| 2026.08.22 | 北京大学人工智能研究院博士生李珩立 | LatentSeek & GradCuit:从价值引导的隐空间优化看大语言模型推理 | YouTube Bilibili | link |
| 2026.08.13 | 衔远科技算法研究员、清华大学博士生姜澈 | AI for AI 的前世今生:从进化、自进化与元进化,迈向递归自我改进(RSI) | YouTube Bilibili | |
| 2026.08.11 | 新加坡国立大学(NUS)计算学院博士生李一博 | Agentic RL 下半场:无需梯度更新的即时强化学习JitRL | YouTube Bilibili | |
| 2026.08.08 | 清华大学深圳国际研究生院硕士在读张翼显 | 从端到端 VLA 到 Harness VLA:面向具身智能与机器人操作任务的记忆增强式执行框架 | YouTube Bilibili | |
| 2026.08.06 | 新加坡南洋理工大学(MMLab@NTU)博士后研究员操雨康 | 新一代具身智能数据范式ACE-Data-0:以人为中心的环境式采集构建具身数据引擎 | YouTube Bilibili | |
| 2026.08.04 | 上海交通大学人工智能学院博士生林涛 | LA4VLA:从 VLA 预训练中解耦语言-动作监督 | YouTube Bilibili | link |
| 2026.08.01 | 通义千问(Qwen)团队研究员陈雄辉 | Alignment unlocks Scaling:Qwen-Robot Suite 的设计原理和背后的思考 | YouTube Bilibili | |
| 2026.07.28 | 清华大学数学系四年级博士生王颢宁 巴黎萨克雷高等师范学院 MVA 研究生刘懿玮 | 在线自进化后训练框架 DRIFT:没有外部专家监督时,如何让 OPD 策略学会自我持续进化 | YouTube Bilibili | |
| 2026.07.25 | 中关村学院联合培养博士生陈佳磊 | LaWAM:隐空间世界动作模型!不生成未来视频,也让机器人拥有"物理预见力" | YouTube Bilibili | link |
| 2026.07.21 | 北京中关村学院与中科院自动化所联培博士生刘志豪 | STEAM:面向真实世界机器人学习的、无需人工标注的帧级优势估计框架 | YouTube Bilibili | link |
| 2026.07.15 | 新加坡南洋理工大学(MMLab@NTU)博士后研究员许牧天 | Kinema4D:面向时空具身仿真的运动学 4D 世界建模 | YouTube Bilibili | |
| 2026.07.11 | CMU 博士研究生赖睿航 | PithTrain:Agent 时代的 MoE 训练框架设计 | YouTube Bilibili | |
| 2026.07.04 | 复旦大学计算与智能创新学院23级硕士研究生张世铎 | 如何设计一个好的自回归 VLA:从问题构建到工程落地的探索之旅 | YouTube Bilibili | link |
| 2026.06.30 | 清华大学人工智能学院博士生方科晨 | DPA & LLaVA-HUD v4:多模态大模型的深度预对齐与高效视觉编码优化 | YouTube Bilibili | |
| 2026.06.27 | Mind Lab Research Scientist,Head of Infrastructure,清华大学博士陆逸文 | MinT: 面向百万级 LoRA 策略的训练与推理基础设施 | YouTube Bilibili | |
| 2026.06.23 | vLLM-Omni和VeRL-Omni开源社区核心贡献者,香港科技大学博士,华为莱布尼茨研究所Research Scientist黄永祥 | VeRL-Omni:面向多模态生成模型的高效RL后训练框架 | YouTube Bilibili | |
| 2026.06.16 | 北大博士生孟繁续 | 从 MLA 到 GQLA:无需从头训练,硬件自适应高效注意力机制 | YouTube Bilibili | link |
| 2026.06.13 | 新加坡国立大学(NUS)计算机科学在读博士吴林昱 | UniRL:面向统一多模态模型的分布式 RL 后训练框架 | YouTube Bilibili | |
| 2026.06.09 | 清华大学博士生吕兴泰 | ZEDA:将 Post-Trained MoE 迁移为高效动态 MoE | YouTube Bilibili | link |
| 2026.06.06 | 中国人民大学高瓴人工智能学院博士在读董冠霆 | 从 ARPO,到 AEPO,再到 Agent-World:探索通用智能体训练的可行路径 | YouTube Bilibili | |
| 2026.05.26 | 南洋理工大学一年级博士生、Mind Lab 研究员雷京迪 | δ-mem:从长上下文到在线记忆,动态演化原生记忆的一次尝试 | YouTube Bilibili | link |
| 2026.05.19 | 南洋理工大学(NTU)MMLab 博士生罗奕航 | STream3R & 4RC: 面向几何与运动理解的流式前馈 3D/4D 重建 | YouTube Bilibili | link |
| 2026.05.16 | 自动化所深度强化学习团队博士生傅宇千 | 重探 On-Policy Distillation(OPD):三类典型失败以及修复路径 | YouTube Bilibili | link |
| 2026.05.12 | 中科大与上海AI Lab联培博士生谭泽霖 | 大模型强化学习的 Scaling Law | YouTube Bilibili | link |
| 2026.05.09 | SGLang框架核心开发者和维护者张柏舟 | DeepSeek V4 模型在 SGLang 中的系统级优化与全栈适配 | YouTube Bilibili | link |
| 2026.04.27 | 清华大学博士生何秉翔 | 从 TTRL 到 URLVR:大模型的无监督强化学习还能走多远? | YouTube Bilibili | link |
| 2026.04.21 | 中科院自动化所模式识别实验室在读博士生田浩辰 | SimScale:大规模真实世界仿真重塑端到端自动驾驶学习范式 | YouTube Bilibili | link |
| 2026.04.14 | MMLab@NTU 博士生伍晓鸣 | VLANeXt:12条设计准则,从入门到精通的 VLA 终极“配方” | YouTube | link |
| 2026.04.11 | 达特茅斯学院计算机科学在读博士马驰宇 | FIPO & Future-KL:突破大语言模型在复杂推理中的性能瓶颈 | YouTube Bilibili | link |
| 2026.04.07 | 新加坡南洋理工大学 MMLab 与 S-Lab 博士后研究员廖康 | Puffin: 统一多模态空间智能大模型——从任意视角理解和生成世界 | YouTube Bilibili | link |
| 2026.03.31 | 芝加哥大学二年级博士生王胤杰 | OpenClaw-RL: 结合 GRPO + OPD,在使用中自适应变强的龙虾 | YouTube Bilibili | link |
| 2026.03.28 | CUHK MMLab PhD 二年级在读杨佳智 | RISE: 组合式世界模型,在“想象”中实现机器人策略的自主进化 | YouTube Bilibili | link |
| 2026.03.24 | 中国科学技术大学少年班本科生徐哲轩 | 从Depth Scaling到Width Scaling!WideSeek-R1:通过MARL探索大模型的广度扩展 | YouTube Bilibili | link |
| 2026.03.20 | 麻省理工学院(MIT)博士后研究员周恺辰 | 从 VGGT 到 PAGE-4D:动态世界中的 3D 感知统一框架 | YouTube Bilibili | link |
| 2026.03.17 | 新加坡国立大学计算机系博士生、水杉智算技术联合创始人万政霖 | 面向对象的 Agent Infra 新范式:有状态运行时管理的设计与工程实践 | YouTube Bilibili | link |
| 2026.03.14 | 清华大学在读博士生吴科明 | EditReward : 当 AI 学会“审美”,可控多模态生成的下一代范式 | YouTube Bilibili | link |
| 2026.03.10 | 清华大学交叉信息研究院本科生臧宏之 | RLinf-USER:面向现实世界机器人在线策略学习的统一且可扩展系统 | YouTube Bilibili | |
| 2026.03.07 | 香港科技大学(HKUST)在读博士生刘威 | Dr. Kernel: 突破大模型 GPU Kernel 生成的多轮 RL 训练瓶颈 | YouTube Bilibili | link |
| 2026.03.03 | 香港城市大学数据科学系博士生王天乐 | 线性轨迹:揭示 LLM 强化学习中的高效捷径 | YouTube Bilibili | link |
| 2026.02.28 | MIT本科生 Iris Xu | BOAD:引入多臂老虎机,自动化搜索层级结构的多 Agent 架构设计 | YouTube Bilibili | |
| 2026.02.03 | 清华大学博士生何秉翔 | JustRL: 用"最笨"的 RL 方法刷新 1.5B 推理模型新基线 | YouTube Bilibili | link |
| 2026.01.30 | 香港科技大学博士候选人、 NVIDIA 研究实习生刘诗扬 | GDPO:解决 GRPO 在多奖励 RL 训练中的"优势崩溃"问题 | YouTube Bilibili | link |
| 2026.01.27 | 上海人工智能实验室具身智能中心青年科学家曾嘉 | InternVLA-A1,虚实贯通:理解、生成、执行一体化的具身操作大模型 | YouTube Bilibili | link |
| 2026.01.20 | 南洋理工大学 MMLab 实验室博士生范洧辰 | The Prism Hypothesis 视觉统一表征假说:从语义到像素的统一自编码(UAE) | H5 YouTube Bilibili | link |
| 2026.01.13 | 阿里巴巴通义实验室实习生、西北工业大学本科&香港科技大学预备博士姜登阳 | Decoupled DMD & DMDR: 在扩散模型步数蒸馏的实践及 Z-Image-Turbo 应用 | H5 YouTube Bilibili | link |
| 2026.01.10 | 通义千问算法工程师高畅 | 从 TRPO 到 SAPO:大模型 RL 算法演进 | H5 YouTube Bilibili | link |
| 2026.01.06 | MiniMax算法工程师、通用模型后训练负责人程威宇 | MiniMax M2.1:Agent 后训练经验与认知 | H5 YouTube Bilibili | link |
| 直播时间 | 主讲人 | 主题 | 直播/回放观看链接 | PPT |
|---|---|---|---|---|
| 2025.12.26 | 青稞‘s | 2025 “青稞” AI 嘉年华 | YouTube Bilibili | |
| 2025.12.20 | 大厂研究科学家Yingru Li | TRPO重生:大模型时代的信任域策略优化 | YouTube Bilibili | |
| 2025.12.16 | 香港大学MMLab博士生陈俊松 | SANA-Series:探索图像视频扩散模型的高效设计与加速 | H5 YouTube Bilibili | link |
| 2025.12.13 | SeaAI Lab 研究工程师、新加坡国立大学博士生齐朋辉 | 从 BF16 到 FP16:如何解决RL训练-推理不匹配问题 | H5 YouTube Bilibili | link |
| 2025.12.09 | 香港大学MMLab博士生吴成岳 | Fast-dLLM v2:高效训练推理的块扩散大语言模型框架 | H5 YouTube Bilibili | link |
| 2025.12.06 | 北京大学博士生陈康 | 从 $π_0$ 到 $π_{RL}$:面向流匹配 VLA 的强化学习后训练框架 | H5 YouTube Bilibili | link |
| 2025.12.02 | 清华大学交叉信息研究院本科生臧宏之 | RLinf-VLA 实践:从零上手 VLA(OpenVLA )强化学习 | H5 YouTube Bilibili | link |
| 2025.11.29 | 清华大学博士生张金涛 | SageAttention & Sparse-Linear Attention & SpargeAttention:通过量化与稀疏性实现高效注意力机制 | H5 YouTube Bilibili | link |
| 2025.11.25 | 无问芯穹首席研究员林灏 | RLinf:面向具身智能的“渲训推一体化”开源强化训练框架 | H5 YouTube Bilibili | link |
| 2025.11.22 | 清华大学计算机系副教授章明星、KTransformers项目核心参与者李沛 | KTransformers,在大模型微调与推理中的系统化实践 | H5 YouTube Bilibili | link |
| 2025.11.18 | 同济大学计算机学院博士生刘洪博 | ShotBench: 面向增强MLLM摄影语言理解能力的训练与评估体系 | H5 YouTube Bilibili | |
| 2025.11.15 | 北京大学博士生周嘉懿 | Generative RLHF-V: 面向多模态 RLHF 的人类意图对齐框架 | H5 YouTube Bilibili | link |
| 2025.11.11 | 华中科技大学&华为联培博士生吴官骏 | UniLat3D:几何–外观统一VAE的单阶段 3D 生成框架 | H5 YouTube Bilibili | link |
| 2025.11.08 | 香港大学直博生黄炜 | RL 训练框架:QeRL,量化技术增强强化学习 Reasoning 探索 | H5 YouTube Bilibili | link |
| 2025.11.06 | 清华博士生程家乐 | 从 DeepSeek-OCR 到 Glyph:深入理解图像-文本压缩技术 | H5 YouTube Bilibili | link |
| 2025.11.04 | NUS AI Researcher 倪瑾杰 | OpenMoE2 :Sparse Diffusion Language Models | H5 YouTube Bilibili | link |
| 2025.11.01 | 清华大学博士生李昊展 | SimpleVLA-RL:简单可拓展的VLA强化学习训练 | H5 YouTube Bilibili | link |
| 2025.10.28 | 清华大学博士生吕兴泰 | 统一 SFT & RL:迈向大型语言模型后训练的统一视角 | H5 YouTube Bilibili | link |
| 2025.10.25 | 香港大学 XLANG Lab 计算机科学博士生王心远 | OpenCUA:用于构建 Computer-Use Agent 的开源框架 | H5 Youtube Bilibili | link |
| 2025.10.21 | 清华大学博士生张开颜 | RL for LRMs:探讨面向推理模型的 RL 最新研究 | H5 YouTube Bilibili | link |
| 2025.10.18 | 伊利诺伊大学香槟分校 (UIUC) 博士生钱成 | UserRL & UserBench-“知人者智”:以用户为中心的智能体交互与训练 | H5 YouTube Bilibili | link |
| 2025.10.16 | 新加坡国立大学博士生张桂彬 | MemGen:生成式隐式记忆,Agent Memory 的第三种可能 | H5 YouTube Bilibili | link |
| 2025.09.18 | 新加坡国立大学博士生张桂彬 | 从 LLM-RL 到 Agentic RL:如何让语言模型成为自主智能体 | H5 YouTube Bilibili | link |
| 2025.09.09 | 香港中文大学王鸿儒博士 | Theory of Agent: From Definition, to Behavior and Objective | H5 YouTube Bilibili | link1 link2 |
| 2025.09.06 | 英伟达NeMo团队高级深度学习算法工程师李之愈,以及高级产品经理高文雯 | NeMo RL:让大规模 MoE 模型权重 Refit 加速 10 倍 | H5 YouTube Bilibili | link |
| 2025.08.30 | 加州大学圣地亚哥分校(UCSD)博士生姚峰 | FlashRL:探讨现代 RL 框架中推理与训练的错位问题及解决方案 | H5 YouTube bilibili | link1 link |
| 2025.08.23 | 王维埙博士,淘天集团未来生活实验室 算法专家 熊绍潘硕士,爱橙科技智能引擎算法平台 大模型强化学习框架工程师 | ROLL:面向 Agentic 场景的生产级大规模强化学习训练框架 | H5 YouTube Bilibili | link |
| 2025.08.19 | 马里兰大学博士生陈玖海 | 从BLIP3o到BLIP3o-NEXT:迈向统一生成与理解的多模态大模型 | H5 YouTube Bilibili | link |
| 2025.08.16 | 西湖大学修宇亮实验室访问学生李博谦 | ETCH: 通过等变紧度向量将人体拟合推广到穿衣人体的方法 | H5 YouTube Bilibili | |
| 2025.08.12 | 清华大学自然语言处理实验室博士生余天予 | RLPR:基于参考概率奖励的强化学习,推广 RLVR 到通用领域推理问题 | H5 YouTube | link |
| 2025.08.09 | 南洋理工大学MMLab博士生田淑琳 | Evaluation Agent:面向视觉生成模型的高效可提示的评估框架 | H5 YouTube | link |
| 2025.08.07 | 通义千问研究员,Qwen3、QwQ系列开源模型核心贡献者郑楚杰博士 | GSPO:大规模强化学习训练算法,迈向持续拓展的语言模型强化学习 | H5 YouTube | |
| 2025.08.05 | Sea AI Lab(新加坡)算法工程师,新加坡国立大学博士生万信逸 | 大模型训练流水线并行四部曲:吞吐、内存、负载均衡与线性扩展 | H5 YouTube | link |
| 2025.08.02 | 智谱 AI RL Infra 工程师、slime 开源项目作者朱子霖 | slime:专为 RL Scaling 设计的大规模 RL 训练框架及实践 | H5 YouTube | link |
| 2025.07.26 | 香港城市大学计算机科学在读博士生陈胜庄 | SIMoE:稀疏插值混合专家,大模型升级再造的自动化专家发现框架 | H5 YouTube | link |
| 2025.07.22 | 香港中文大学(深圳)GAP实验室博士生叶崇杰 | Hi3DGen:法线为桥,为高清三维几何生成另辟蹊径 | H5 YouTube | |
| 2025.07.19 | 纽约大学访问学生尹柏乔和西北大学博士生王启能 | MindCube:空间智能的实现路径,探究 VLMs 构建稳健空间心理模型的能力 | H5 YouTube | link |
| 2025.07.15 | 华南理工大学与IDEA 联合培养博士蒋擎 | ChatRex/RexSeek/Rex-Thinker:结合多模态大语言模型的目标检测模型构建 | H5 YouTube | link |
| 2025.07.12 | 英伟达公司研究员刁诗哲 | ProRL: 延长强化学习训练框架,拓展大语言模型的推理边界 | H5 YouTube | link |
| 2025.07.08 | 南洋理工大学MMLab博士生吴鹏浩 | GUI-Reflection:让多模态 GUI 智能体获得反思纠错能力的训练框架 | H5 YouTube | |
| 2025.07.05 | 新加坡科技设计大学 博士生曾广韬 | Satori-SWE:用 Evolutionary Test-Time Scaling 让小语言模型解决复杂软件工程 | H5 YouTube | link |
| 2025.07.01 | 北京大学博士生张宇臣 | 大模型推理强化学习中的熵机制 | H5 YouTube | link |
| 2025.06.28 | 马萨诸塞大学阿默斯特分校周沁泓博士和张洪鑫博士 | Virtual Community 虚拟社区:面向人、机器人与社会的开放世界 | H5 YouTube | |
| 2025.06.24 | 香港大学MMLab博士生吴成岳 | Fast-dLLM:无需重训的扩散大语言模型推理加速 | H5 YouTube | link |
| 2025.06.21 | 复旦大学博士生王玮赟 | InternVL3,GPT-4o开源平替:探索多模态通用感知大模型的技术演进与应用探索 | H5 YouTube | link |
| 2025.06.16 | 新加坡国立大学博士生张扬 | 生成模型中的极简概念擦除 | H5 YouTube | |
| 2025.06.12 | 中国科学院博士黎昆昌 | BAGEL:统一生成理解的多模态基础模型 | H5 YouTube | link |
| 2025.06.09 | 微软亚洲研究院高级研究员宋恺涛 | Chain-of-Model (模型链):引入因果建模,全新的大模型 Scaling 结构 | H5 YouTube | link |
| 2025.05.29 | 加州大学伯克利分校计算机科学博士生席浩诚 | Sparse VideoGen:无需重新训练的 DiTs 推理加速框架 | H5 YouTube | |
| 2025.05.26 | 青稞社区联合创始人高岱恒 | EraseAnything:在 Flux 等先进文生图架构的概念擦除方法 | H5 YouTube | link |
| 2025.05.22 | 北京大学智能学院博士生节世博 | MoLE & SpeCache:大语言模型端侧部署的架构与算法 | H5 YouTube | link |
| 2025.05.19 | verl core contributor 童雨轩 | verl 源码解读 与 HybridFlow 编程范式讲解 | H5 YouTube | link |
| 2025.05.14 | 清华大学博士生张开颜 | 从 TTS 到 TTRL:无标签数据强化学习探索与展望 | H5 YouTube | |
| 2025.04.26 | 华中科技大学硕士在读、MMlab@NTU研究助理刘天齐 | Free4D:无需微调的 4D 场景生成新框架 | H5 YouTube | |
| 2025.04.22 | UC Berkeley 博士生潘家怡和李岫宇 | 从 TinyZero 到 APR:语言模型推理能力的探索与自适应并行化 | H5 YouTube | link |
| 2025.04.19 | 香港科技大学(HKUST)计算机系博士生曾伟豪 | B-STaR & SimpleRL-Zoo:通过强化学习自我提升推理性能和效率 | H5 YouTube | link |
| 2025.04.04 | 加州大学圣地亚哥分校计算机科学与工程系副教授张怡颖 | InferCept、Preble & Cognify:面向下一代 AI Agent 工作流系统的构建 | H5 YouTube | link |
| 2025.03.29 | UTS ReLER lab博士生杨向鹏 | VideoGrain:基于扩散模型的多粒度视频编辑的探索与应用 | H5 YouTube | link |
| 2025.03.22 | 加州大学伯克利分校计算机科学博士生席浩诚 | COAT:显存高效的 FP8 训练,实现高效深度学习 | H5 YouTube | link |
| 2025.03.15 | 阿里通义实验室高级算法工程师张熙 | PC-Agent:面向复杂 PL 任务的多模态智能体框架 | H5 YouTube | |
| 2025.03.08 | 商汤科技大模型工具体系团队研究员、LightLLM 核心开发人员白世豪 | 基于 LightLLM 的 DeepSeek R1/V3 模型部署实战 | H5 YouTube | link |
| 2025.02.22 | 上海人工智能实验室青年科学家崔淦渠 | PRIME: 结合隐式过程奖励的强化学习 | H5 YouTube | link |
| 2025.02.15 | MIT博士生沈茂昊 | Satori:通过训练LLM做自回归搜索来增强推理能力 | H5 YouTube | link |
| 2025.01.14 | 香港科技大学(广州)博士生许添硕 | Motion Dreamer:面向自动驾驶与物理世界对齐的视频生成模型 | H5 YouTube bilibili | |
| 2025.01.04 | 香港科技大学计算机博士生马跃 | Follow Family:可控视频生成方法探索与应用 | H5 YouTube bilibili | |
| 2024.12.28 | 香港科技大学广州博士生周子凯 | Tuning-Free Enhence:通过噪声初始化和采样轨迹优化增强预训练扩散模型 | H5 YouTube | link |
| 2024.12.24 | 中国科学院自动化研究所博士生、新加坡国立大学访问博士生李志凯 | K-Sort Arena:视觉生成模型的高效人类偏好竞技场 | H5 YouTube bilibili | link |
| 2024.12.21 | CMU 博士生董易昕 | XGrammar:高效实现 LLM灵活且可移植的结构化生成 | H5 YouTube | link |
| 2024.12.16 | 商汤科技研究院模型压缩研究员谷石桥、雍洋 | LLMC:大语言模型压缩工具的开发实践 | H5 YouTube bilibili | link |
| 2024.12.14 | 深度求索(DeepSeek)研究员、UT Austin博士刘星超 | Rectified Flow:矫正流生成式模型的概念及应用实践 | H5 YouTube | link |
| 2024.11.30 | 微软研究院 AI Frontiers 实验室高级研究员鲁亚东 | OminiParser:基于纯视觉的 GUI Agent | H5 | |
| 2024.11.23 | NVIDIA VILA 团队实习生方云浩 | VILA^2 : 视觉语言模型能力的自我提升 | H5 YouTube | link |
| 2024.11.05 | 中科院自动化所和香港城市大学联合培养博士生林浩坤 | DuQuant: 基于正交变换实现大型语言模型的 SOTA级 4 bit 量化 | H5 YouTube | link |
| 2024.10.17 | 香港科技大学在读博士高深远 | GenAD & Vista:构建通用可泛化的自动驾驶世界模型 | H5 YouTube | |
| 2024.10.14 | 南京大学智能科学与技术学院研究员、助理教授傅朝友 | VITA:开源交互式多模态基础大模型 | H5 | |
| 2024.10.11 | 商汤科技算法实习生、香港科技大学准博士生黄雨石 | LLMC:大语言模型的量化基准 | H5 YouTube bilibili | |
| 2024.09.26 | Eigent AI Founding Engineer、CAMEL AI开源多智能体框架核心贡献者范文栋 | 使用 CAMEL Agents 构建 GraphRAG 及应用实践 | H5 YouTube bilibili | |
| 2024.09.23 | 智谱AI算法工程师,CogVideoX作者之一 张昱轩 | CogVideoX 视频生成开源模型上手实践 | H5 YouTube | |
| 2024.09.10 | 阿里巴巴通义实验室高级算法工程师、华东师范大学博士叶加博 | mPLUG-Owl3:探索长序列模型架构的通用多模态大模型 | H5 YouTube | |
| 2024.09.03 | Databricks Mosaic Research研究科学家,斯坦福大学博士盛颖 | SGLang v0.2:面向 LLM 和 VLM 的快速、高效通用服务引擎 | H5 | link |
| 2024.08.26 | UC Berkeley 博士生曹诗怡 | S-LoRA:实现多 LoRA 大模型的高效并行化推理 | H5 YouTube | |
| 2024.08.14 | 麻省理工学院准博士生唐嘉铭 | AWQ:激活值感知的LLM低位权重量化 | H5 YouTube | |
| 2024.08.06 | 香港中文大学博士后王文海 | InternVL 2.0:通过渐进式策略扩展开源多模态大模型的性能边界 | H5 YouTube | link |
| 2024.07.30 | 香港科技大学(广州)人工智能方向博士研究生杨帅 | SEED-Story:生成长篇图文故事的多模态大型语言模型 | H5 YouTube | |
| 2024.07.23 | 华中科技大学博士生程天恒 | YOLO-World:基于视觉语言模型的实时开放词汇物体检测 | H5 YouTube | link |
| 2024.07.15 | 清华大学自然语言处理实验室博士生余天予 | MiniCPM-V:端侧可用的 GPT-4V 级多模态大模型 | H5 YouTube | link |
| 2024.07.11 | 阿里通义实验室高级算法专家徐海洋 | Mobile-Agent:基于多模态Agent架构的手机智能体 | H5 YouTube | link |
| 2024.07.08 | 北京航空航天大学博士生郑耀威 | LLaMA Factory:从预训练到RLHF,大模型高效训练框架 | H5 YouTube | link |
| 2024.06.27 | 浙江大学硕士研究生董玉博 | VillagerAgent:减少幻觉、提高任务分解效率的多智能协作体框架 | H5 YouTube | link |
| 2024.06.17 | 香港大学MMLAB在读博士吴成岳 | LLaMA Pro:扩展Transformer块优化的大型语言模型继续预训练 | H5 YouTube | link |
| 2024.06.13 | 北京大学在读博士孟繁续 | PiSSA:收敛快、误差小的大模型参数高效微调方法 | H5 YouTube | |
| 2024.06.06 | 上海人工智能实验室青年研究员、OpenDriveLab具身智能方向负责人曾嘉博士 | 具身多模态大模型的视觉表征预训练研究 | H5 YouTube | |
| 2024.05.29 | 南洋理工大学 MMLab 实验室在读博士姜瑜铭 | VideoBooth:文本和图像提示共同驱动的视频生成 | H5 YouTube | |
| 2024.05.24 | 新加坡国立大学Research Fellow倪瑾杰 | MixEval:混合评测数据集来拟合大语言模型的人类评估 | H5 YouTube | |
| 2024.05.21 | 华南理工大学集合感知与智能实验室博士梁智灏 | 实时渲染 3DGS 中的反走样及逆渲染应用 | H5 YouTube | |
| 2024.05.10 | 3D-VLA第一作者甄昊宇 | 3D-VLA:构建生成式三维具身世界模型 | H5 YouTube | link |
| 2024.04.24 | 香港中文大学在读博士李彦玮 | Mini-Gemini:挖掘多模态视觉语言大模型的潜力 | H5 YouTube | link |
| 2024.04.19 | 加州大学洛杉矶分校在读博士洪逸宁 | 从 3D LLM 到 MultiPLY ,3D 具身基础模型的构建 | H5 youtube | |
| 2024.04.15 | 清华大学自然语言处理实验室(THUNLP)博士后钱忱 | ChatDev——大语言模型驱动的多智能体协作与演化 | H5 YouTube | link |
| 2024.04.10 | 慕尼黑工业大学视觉计算实验室博士陈振宇 | SceneTex:高质量三维室内场景纹理图生成 | H5 YouTube | link |
| 2024.03.02 | DeepFaceLab(累计60,000 +⭐️)作者小黑兔 InstantID(huggingface space周榜第一)作者王浩帆 剑桥大学计算机系在读博士Andi Zhang VBench 第一作者、南洋理工大学MMLab在读博士黄子琪 | Sora迷思,AIGC的微积分时刻? | H5 |
![]() | ![]() |
|---|---|
| 青稞具身智能技术交流群 | 青稞AI技术交流群 |
70 commits

青年AI研究员idea加油站,AI开发者的新能源充电桩!
| 直播时间 | 主讲人 | 主题 | 直播/回放观看链接 | PPT |
|---|---|---|---|---|
| 2026.09.17 | 清华大学博士生何秉翔 | Rethinking On-Policy Distillation of Large Language Models | ||
| 2026.09.12 | 圣路易斯华盛顿大学博士生黄呈松 | EnvHarness:左脚踩右脚!让环境随着 Agent 的训练一起进化 | ||
| 2026.09.08 | 香港中文大学博士、华为莱布尼茨研究所研究员杜一鸣 | Lego-RL:面向真实 Coding Agent 的 Harness-Native 强化学习方法 | YouTube Bilibili | link |
| 2026.09.05 | 伊利诺伊大学香槟分校 (UIUC) 二年级博士生钱成 | AI4AI at Test-Time:从 Harness 看 AI4AI 如何实现以及未来 | YouTube Bilibili | link |
| 2026.09.01 | 上海人工智能实验室物理智能中心青年研究员周云松 上海人工智能实验室物理智能中心青年研究员王帅 | 从“如何生成”到“如何验证”,探讨物理一致世界模型如何实现可扩展机器人学习 | YouTube Bilibili | |
| 2026.08.29 | NUS 博士生张桂彬 | 模型的“什么经验值得被看见”?LOPD:不再手动设计 OPSD 特权信息 | ||
| 2026.08.25 | NVIDIA Research 研究科学家,前 MIT CSAIL 博士后研究员毛伟岸 | TriAttention:面向长推理的三角级数式 KV Cache 压缩 | YouTube Bilibili | link |
| 2026.08.22 | 北京大学人工智能研究院博士生李珩立 | LatentSeek & GradCuit:从价值引导的隐空间优化看大语言模型推理 | YouTube Bilibili | link |
| 2026.08.13 | 衔远科技算法研究员、清华大学博士生姜澈 | AI for AI 的前世今生:从进化、自进化与元进化,迈向递归自我改进(RSI) | YouTube Bilibili | |
| 2026.08.11 | 新加坡国立大学(NUS)计算学院博士生李一博 | Agentic RL 下半场:无需梯度更新的即时强化学习JitRL | YouTube Bilibili | |
| 2026.08.08 | 清华大学深圳国际研究生院硕士在读张翼显 | 从端到端 VLA 到 Harness VLA:面向具身智能与机器人操作任务的记忆增强式执行框架 | YouTube Bilibili | |
| 2026.08.06 | 新加坡南洋理工大学(MMLab@NTU)博士后研究员操雨康 | 新一代具身智能数据范式ACE-Data-0:以人为中心的环境式采集构建具身数据引擎 | YouTube Bilibili | |
| 2026.08.04 | 上海交通大学人工智能学院博士生林涛 | LA4VLA:从 VLA 预训练中解耦语言-动作监督 | YouTube Bilibili | link |
| 2026.08.01 | 通义千问(Qwen)团队研究员陈雄辉 | Alignment unlocks Scaling:Qwen-Robot Suite 的设计原理和背后的思考 | YouTube Bilibili | |
| 2026.07.28 | 清华大学数学系四年级博士生王颢宁 巴黎萨克雷高等师范学院 MVA 研究生刘懿玮 | 在线自进化后训练框架 DRIFT:没有外部专家监督时,如何让 OPD 策略学会自我持续进化 | YouTube Bilibili | |
| 2026.07.25 | 中关村学院联合培养博士生陈佳磊 | LaWAM:隐空间世界动作模型!不生成未来视频,也让机器人拥有"物理预见力" | YouTube Bilibili | link |
| 2026.07.21 | 北京中关村学院与中科院自动化所联培博士生刘志豪 | STEAM:面向真实世界机器人学习的、无需人工标注的帧级优势估计框架 | YouTube Bilibili | link |
| 2026.07.15 | 新加坡南洋理工大学(MMLab@NTU)博士后研究员许牧天 | Kinema4D:面向时空具身仿真的运动学 4D 世界建模 | YouTube Bilibili | |
| 2026.07.11 | CMU 博士研究生赖睿航 | PithTrain:Agent 时代的 MoE 训练框架设计 | YouTube Bilibili | |
| 2026.07.04 | 复旦大学计算与智能创新学院23级硕士研究生张世铎 | 如何设计一个好的自回归 VLA:从问题构建到工程落地的探索之旅 | YouTube Bilibili | link |
| 2026.06.30 | 清华大学人工智能学院博士生方科晨 | DPA & LLaVA-HUD v4:多模态大模型的深度预对齐与高效视觉编码优化 | YouTube Bilibili | |
| 2026.06.27 | Mind Lab Research Scientist,Head of Infrastructure,清华大学博士陆逸文 | MinT: 面向百万级 LoRA 策略的训练与推理基础设施 | YouTube Bilibili | |
| 2026.06.23 | vLLM-Omni和VeRL-Omni开源社区核心贡献者,香港科技大学博士,华为莱布尼茨研究所Research Scientist黄永祥 | VeRL-Omni:面向多模态生成模型的高效RL后训练框架 | YouTube Bilibili | |
| 2026.06.16 | 北大博士生孟繁续 | 从 MLA 到 GQLA:无需从头训练,硬件自适应高效注意力机制 | YouTube Bilibili | link |
| 2026.06.13 | 新加坡国立大学(NUS)计算机科学在读博士吴林昱 | UniRL:面向统一多模态模型的分布式 RL 后训练框架 | YouTube Bilibili | |
| 2026.06.09 | 清华大学博士生吕兴泰 | ZEDA:将 Post-Trained MoE 迁移为高效动态 MoE | YouTube Bilibili | link |
| 2026.06.06 | 中国人民大学高瓴人工智能学院博士在读董冠霆 | 从 ARPO,到 AEPO,再到 Agent-World:探索通用智能体训练的可行路径 | YouTube Bilibili | |
| 2026.05.26 | 南洋理工大学一年级博士生、Mind Lab 研究员雷京迪 | δ-mem:从长上下文到在线记忆,动态演化原生记忆的一次尝试 | YouTube Bilibili | link |
| 2026.05.19 | 南洋理工大学(NTU)MMLab 博士生罗奕航 | STream3R & 4RC: 面向几何与运动理解的流式前馈 3D/4D 重建 | YouTube Bilibili | link |
| 2026.05.16 | 自动化所深度强化学习团队博士生傅宇千 | 重探 On-Policy Distillation(OPD):三类典型失败以及修复路径 | YouTube Bilibili | link |
| 2026.05.12 | 中科大与上海AI Lab联培博士生谭泽霖 | 大模型强化学习的 Scaling Law | YouTube Bilibili | link |
| 2026.05.09 | SGLang框架核心开发者和维护者张柏舟 | DeepSeek V4 模型在 SGLang 中的系统级优化与全栈适配 | YouTube Bilibili | link |
| 2026.04.27 | 清华大学博士生何秉翔 | 从 TTRL 到 URLVR:大模型的无监督强化学习还能走多远? | YouTube Bilibili | link |
| 2026.04.21 | 中科院自动化所模式识别实验室在读博士生田浩辰 | SimScale:大规模真实世界仿真重塑端到端自动驾驶学习范式 | YouTube Bilibili | link |
| 2026.04.14 | MMLab@NTU 博士生伍晓鸣 | VLANeXt:12条设计准则,从入门到精通的 VLA 终极“配方” | YouTube | link |
| 2026.04.11 | 达特茅斯学院计算机科学在读博士马驰宇 | FIPO & Future-KL:突破大语言模型在复杂推理中的性能瓶颈 | YouTube Bilibili | link |
| 2026.04.07 | 新加坡南洋理工大学 MMLab 与 S-Lab 博士后研究员廖康 | Puffin: 统一多模态空间智能大模型——从任意视角理解和生成世界 | YouTube Bilibili | link |
| 2026.03.31 | 芝加哥大学二年级博士生王胤杰 | OpenClaw-RL: 结合 GRPO + OPD,在使用中自适应变强的龙虾 | YouTube Bilibili | link |
| 2026.03.28 | CUHK MMLab PhD 二年级在读杨佳智 | RISE: 组合式世界模型,在“想象”中实现机器人策略的自主进化 | YouTube Bilibili | link |
| 2026.03.24 | 中国科学技术大学少年班本科生徐哲轩 | 从Depth Scaling到Width Scaling!WideSeek-R1:通过MARL探索大模型的广度扩展 | YouTube Bilibili | link |
| 2026.03.20 | 麻省理工学院(MIT)博士后研究员周恺辰 | 从 VGGT 到 PAGE-4D:动态世界中的 3D 感知统一框架 | YouTube Bilibili | link |
| 2026.03.17 | 新加坡国立大学计算机系博士生、水杉智算技术联合创始人万政霖 | 面向对象的 Agent Infra 新范式:有状态运行时管理的设计与工程实践 | YouTube Bilibili | link |
| 2026.03.14 | 清华大学在读博士生吴科明 | EditReward : 当 AI 学会“审美”,可控多模态生成的下一代范式 | YouTube Bilibili | link |
| 2026.03.10 | 清华大学交叉信息研究院本科生臧宏之 | RLinf-USER:面向现实世界机器人在线策略学习的统一且可扩展系统 | YouTube Bilibili | |
| 2026.03.07 | 香港科技大学(HKUST)在读博士生刘威 | Dr. Kernel: 突破大模型 GPU Kernel 生成的多轮 RL 训练瓶颈 | YouTube Bilibili | link |
| 2026.03.03 | 香港城市大学数据科学系博士生王天乐 | 线性轨迹:揭示 LLM 强化学习中的高效捷径 | YouTube Bilibili | link |
| 2026.02.28 | MIT本科生 Iris Xu | BOAD:引入多臂老虎机,自动化搜索层级结构的多 Agent 架构设计 | YouTube Bilibili | |
| 2026.02.03 | 清华大学博士生何秉翔 | JustRL: 用"最笨"的 RL 方法刷新 1.5B 推理模型新基线 | YouTube Bilibili | link |
| 2026.01.30 | 香港科技大学博士候选人、 NVIDIA 研究实习生刘诗扬 | GDPO:解决 GRPO 在多奖励 RL 训练中的"优势崩溃"问题 | YouTube Bilibili | link |
| 2026.01.27 | 上海人工智能实验室具身智能中心青年科学家曾嘉 | InternVLA-A1,虚实贯通:理解、生成、执行一体化的具身操作大模型 | YouTube Bilibili | link |
| 2026.01.20 | 南洋理工大学 MMLab 实验室博士生范洧辰 | The Prism Hypothesis 视觉统一表征假说:从语义到像素的统一自编码(UAE) | H5 YouTube Bilibili | link |
| 2026.01.13 | 阿里巴巴通义实验室实习生、西北工业大学本科&香港科技大学预备博士姜登阳 | Decoupled DMD & DMDR: 在扩散模型步数蒸馏的实践及 Z-Image-Turbo 应用 | H5 YouTube Bilibili | link |
| 2026.01.10 | 通义千问算法工程师高畅 | 从 TRPO 到 SAPO:大模型 RL 算法演进 | H5 YouTube Bilibili | link |
| 2026.01.06 | MiniMax算法工程师、通用模型后训练负责人程威宇 | MiniMax M2.1:Agent 后训练经验与认知 | H5 YouTube Bilibili | link |
| 直播时间 | 主讲人 | 主题 | 直播/回放观看链接 | PPT |
|---|---|---|---|---|
| 2025.12.26 | 青稞‘s | 2025 “青稞” AI 嘉年华 | YouTube Bilibili | |
| 2025.12.20 | 大厂研究科学家Yingru Li | TRPO重生:大模型时代的信任域策略优化 | YouTube Bilibili | |
| 2025.12.16 | 香港大学MMLab博士生陈俊松 | SANA-Series:探索图像视频扩散模型的高效设计与加速 | H5 YouTube Bilibili | link |
| 2025.12.13 | SeaAI Lab 研究工程师、新加坡国立大学博士生齐朋辉 | 从 BF16 到 FP16:如何解决RL训练-推理不匹配问题 | H5 YouTube Bilibili | link |
| 2025.12.09 | 香港大学MMLab博士生吴成岳 | Fast-dLLM v2:高效训练推理的块扩散大语言模型框架 | H5 YouTube Bilibili | link |
| 2025.12.06 | 北京大学博士生陈康 | 从 $π_0$ 到 $π_{RL}$:面向流匹配 VLA 的强化学习后训练框架 | H5 YouTube Bilibili | link |
| 2025.12.02 | 清华大学交叉信息研究院本科生臧宏之 | RLinf-VLA 实践:从零上手 VLA(OpenVLA )强化学习 | H5 YouTube Bilibili | link |
| 2025.11.29 | 清华大学博士生张金涛 | SageAttention & Sparse-Linear Attention & SpargeAttention:通过量化与稀疏性实现高效注意力机制 | H5 YouTube Bilibili | link |
| 2025.11.25 | 无问芯穹首席研究员林灏 | RLinf:面向具身智能的“渲训推一体化”开源强化训练框架 | H5 YouTube Bilibili | link |
| 2025.11.22 | 清华大学计算机系副教授章明星、KTransformers项目核心参与者李沛 | KTransformers,在大模型微调与推理中的系统化实践 | H5 YouTube Bilibili | link |
| 2025.11.18 | 同济大学计算机学院博士生刘洪博 | ShotBench: 面向增强MLLM摄影语言理解能力的训练与评估体系 | H5 YouTube Bilibili | |
| 2025.11.15 | 北京大学博士生周嘉懿 | Generative RLHF-V: 面向多模态 RLHF 的人类意图对齐框架 | H5 YouTube Bilibili | link |
| 2025.11.11 | 华中科技大学&华为联培博士生吴官骏 | UniLat3D:几何–外观统一VAE的单阶段 3D 生成框架 | H5 YouTube Bilibili | link |
| 2025.11.08 | 香港大学直博生黄炜 | RL 训练框架:QeRL,量化技术增强强化学习 Reasoning 探索 | H5 YouTube Bilibili | link |
| 2025.11.06 | 清华博士生程家乐 | 从 DeepSeek-OCR 到 Glyph:深入理解图像-文本压缩技术 | H5 YouTube Bilibili | link |
| 2025.11.04 | NUS AI Researcher 倪瑾杰 | OpenMoE2 :Sparse Diffusion Language Models | H5 YouTube Bilibili | link |
| 2025.11.01 | 清华大学博士生李昊展 | SimpleVLA-RL:简单可拓展的VLA强化学习训练 | H5 YouTube Bilibili | link |
| 2025.10.28 | 清华大学博士生吕兴泰 | 统一 SFT & RL:迈向大型语言模型后训练的统一视角 | H5 YouTube Bilibili | link |
| 2025.10.25 | 香港大学 XLANG Lab 计算机科学博士生王心远 | OpenCUA:用于构建 Computer-Use Agent 的开源框架 | H5 Youtube Bilibili | link |
| 2025.10.21 | 清华大学博士生张开颜 | RL for LRMs:探讨面向推理模型的 RL 最新研究 | H5 YouTube Bilibili | link |
| 2025.10.18 | 伊利诺伊大学香槟分校 (UIUC) 博士生钱成 | UserRL & UserBench-“知人者智”:以用户为中心的智能体交互与训练 | H5 YouTube Bilibili | link |
| 2025.10.16 | 新加坡国立大学博士生张桂彬 | MemGen:生成式隐式记忆,Agent Memory 的第三种可能 | H5 YouTube Bilibili | link |
| 2025.09.18 | 新加坡国立大学博士生张桂彬 | 从 LLM-RL 到 Agentic RL:如何让语言模型成为自主智能体 | H5 YouTube Bilibili | link |
| 2025.09.09 | 香港中文大学王鸿儒博士 | Theory of Agent: From Definition, to Behavior and Objective | H5 YouTube Bilibili | link1 link2 |
| 2025.09.06 | 英伟达NeMo团队高级深度学习算法工程师李之愈,以及高级产品经理高文雯 | NeMo RL:让大规模 MoE 模型权重 Refit 加速 10 倍 | H5 YouTube Bilibili | link |
| 2025.08.30 | 加州大学圣地亚哥分校(UCSD)博士生姚峰 | FlashRL:探讨现代 RL 框架中推理与训练的错位问题及解决方案 | H5 YouTube bilibili | link1 link |
| 2025.08.23 | 王维埙博士,淘天集团未来生活实验室 算法专家 熊绍潘硕士,爱橙科技智能引擎算法平台 大模型强化学习框架工程师 | ROLL:面向 Agentic 场景的生产级大规模强化学习训练框架 | H5 YouTube Bilibili | link |
| 2025.08.19 | 马里兰大学博士生陈玖海 | 从BLIP3o到BLIP3o-NEXT:迈向统一生成与理解的多模态大模型 | H5 YouTube Bilibili | link |
| 2025.08.16 | 西湖大学修宇亮实验室访问学生李博谦 | ETCH: 通过等变紧度向量将人体拟合推广到穿衣人体的方法 | H5 YouTube Bilibili | |
| 2025.08.12 | 清华大学自然语言处理实验室博士生余天予 | RLPR:基于参考概率奖励的强化学习,推广 RLVR 到通用领域推理问题 | H5 YouTube | link |
| 2025.08.09 | 南洋理工大学MMLab博士生田淑琳 | Evaluation Agent:面向视觉生成模型的高效可提示的评估框架 | H5 YouTube | link |
| 2025.08.07 | 通义千问研究员,Qwen3、QwQ系列开源模型核心贡献者郑楚杰博士 | GSPO:大规模强化学习训练算法,迈向持续拓展的语言模型强化学习 | H5 YouTube | |
| 2025.08.05 | Sea AI Lab(新加坡)算法工程师,新加坡国立大学博士生万信逸 | 大模型训练流水线并行四部曲:吞吐、内存、负载均衡与线性扩展 | H5 YouTube | link |
| 2025.08.02 | 智谱 AI RL Infra 工程师、slime 开源项目作者朱子霖 | slime:专为 RL Scaling 设计的大规模 RL 训练框架及实践 | H5 YouTube | link |
| 2025.07.26 | 香港城市大学计算机科学在读博士生陈胜庄 | SIMoE:稀疏插值混合专家,大模型升级再造的自动化专家发现框架 | H5 YouTube | link |
| 2025.07.22 | 香港中文大学(深圳)GAP实验室博士生叶崇杰 | Hi3DGen:法线为桥,为高清三维几何生成另辟蹊径 | H5 YouTube | |
| 2025.07.19 | 纽约大学访问学生尹柏乔和西北大学博士生王启能 | MindCube:空间智能的实现路径,探究 VLMs 构建稳健空间心理模型的能力 | H5 YouTube | link |
| 2025.07.15 | 华南理工大学与IDEA 联合培养博士蒋擎 | ChatRex/RexSeek/Rex-Thinker:结合多模态大语言模型的目标检测模型构建 | H5 YouTube | link |
| 2025.07.12 | 英伟达公司研究员刁诗哲 | ProRL: 延长强化学习训练框架,拓展大语言模型的推理边界 | H5 YouTube | link |
| 2025.07.08 | 南洋理工大学MMLab博士生吴鹏浩 | GUI-Reflection:让多模态 GUI 智能体获得反思纠错能力的训练框架 | H5 YouTube | |
| 2025.07.05 | 新加坡科技设计大学 博士生曾广韬 | Satori-SWE:用 Evolutionary Test-Time Scaling 让小语言模型解决复杂软件工程 | H5 YouTube | link |
| 2025.07.01 | 北京大学博士生张宇臣 | 大模型推理强化学习中的熵机制 | H5 YouTube | link |
| 2025.06.28 | 马萨诸塞大学阿默斯特分校周沁泓博士和张洪鑫博士 | Virtual Community 虚拟社区:面向人、机器人与社会的开放世界 | H5 YouTube | |
| 2025.06.24 | 香港大学MMLab博士生吴成岳 | Fast-dLLM:无需重训的扩散大语言模型推理加速 | H5 YouTube | link |
| 2025.06.21 | 复旦大学博士生王玮赟 | InternVL3,GPT-4o开源平替:探索多模态通用感知大模型的技术演进与应用探索 | H5 YouTube | link |
| 2025.06.16 | 新加坡国立大学博士生张扬 | 生成模型中的极简概念擦除 | H5 YouTube | |
| 2025.06.12 | 中国科学院博士黎昆昌 | BAGEL:统一生成理解的多模态基础模型 | H5 YouTube | link |
| 2025.06.09 | 微软亚洲研究院高级研究员宋恺涛 | Chain-of-Model (模型链):引入因果建模,全新的大模型 Scaling 结构 | H5 YouTube | link |
| 2025.05.29 | 加州大学伯克利分校计算机科学博士生席浩诚 | Sparse VideoGen:无需重新训练的 DiTs 推理加速框架 | H5 YouTube | |
| 2025.05.26 | 青稞社区联合创始人高岱恒 | EraseAnything:在 Flux 等先进文生图架构的概念擦除方法 | H5 YouTube | link |
| 2025.05.22 | 北京大学智能学院博士生节世博 | MoLE & SpeCache:大语言模型端侧部署的架构与算法 | H5 YouTube | link |
| 2025.05.19 | verl core contributor 童雨轩 | verl 源码解读 与 HybridFlow 编程范式讲解 | H5 YouTube | link |
| 2025.05.14 | 清华大学博士生张开颜 | 从 TTS 到 TTRL:无标签数据强化学习探索与展望 | H5 YouTube | |
| 2025.04.26 | 华中科技大学硕士在读、MMlab@NTU研究助理刘天齐 | Free4D:无需微调的 4D 场景生成新框架 | H5 YouTube | |
| 2025.04.22 | UC Berkeley 博士生潘家怡和李岫宇 | 从 TinyZero 到 APR:语言模型推理能力的探索与自适应并行化 | H5 YouTube | link |
| 2025.04.19 | 香港科技大学(HKUST)计算机系博士生曾伟豪 | B-STaR & SimpleRL-Zoo:通过强化学习自我提升推理性能和效率 | H5 YouTube | link |
| 2025.04.04 | 加州大学圣地亚哥分校计算机科学与工程系副教授张怡颖 | InferCept、Preble & Cognify:面向下一代 AI Agent 工作流系统的构建 | H5 YouTube | link |
| 2025.03.29 | UTS ReLER lab博士生杨向鹏 | VideoGrain:基于扩散模型的多粒度视频编辑的探索与应用 | H5 YouTube | link |
| 2025.03.22 | 加州大学伯克利分校计算机科学博士生席浩诚 | COAT:显存高效的 FP8 训练,实现高效深度学习 | H5 YouTube | link |
| 2025.03.15 | 阿里通义实验室高级算法工程师张熙 | PC-Agent:面向复杂 PL 任务的多模态智能体框架 | H5 YouTube | |
| 2025.03.08 | 商汤科技大模型工具体系团队研究员、LightLLM 核心开发人员白世豪 | 基于 LightLLM 的 DeepSeek R1/V3 模型部署实战 | H5 YouTube | link |
| 2025.02.22 | 上海人工智能实验室青年科学家崔淦渠 | PRIME: 结合隐式过程奖励的强化学习 | H5 YouTube | link |
| 2025.02.15 | MIT博士生沈茂昊 | Satori:通过训练LLM做自回归搜索来增强推理能力 | H5 YouTube | link |
| 2025.01.14 | 香港科技大学(广州)博士生许添硕 | Motion Dreamer:面向自动驾驶与物理世界对齐的视频生成模型 | H5 YouTube bilibili | |
| 2025.01.04 | 香港科技大学计算机博士生马跃 | Follow Family:可控视频生成方法探索与应用 | H5 YouTube bilibili | |
| 2024.12.28 | 香港科技大学广州博士生周子凯 | Tuning-Free Enhence:通过噪声初始化和采样轨迹优化增强预训练扩散模型 | H5 YouTube | link |
| 2024.12.24 | 中国科学院自动化研究所博士生、新加坡国立大学访问博士生李志凯 | K-Sort Arena:视觉生成模型的高效人类偏好竞技场 | H5 YouTube bilibili | link |
| 2024.12.21 | CMU 博士生董易昕 | XGrammar:高效实现 LLM灵活且可移植的结构化生成 | H5 YouTube | link |
| 2024.12.16 | 商汤科技研究院模型压缩研究员谷石桥、雍洋 | LLMC:大语言模型压缩工具的开发实践 | H5 YouTube bilibili | link |
| 2024.12.14 | 深度求索(DeepSeek)研究员、UT Austin博士刘星超 | Rectified Flow:矫正流生成式模型的概念及应用实践 | H5 YouTube | link |
| 2024.11.30 | 微软研究院 AI Frontiers 实验室高级研究员鲁亚东 | OminiParser:基于纯视觉的 GUI Agent | H5 | |
| 2024.11.23 | NVIDIA VILA 团队实习生方云浩 | VILA^2 : 视觉语言模型能力的自我提升 | H5 YouTube | link |
| 2024.11.05 | 中科院自动化所和香港城市大学联合培养博士生林浩坤 | DuQuant: 基于正交变换实现大型语言模型的 SOTA级 4 bit 量化 | H5 YouTube | link |
| 2024.10.17 | 香港科技大学在读博士高深远 | GenAD & Vista:构建通用可泛化的自动驾驶世界模型 | H5 YouTube | |
| 2024.10.14 | 南京大学智能科学与技术学院研究员、助理教授傅朝友 | VITA:开源交互式多模态基础大模型 | H5 | |
| 2024.10.11 | 商汤科技算法实习生、香港科技大学准博士生黄雨石 | LLMC:大语言模型的量化基准 | H5 YouTube bilibili | |
| 2024.09.26 | Eigent AI Founding Engineer、CAMEL AI开源多智能体框架核心贡献者范文栋 | 使用 CAMEL Agents 构建 GraphRAG 及应用实践 | H5 YouTube bilibili | |
| 2024.09.23 | 智谱AI算法工程师,CogVideoX作者之一 张昱轩 | CogVideoX 视频生成开源模型上手实践 | H5 YouTube | |
| 2024.09.10 | 阿里巴巴通义实验室高级算法工程师、华东师范大学博士叶加博 | mPLUG-Owl3:探索长序列模型架构的通用多模态大模型 | H5 YouTube | |
| 2024.09.03 | Databricks Mosaic Research研究科学家,斯坦福大学博士盛颖 | SGLang v0.2:面向 LLM 和 VLM 的快速、高效通用服务引擎 | H5 | link |
| 2024.08.26 | UC Berkeley 博士生曹诗怡 | S-LoRA:实现多 LoRA 大模型的高效并行化推理 | H5 YouTube | |
| 2024.08.14 | 麻省理工学院准博士生唐嘉铭 | AWQ:激活值感知的LLM低位权重量化 | H5 YouTube | |
| 2024.08.06 | 香港中文大学博士后王文海 | InternVL 2.0:通过渐进式策略扩展开源多模态大模型的性能边界 | H5 YouTube | link |
| 2024.07.30 | 香港科技大学(广州)人工智能方向博士研究生杨帅 | SEED-Story:生成长篇图文故事的多模态大型语言模型 | H5 YouTube | |
| 2024.07.23 | 华中科技大学博士生程天恒 | YOLO-World:基于视觉语言模型的实时开放词汇物体检测 | H5 YouTube | link |
| 2024.07.15 | 清华大学自然语言处理实验室博士生余天予 | MiniCPM-V:端侧可用的 GPT-4V 级多模态大模型 | H5 YouTube | link |
| 2024.07.11 | 阿里通义实验室高级算法专家徐海洋 | Mobile-Agent:基于多模态Agent架构的手机智能体 | H5 YouTube | link |
| 2024.07.08 | 北京航空航天大学博士生郑耀威 | LLaMA Factory:从预训练到RLHF,大模型高效训练框架 | H5 YouTube | link |
| 2024.06.27 | 浙江大学硕士研究生董玉博 | VillagerAgent:减少幻觉、提高任务分解效率的多智能协作体框架 | H5 YouTube | link |
| 2024.06.17 | 香港大学MMLAB在读博士吴成岳 | LLaMA Pro:扩展Transformer块优化的大型语言模型继续预训练 | H5 YouTube | link |
| 2024.06.13 | 北京大学在读博士孟繁续 | PiSSA:收敛快、误差小的大模型参数高效微调方法 | H5 YouTube | |
| 2024.06.06 | 上海人工智能实验室青年研究员、OpenDriveLab具身智能方向负责人曾嘉博士 | 具身多模态大模型的视觉表征预训练研究 | H5 YouTube | |
| 2024.05.29 | 南洋理工大学 MMLab 实验室在读博士姜瑜铭 | VideoBooth:文本和图像提示共同驱动的视频生成 | H5 YouTube | |
| 2024.05.24 | 新加坡国立大学Research Fellow倪瑾杰 | MixEval:混合评测数据集来拟合大语言模型的人类评估 | H5 YouTube | |
| 2024.05.21 | 华南理工大学集合感知与智能实验室博士梁智灏 | 实时渲染 3DGS 中的反走样及逆渲染应用 | H5 YouTube | |
| 2024.05.10 | 3D-VLA第一作者甄昊宇 | 3D-VLA:构建生成式三维具身世界模型 | H5 YouTube | link |
| 2024.04.24 | 香港中文大学在读博士李彦玮 | Mini-Gemini:挖掘多模态视觉语言大模型的潜力 | H5 YouTube | link |
| 2024.04.19 | 加州大学洛杉矶分校在读博士洪逸宁 | 从 3D LLM 到 MultiPLY ,3D 具身基础模型的构建 | H5 youtube | |
| 2024.04.15 | 清华大学自然语言处理实验室(THUNLP)博士后钱忱 | ChatDev——大语言模型驱动的多智能体协作与演化 | H5 YouTube | link |
| 2024.04.10 | 慕尼黑工业大学视觉计算实验室博士陈振宇 | SceneTex:高质量三维室内场景纹理图生成 | H5 YouTube | link |
| 2024.03.02 | DeepFaceLab(累计60,000 +⭐️)作者小黑兔 InstantID(huggingface space周榜第一)作者王浩帆 剑桥大学计算机系在读博士Andi Zhang VBench 第一作者、南洋理工大学MMLab在读博士黄子琪 | Sora迷思,AIGC的微积分时刻? | H5 |
![]() | ![]() |
|---|---|
| 青稞具身智能技术交流群 | 青稞AI技术交流群 |
70 commits