qingkelab/qingketalk

青稞Talk

223

70 commits

updated Sep 12, 2026

See the code

README

青年AI研究员idea加油站,AI开发者的新能源充电桩!


青稞社区主页 | 关于青稞


青稞Talk


2026

直播时间主讲人主题直播/回放观看链接PPT
2026.09.17清华大学博士生何秉翔Rethinking On-Policy Distillation of Large Language Models
2026.09.12圣路易斯华盛顿大学博士生黄呈松EnvHarness:左脚踩右脚!让环境随着 Agent 的训练一起进化
2026.09.08香港中文大学博士、华为莱布尼茨研究所研究员杜一鸣Lego-RL:面向真实 Coding Agent 的 Harness-Native 强化学习方法YouTube Bilibililink
2026.09.05伊利诺伊大学香槟分校 (UIUC) 二年级博士生钱成AI4AI at Test-Time:从 Harness 看 AI4AI 如何实现以及未来YouTube Bilibililink
2026.09.01上海人工智能实验室物理智能中心青年研究员周云松
上海人工智能实验室物理智能中心青年研究员王帅
从“如何生成”到“如何验证”,探讨物理一致世界模型如何实现可扩展机器人学习YouTube Bilibili
2026.08.29NUS 博士生张桂彬模型的“什么经验值得被看见”?LOPD:不再手动设计 OPSD 特权信息
2026.08.25NVIDIA Research 研究科学家,前 MIT CSAIL 博士后研究员毛伟岸TriAttention:面向长推理的三角级数式 KV Cache 压缩YouTube Bilibililink
2026.08.22北京大学人工智能研究院博士生李珩立LatentSeek & GradCuit:从价值引导的隐空间优化看大语言模型推理YouTube Bilibililink
2026.08.13衔远科技算法研究员、清华大学博士生姜澈AI for AI 的前世今生:从进化、自进化与元进化,迈向递归自我改进(RSI)YouTube Bilibili
2026.08.11新加坡国立大学(NUS)计算学院博士生李一博Agentic RL 下半场:无需梯度更新的即时强化学习JitRLYouTube Bilibili
2026.08.08清华大学深圳国际研究生院硕士在读张翼显从端到端 VLA 到 Harness VLA:面向具身智能与机器人操作任务的记忆增强式执行框架YouTube Bilibili
2026.08.06新加坡南洋理工大学(MMLab@NTU)博士后研究员操雨康新一代具身智能数据范式ACE-Data-0:以人为中心的环境式采集构建具身数据引擎YouTube Bilibili
2026.08.04上海交通大学人工智能学院博士生林涛LA4VLA:从 VLA 预训练中解耦语言-动作监督YouTube Bilibililink
2026.08.01通义千问(Qwen)团队研究员陈雄辉Alignment unlocks Scaling:Qwen-Robot Suite 的设计原理和背后的思考YouTube Bilibili
2026.07.28清华大学数学系四年级博士生王颢宁
巴黎萨克雷高等师范学院 MVA 研究生刘懿玮
在线自进化后训练框架 DRIFT:没有外部专家监督时,如何让 OPD 策略学会自我持续进化YouTube Bilibili
2026.07.25中关村学院联合培养博士生陈佳磊LaWAM:隐空间世界动作模型!不生成未来视频,也让机器人拥有"物理预见力"YouTube Bilibililink
2026.07.21北京中关村学院与中科院自动化所联培博士生刘志豪STEAM:面向真实世界机器人学习的、无需人工标注的帧级优势估计框架YouTube Bilibililink
2026.07.15新加坡南洋理工大学(MMLab@NTU)博士后研究员许牧天Kinema4D:面向时空具身仿真的运动学 4D 世界建模YouTube Bilibili
2026.07.11CMU 博士研究生赖睿航PithTrain:Agent 时代的 MoE 训练框架设计YouTube Bilibili
2026.07.04复旦大学计算与智能创新学院23级硕士研究生张世铎如何设计一个好的自回归 VLA:从问题构建到工程落地的探索之旅YouTube Bilibililink
2026.06.30清华大学人工智能学院博士生方科晨DPA & LLaVA-HUD v4:多模态大模型的深度预对齐与高效视觉编码优化YouTube Bilibili
2026.06.27Mind Lab Research Scientist,Head of Infrastructure,清华大学博士陆逸文MinT: 面向百万级 LoRA 策略的训练与推理基础设施YouTube Bilibili
2026.06.23vLLM-Omni和VeRL-Omni开源社区核心贡献者,香港科技大学博士,华为莱布尼茨研究所Research Scientist黄永祥VeRL-Omni:面向多模态生成模型的高效RL后训练框架YouTube Bilibili
2026.06.16北大博士生孟繁续从 MLA 到 GQLA:无需从头训练,硬件自适应高效注意力机制YouTube Bilibililink
2026.06.13新加坡国立大学(NUS)计算机科学在读博士吴林昱UniRL:面向统一多模态模型的分布式 RL 后训练框架YouTube Bilibili
2026.06.09清华大学博士生吕兴泰ZEDA:将 Post-Trained MoE 迁移为高效动态 MoEYouTube Bilibililink
2026.06.06中国人民大学高瓴人工智能学院博士在读董冠霆从 ARPO,到 AEPO,再到 Agent-World:探索通用智能体训练的可行路径YouTube Bilibili
2026.05.26南洋理工大学一年级博士生、Mind Lab 研究员雷京迪δ-mem:从长上下文到在线记忆,动态演化原生记忆的一次尝试YouTube Bilibililink
2026.05.19南洋理工大学(NTU)MMLab 博士生罗奕航STream3R & 4RC: 面向几何与运动理解的流式前馈 3D/4D 重建YouTube Bilibililink
2026.05.16自动化所深度强化学习团队博士生傅宇千重探 On-Policy Distillation(OPD):三类典型失败以及修复路径YouTube Bilibililink
2026.05.12中科大与上海AI Lab联培博士生谭泽霖大模型强化学习的 Scaling LawYouTube Bilibililink
2026.05.09SGLang框架核心开发者和维护者张柏舟DeepSeek V4 模型在 SGLang 中的系统级优化与全栈适配YouTube Bilibililink
2026.04.27清华大学博士生何秉翔从 TTRL 到 URLVR:大模型的无监督强化学习还能走多远?YouTube Bilibililink
2026.04.21中科院自动化所模式识别实验室在读博士生田浩辰SimScale:大规模真实世界仿真重塑端到端自动驾驶学习范式YouTube Bilibililink
2026.04.14MMLab@NTU 博士生伍晓鸣VLANeXt:12条设计准则,从入门到精通的 VLA 终极“配方”YouTubelink
2026.04.11达特茅斯学院计算机科学在读博士马驰宇FIPO & Future-KL:突破大语言模型在复杂推理中的性能瓶颈YouTube Bilibililink
2026.04.07新加坡南洋理工大学 MMLab 与 S-Lab 博士后研究员廖康Puffin: 统一多模态空间智能大模型——从任意视角理解和生成世界YouTube Bilibililink
2026.03.31芝加哥大学二年级博士生王胤杰OpenClaw-RL: 结合 GRPO + OPD,在使用中自适应变强的龙虾YouTube Bilibililink
2026.03.28CUHK MMLab PhD 二年级在读杨佳智RISE: 组合式世界模型,在“想象”中实现机器人策略的自主进化YouTube Bilibililink
2026.03.24中国科学技术大学少年班本科生徐哲轩从Depth Scaling到Width Scaling!WideSeek-R1:通过MARL探索大模型的广度扩展YouTube Bilibililink
2026.03.20麻省理工学院(MIT)博士后研究员周恺辰从 VGGT 到 PAGE-4D:动态世界中的 3D 感知统一框架YouTube Bilibililink
2026.03.17新加坡国立大学计算机系博士生、水杉智算技术联合创始人万政霖面向对象的 Agent Infra 新范式:有状态运行时管理的设计与工程实践YouTube Bilibililink
2026.03.14清华大学在读博士生吴科明EditReward : 当 AI 学会“审美”,可控多模态生成的下一代范式YouTube Bilibililink
2026.03.10清华大学交叉信息研究院本科生臧宏之RLinf-USER:面向现实世界机器人在线策略学习的统一且可扩展系统YouTube Bilibili
2026.03.07香港科技大学(HKUST)在读博士生刘威Dr. Kernel: 突破大模型 GPU Kernel 生成的多轮 RL 训练瓶颈YouTube Bilibililink
2026.03.03香港城市大学数据科学系博士生王天乐线性轨迹:揭示 LLM 强化学习中的高效捷径YouTube Bilibililink
2026.02.28MIT本科生 Iris XuBOAD:引入多臂老虎机,自动化搜索层级结构的多 Agent 架构设计YouTube Bilibili
2026.02.03清华大学博士生何秉翔JustRL: 用"最笨"的 RL 方法刷新 1.5B 推理模型新基线YouTube Bilibililink
2026.01.30香港科技大学博士候选人、 NVIDIA 研究实习生刘诗扬GDPO:解决 GRPO 在多奖励 RL 训练中的"优势崩溃"问题YouTube Bilibililink
2026.01.27上海人工智能实验室具身智能中心青年科学家曾嘉InternVLA-A1,虚实贯通:理解、生成、执行一体化的具身操作大模型YouTube Bilibililink
2026.01.20南洋理工大学 MMLab 实验室博士生范洧辰The Prism Hypothesis 视觉统一表征假说:从语义到像素的统一自编码(UAE)H5 YouTube Bilibililink
2026.01.13阿里巴巴通义实验室实习生、西北工业大学本科&香港科技大学预备博士姜登阳Decoupled DMD & DMDR: 在扩散模型步数蒸馏的实践及 Z-Image-Turbo 应用H5 YouTube Bilibililink
2026.01.10通义千问算法工程师高畅从 TRPO 到 SAPO:大模型 RL 算法演进H5 YouTube Bilibililink
2026.01.06MiniMax算法工程师、通用模型后训练负责人程威宇MiniMax M2.1:Agent 后训练经验与认知H5 YouTube Bilibililink

2025

直播时间主讲人主题直播/回放观看链接PPT
2025.12.26青稞‘s2025 “青稞” AI 嘉年华YouTube Bilibili
2025.12.20大厂研究科学家Yingru LiTRPO重生:大模型时代的信任域策略优化YouTube Bilibili
2025.12.16香港大学MMLab博士生陈俊松SANA-Series:探索图像视频扩散模型的高效设计与加速H5 YouTube Bilibililink
2025.12.13SeaAI Lab 研究工程师、新加坡国立大学博士生齐朋辉从 BF16 到 FP16:如何解决RL训练-推理不匹配问题H5 YouTube Bilibililink
2025.12.09香港大学MMLab博士生吴成岳Fast-dLLM v2:高效训练推理的块扩散大语言模型框架H5 YouTube Bilibililink
2025.12.06北京大学博士生陈康从 $π_0$ 到 $π_{RL}$:面向流匹配 VLA 的强化学习后训练框架H5 YouTube Bilibililink
2025.12.02清华大学交叉信息研究院本科生臧宏之RLinf-VLA 实践:从零上手 VLA(OpenVLA )强化学习H5 YouTube Bilibililink
2025.11.29清华大学博士生张金涛SageAttention & Sparse-Linear Attention & SpargeAttention:通过量化与稀疏性实现高效注意力机制H5 YouTube Bilibililink
2025.11.25无问芯穹首席研究员林灏RLinf:面向具身智能的“渲训推一体化”开源强化训练框架H5 YouTube Bilibililink
2025.11.22清华大学计算机系副教授章明星、KTransformers项目核心参与者李沛KTransformers,在大模型微调与推理中的系统化实践H5 YouTube Bilibililink
2025.11.18同济大学计算机学院博士生刘洪博ShotBench: 面向增强MLLM摄影语言理解能力的训练与评估体系H5 YouTube Bilibili
2025.11.15北京大学博士生周嘉懿Generative RLHF-V: 面向多模态 RLHF 的人类意图对齐框架H5 YouTube Bilibililink
2025.11.11华中科技大学&华为联培博士生吴官骏UniLat3D:几何–外观统一VAE的单阶段 3D 生成框架H5 YouTube Bilibililink
2025.11.08香港大学直博生黄炜RL 训练框架:QeRL,量化技术增强强化学习 Reasoning 探索H5 YouTube Bilibililink
2025.11.06清华博士生程家乐从 DeepSeek-OCR 到 Glyph:深入理解图像-文本压缩技术H5 YouTube Bilibililink
2025.11.04NUS AI Researcher 倪瑾杰OpenMoE2 :Sparse Diffusion Language ModelsH5 YouTube Bilibililink
2025.11.01清华大学博士生李昊展SimpleVLA-RL:简单可拓展的VLA强化学习训练H5 YouTube Bilibililink
2025.10.28清华大学博士生吕兴泰统一 SFT & RL:迈向大型语言模型后训练的统一视角H5 YouTube Bilibililink
2025.10.25香港大学 XLANG Lab 计算机科学博士生王心远OpenCUA:用于构建 Computer-Use Agent 的开源框架H5 Youtube Bilibililink
2025.10.21清华大学博士生张开颜RL for LRMs:探讨面向推理模型的 RL 最新研究H5 YouTube Bilibililink
2025.10.18伊利诺伊大学香槟分校 (UIUC) 博士生钱成UserRL & UserBench-“知人者智”:以用户为中心的智能体交互与训练H5 YouTube Bilibililink
2025.10.16新加坡国立大学博士生张桂彬MemGen:生成式隐式记忆,Agent Memory 的第三种可能H5 YouTube Bilibililink
2025.09.18新加坡国立大学博士生张桂彬从 LLM-RL 到 Agentic RL:如何让语言模型成为自主智能体H5 YouTube Bilibililink
2025.09.09香港中文大学王鸿儒博士Theory of Agent: From Definition, to Behavior and ObjectiveH5 YouTube Bilibililink1 link2
2025.09.06英伟达NeMo团队高级深度学习算法工程师李之愈,以及高级产品经理高文雯NeMo RL:让大规模 MoE 模型权重 Refit 加速 10 倍H5 YouTube Bilibililink
2025.08.30加州大学圣地亚哥分校(UCSD)博士生姚峰FlashRL:探讨现代 RL 框架中推理与训练的错位问题及解决方案H5 YouTube bilibililink1 link
2025.08.23王维埙博士,淘天集团未来生活实验室 算法专家
熊绍潘硕士,爱橙科技智能引擎算法平台 大模型强化学习框架工程师
ROLL:面向 Agentic 场景的生产级大规模强化学习训练框架H5 YouTube Bilibililink
2025.08.19马里兰大学博士生陈玖海从BLIP3o到BLIP3o-NEXT:迈向统一生成与理解的多模态大模型H5 YouTube Bilibililink
2025.08.16西湖大学修宇亮实验室访问学生李博谦ETCH: 通过等变紧度向量将人体拟合推广到穿衣人体的方法H5 YouTube Bilibili
2025.08.12清华大学自然语言处理实验室博士生余天予RLPR:基于参考概率奖励的强化学习,推广 RLVR 到通用领域推理问题H5 YouTubelink
2025.08.09南洋理工大学MMLab博士生田淑琳Evaluation Agent:面向视觉生成模型的高效可提示的评估框架H5 YouTubelink
2025.08.07通义千问研究员,Qwen3、QwQ系列开源模型核心贡献者郑楚杰博士GSPO:大规模强化学习训练算法,迈向持续拓展的语言模型强化学习H5 YouTube
2025.08.05Sea AI Lab(新加坡)算法工程师,新加坡国立大学博士生万信逸大模型训练流水线并行四部曲:吞吐、内存、负载均衡与线性扩展H5 YouTubelink
2025.08.02智谱 AI RL Infra 工程师、slime 开源项目作者朱子霖slime:专为 RL Scaling 设计的大规模 RL 训练框架及实践H5 YouTubelink
2025.07.26香港城市大学计算机科学在读博士生陈胜庄SIMoE:稀疏插值混合专家,大模型升级再造的自动化专家发现框架H5 YouTubelink
2025.07.22香港中文大学(深圳)GAP实验室博士生叶崇杰Hi3DGen:法线为桥,为高清三维几何生成另辟蹊径H5 YouTube
2025.07.19纽约大学访问学生尹柏乔和西北大学博士生王启能MindCube:空间智能的实现路径,探究 VLMs 构建稳健空间心理模型的能力H5 YouTubelink
2025.07.15华南理工大学与IDEA 联合培养博士蒋擎ChatRex/RexSeek/Rex-Thinker:结合多模态大语言模型的目标检测模型构建H5 YouTubelink
2025.07.12英伟达公司研究员刁诗哲ProRL: 延长强化学习训练框架,拓展大语言模型的推理边界H5 YouTubelink
2025.07.08南洋理工大学MMLab博士生吴鹏浩GUI-Reflection:让多模态 GUI 智能体获得反思纠错能力的训练框架H5 YouTube
2025.07.05新加坡科技设计大学 博士生曾广韬Satori-SWE:用 Evolutionary Test-Time Scaling 让小语言模型解决复杂软件工程H5 YouTubelink
2025.07.01北京大学博士生张宇臣大模型推理强化学习中的熵机制H5 YouTubelink
2025.06.28马萨诸塞大学阿默斯特分校周沁泓博士和张洪鑫博士Virtual Community 虚拟社区:面向人、机器人与社会的开放世界H5 YouTube
2025.06.24香港大学MMLab博士生吴成岳Fast-dLLM:无需重训的扩散大语言模型推理加速H5 YouTubelink
2025.06.21复旦大学博士生王玮赟InternVL3,GPT-4o开源平替:探索多模态通用感知大模型的技术演进与应用探索H5 YouTubelink
2025.06.16新加坡国立大学博士生张扬生成模型中的极简概念擦除H5 YouTube
2025.06.12中国科学院博士黎昆昌BAGEL:统一生成理解的多模态基础模型H5 YouTubelink
2025.06.09微软亚洲研究院高级研究员宋恺涛Chain-of-Model (模型链):引入因果建模,全新的大模型 Scaling 结构H5 YouTubelink
2025.05.29加州大学伯克利分校计算机科学博士生席浩诚Sparse VideoGen:无需重新训练的 DiTs 推理加速框架H5 YouTube
2025.05.26青稞社区联合创始人高岱恒EraseAnything:在 Flux 等先进文生图架构的概念擦除方法H5 YouTubelink
2025.05.22北京大学智能学院博士生节世博MoLE & SpeCache:大语言模型端侧部署的架构与算法H5 YouTubelink
2025.05.19verl core contributor 童雨轩verl 源码解读 与 HybridFlow 编程范式讲解H5 YouTubelink
2025.05.14清华大学博士生张开颜从 TTS 到 TTRL:无标签数据强化学习探索与展望H5 YouTube
2025.04.26华中科技大学硕士在读、MMlab@NTU研究助理刘天齐Free4D:无需微调的 4D 场景生成新框架H5 YouTube
2025.04.22UC Berkeley 博士生潘家怡和李岫宇从 TinyZero 到 APR:语言模型推理能力的探索与自适应并行化H5 YouTubelink
2025.04.19香港科技大学(HKUST)计算机系博士生曾伟豪B-STaR & SimpleRL-Zoo:通过强化学习自我提升推理性能和效率H5 YouTubelink
2025.04.04加州大学圣地亚哥分校计算机科学与工程系副教授张怡颖InferCept、Preble & Cognify:面向下一代 AI Agent 工作流系统的构建H5 YouTubelink
2025.03.29UTS ReLER lab博士生杨向鹏VideoGrain:基于扩散模型的多粒度视频编辑的探索与应用H5 YouTubelink
2025.03.22加州大学伯克利分校计算机科学博士生席浩诚COAT:显存高效的 FP8 训练,实现高效深度学习H5 YouTubelink
2025.03.15阿里通义实验室高级算法工程师张熙PC-Agent:面向复杂 PL 任务的多模态智能体框架H5 YouTube
2025.03.08商汤科技大模型工具体系团队研究员、LightLLM 核心开发人员白世豪基于 LightLLM 的 DeepSeek R1/V3 模型部署实战H5 YouTubelink
2025.02.22上海人工智能实验室青年科学家崔淦渠PRIME: 结合隐式过程奖励的强化学习H5 YouTubelink
2025.02.15MIT博士生沈茂昊Satori:通过训练LLM做自回归搜索来增强推理能力H5 YouTubelink
2025.01.14香港科技大学(广州)博士生许添硕Motion Dreamer:面向自动驾驶与物理世界对齐的视频生成模型H5 YouTube bilibili
2025.01.04香港科技大学计算机博士生马跃Follow Family:可控视频生成方法探索与应用H5 YouTube bilibili
2024.12.28香港科技大学广州博士生周子凯Tuning-Free Enhence:通过噪声初始化和采样轨迹优化增强预训练扩散模型H5 YouTubelink
2024.12.24中国科学院自动化研究所博士生、新加坡国立大学访问博士生李志凯K-Sort Arena:视觉生成模型的高效人类偏好竞技场H5 YouTube bilibililink
2024.12.21CMU 博士生董易昕XGrammar:高效实现 LLM灵活且可移植的结构化生成H5 YouTubelink
2024.12.16商汤科技研究院模型压缩研究员谷石桥、雍洋LLMC:大语言模型压缩工具的开发实践H5 YouTube bilibililink
2024.12.14深度求索(DeepSeek)研究员、UT Austin博士刘星超Rectified Flow:矫正流生成式模型的概念及应用实践H5 YouTubelink
2024.11.30微软研究院 AI Frontiers 实验室高级研究员鲁亚东OminiParser:基于纯视觉的 GUI AgentH5
2024.11.23NVIDIA VILA 团队实习生方云浩VILA^2 : 视觉语言模型能力的自我提升H5 YouTubelink
2024.11.05中科院自动化所和香港城市大学联合培养博士生林浩坤DuQuant: 基于正交变换实现大型语言模型的 SOTA级 4 bit 量化H5 YouTubelink
2024.10.17香港科技大学在读博士高深远GenAD & Vista:构建通用可泛化的自动驾驶世界模型H5 YouTube
2024.10.14南京大学智能科学与技术学院研究员、助理教授傅朝友VITA:开源交互式多模态基础大模型H5
2024.10.11商汤科技算法实习生、香港科技大学准博士生黄雨石LLMC:大语言模型的量化基准H5 YouTube bilibili
2024.09.26Eigent AI Founding Engineer、CAMEL AI开源多智能体框架核心贡献者范文栋使用 CAMEL Agents 构建 GraphRAG 及应用实践H5 YouTube bilibili
2024.09.23智谱AI算法工程师,CogVideoX作者之一 张昱轩CogVideoX 视频生成开源模型上手实践H5 YouTube
2024.09.10阿里巴巴通义实验室高级算法工程师、华东师范大学博士叶加博mPLUG-Owl3:探索长序列模型架构的通用多模态大模型H5 YouTube
2024.09.03Databricks Mosaic Research研究科学家,斯坦福大学博士盛颖SGLang v0.2:面向 LLM 和 VLM 的快速、高效通用服务引擎H5link
2024.08.26UC Berkeley 博士生曹诗怡S-LoRA:实现多 LoRA 大模型的高效并行化推理H5 YouTube
2024.08.14麻省理工学院准博士生唐嘉铭AWQ:激活值感知的LLM低位权重量化H5 YouTube
2024.08.06香港中文大学博士后王文海InternVL 2.0:通过渐进式策略扩展开源多模态大模型的性能边界H5 YouTubelink
2024.07.30香港科技大学(广州)人工智能方向博士研究生杨帅SEED-Story:生成长篇图文故事的多模态大型语言模型H5 YouTube
2024.07.23华中科技大学博士生程天恒YOLO-World:基于视觉语言模型的实时开放词汇物体检测H5 YouTubelink
2024.07.15清华大学自然语言处理实验室博士生余天予MiniCPM-V:端侧可用的 GPT-4V 级多模态大模型H5 YouTubelink
2024.07.11阿里通义实验室高级算法专家徐海洋Mobile-Agent:基于多模态Agent架构的手机智能体H5 YouTubelink
2024.07.08北京航空航天大学博士生郑耀威LLaMA Factory:从预训练到RLHF,大模型高效训练框架H5 YouTubelink
2024.06.27浙江大学硕士研究生董玉博VillagerAgent:减少幻觉、提高任务分解效率的多智能协作体框架H5 YouTubelink
2024.06.17香港大学MMLAB在读博士吴成岳LLaMA Pro:扩展Transformer块优化的大型语言模型继续预训练H5 YouTubelink
2024.06.13北京大学在读博士孟繁续PiSSA:收敛快、误差小的大模型参数高效微调方法H5 YouTube
2024.06.06上海人工智能实验室青年研究员、OpenDriveLab具身智能方向负责人曾嘉博士具身多模态大模型的视觉表征预训练研究H5 YouTube
2024.05.29南洋理工大学 MMLab 实验室在读博士姜瑜铭VideoBooth:文本和图像提示共同驱动的视频生成H5 YouTube
2024.05.24新加坡国立大学Research Fellow倪瑾杰MixEval:混合评测数据集来拟合大语言模型的人类评估H5 YouTube
2024.05.21华南理工大学集合感知与智能实验室博士梁智灏实时渲染 3DGS 中的反走样及逆渲染应用H5 YouTube
2024.05.103D-VLA第一作者甄昊宇3D-VLA:构建生成式三维具身世界模型H5 YouTubelink
2024.04.24香港中文大学在读博士李彦玮Mini-Gemini:挖掘多模态视觉语言大模型的潜力H5 YouTubelink
2024.04.19加州大学洛杉矶分校在读博士洪逸宁从 3D LLM 到 MultiPLY ,3D 具身基础模型的构建H5 youtube
2024.04.15清华大学自然语言处理实验室(THUNLP)博士后钱忱ChatDev——大语言模型驱动的多智能体协作与演化H5 YouTubelink
2024.04.10慕尼黑工业大学视觉计算实验室博士陈振宇SceneTex:高质量三维室内场景纹理图生成H5 YouTubelink
2024.03.02DeepFaceLab(累计60,000 +⭐️)作者小黑兔
InstantID(huggingface space周榜第一)作者王浩帆
剑桥大学计算机系在读博士Andi Zhang
VBench 第一作者、南洋理工大学MMLab在读博士黄子琪
Sora迷思,AIGC的微积分时刻?H5

经典大模型公开课第二季


进群

青稞具身智能技术交流群青稞AI技术交流群

Contributors

wangguo113

70 commits

qingkelab/qingketalk

青稞Talk

223

70 commits

updated Sep 12, 2026

See the code

README

青年AI研究员idea加油站,AI开发者的新能源充电桩!


青稞社区主页 | 关于青稞


青稞Talk


2026

直播时间主讲人主题直播/回放观看链接PPT
2026.09.17清华大学博士生何秉翔Rethinking On-Policy Distillation of Large Language Models
2026.09.12圣路易斯华盛顿大学博士生黄呈松EnvHarness:左脚踩右脚!让环境随着 Agent 的训练一起进化
2026.09.08香港中文大学博士、华为莱布尼茨研究所研究员杜一鸣Lego-RL:面向真实 Coding Agent 的 Harness-Native 强化学习方法YouTube Bilibililink
2026.09.05伊利诺伊大学香槟分校 (UIUC) 二年级博士生钱成AI4AI at Test-Time:从 Harness 看 AI4AI 如何实现以及未来YouTube Bilibililink
2026.09.01上海人工智能实验室物理智能中心青年研究员周云松
上海人工智能实验室物理智能中心青年研究员王帅
从“如何生成”到“如何验证”,探讨物理一致世界模型如何实现可扩展机器人学习YouTube Bilibili
2026.08.29NUS 博士生张桂彬模型的“什么经验值得被看见”?LOPD:不再手动设计 OPSD 特权信息
2026.08.25NVIDIA Research 研究科学家,前 MIT CSAIL 博士后研究员毛伟岸TriAttention:面向长推理的三角级数式 KV Cache 压缩YouTube Bilibililink
2026.08.22北京大学人工智能研究院博士生李珩立LatentSeek & GradCuit:从价值引导的隐空间优化看大语言模型推理YouTube Bilibililink
2026.08.13衔远科技算法研究员、清华大学博士生姜澈AI for AI 的前世今生:从进化、自进化与元进化,迈向递归自我改进(RSI)YouTube Bilibili
2026.08.11新加坡国立大学(NUS)计算学院博士生李一博Agentic RL 下半场:无需梯度更新的即时强化学习JitRLYouTube Bilibili
2026.08.08清华大学深圳国际研究生院硕士在读张翼显从端到端 VLA 到 Harness VLA:面向具身智能与机器人操作任务的记忆增强式执行框架YouTube Bilibili
2026.08.06新加坡南洋理工大学(MMLab@NTU)博士后研究员操雨康新一代具身智能数据范式ACE-Data-0:以人为中心的环境式采集构建具身数据引擎YouTube Bilibili
2026.08.04上海交通大学人工智能学院博士生林涛LA4VLA:从 VLA 预训练中解耦语言-动作监督YouTube Bilibililink
2026.08.01通义千问(Qwen)团队研究员陈雄辉Alignment unlocks Scaling:Qwen-Robot Suite 的设计原理和背后的思考YouTube Bilibili
2026.07.28清华大学数学系四年级博士生王颢宁
巴黎萨克雷高等师范学院 MVA 研究生刘懿玮
在线自进化后训练框架 DRIFT:没有外部专家监督时,如何让 OPD 策略学会自我持续进化YouTube Bilibili
2026.07.25中关村学院联合培养博士生陈佳磊LaWAM:隐空间世界动作模型!不生成未来视频,也让机器人拥有"物理预见力"YouTube Bilibililink
2026.07.21北京中关村学院与中科院自动化所联培博士生刘志豪STEAM:面向真实世界机器人学习的、无需人工标注的帧级优势估计框架YouTube Bilibililink
2026.07.15新加坡南洋理工大学(MMLab@NTU)博士后研究员许牧天Kinema4D:面向时空具身仿真的运动学 4D 世界建模YouTube Bilibili
2026.07.11CMU 博士研究生赖睿航PithTrain:Agent 时代的 MoE 训练框架设计YouTube Bilibili
2026.07.04复旦大学计算与智能创新学院23级硕士研究生张世铎如何设计一个好的自回归 VLA:从问题构建到工程落地的探索之旅YouTube Bilibililink
2026.06.30清华大学人工智能学院博士生方科晨DPA & LLaVA-HUD v4:多模态大模型的深度预对齐与高效视觉编码优化YouTube Bilibili
2026.06.27Mind Lab Research Scientist,Head of Infrastructure,清华大学博士陆逸文MinT: 面向百万级 LoRA 策略的训练与推理基础设施YouTube Bilibili
2026.06.23vLLM-Omni和VeRL-Omni开源社区核心贡献者,香港科技大学博士,华为莱布尼茨研究所Research Scientist黄永祥VeRL-Omni:面向多模态生成模型的高效RL后训练框架YouTube Bilibili
2026.06.16北大博士生孟繁续从 MLA 到 GQLA:无需从头训练,硬件自适应高效注意力机制YouTube Bilibililink
2026.06.13新加坡国立大学(NUS)计算机科学在读博士吴林昱UniRL:面向统一多模态模型的分布式 RL 后训练框架YouTube Bilibili
2026.06.09清华大学博士生吕兴泰ZEDA:将 Post-Trained MoE 迁移为高效动态 MoEYouTube Bilibililink
2026.06.06中国人民大学高瓴人工智能学院博士在读董冠霆从 ARPO,到 AEPO,再到 Agent-World:探索通用智能体训练的可行路径YouTube Bilibili
2026.05.26南洋理工大学一年级博士生、Mind Lab 研究员雷京迪δ-mem:从长上下文到在线记忆,动态演化原生记忆的一次尝试YouTube Bilibililink
2026.05.19南洋理工大学(NTU)MMLab 博士生罗奕航STream3R & 4RC: 面向几何与运动理解的流式前馈 3D/4D 重建YouTube Bilibililink
2026.05.16自动化所深度强化学习团队博士生傅宇千重探 On-Policy Distillation(OPD):三类典型失败以及修复路径YouTube Bilibililink
2026.05.12中科大与上海AI Lab联培博士生谭泽霖大模型强化学习的 Scaling LawYouTube Bilibililink
2026.05.09SGLang框架核心开发者和维护者张柏舟DeepSeek V4 模型在 SGLang 中的系统级优化与全栈适配YouTube Bilibililink
2026.04.27清华大学博士生何秉翔从 TTRL 到 URLVR:大模型的无监督强化学习还能走多远?YouTube Bilibililink
2026.04.21中科院自动化所模式识别实验室在读博士生田浩辰SimScale:大规模真实世界仿真重塑端到端自动驾驶学习范式YouTube Bilibililink
2026.04.14MMLab@NTU 博士生伍晓鸣VLANeXt:12条设计准则,从入门到精通的 VLA 终极“配方”YouTubelink
2026.04.11达特茅斯学院计算机科学在读博士马驰宇FIPO & Future-KL:突破大语言模型在复杂推理中的性能瓶颈YouTube Bilibililink
2026.04.07新加坡南洋理工大学 MMLab 与 S-Lab 博士后研究员廖康Puffin: 统一多模态空间智能大模型——从任意视角理解和生成世界YouTube Bilibililink
2026.03.31芝加哥大学二年级博士生王胤杰OpenClaw-RL: 结合 GRPO + OPD,在使用中自适应变强的龙虾YouTube Bilibililink
2026.03.28CUHK MMLab PhD 二年级在读杨佳智RISE: 组合式世界模型,在“想象”中实现机器人策略的自主进化YouTube Bilibililink
2026.03.24中国科学技术大学少年班本科生徐哲轩从Depth Scaling到Width Scaling!WideSeek-R1:通过MARL探索大模型的广度扩展YouTube Bilibililink
2026.03.20麻省理工学院(MIT)博士后研究员周恺辰从 VGGT 到 PAGE-4D:动态世界中的 3D 感知统一框架YouTube Bilibililink
2026.03.17新加坡国立大学计算机系博士生、水杉智算技术联合创始人万政霖面向对象的 Agent Infra 新范式:有状态运行时管理的设计与工程实践YouTube Bilibililink
2026.03.14清华大学在读博士生吴科明EditReward : 当 AI 学会“审美”,可控多模态生成的下一代范式YouTube Bilibililink
2026.03.10清华大学交叉信息研究院本科生臧宏之RLinf-USER:面向现实世界机器人在线策略学习的统一且可扩展系统YouTube Bilibili
2026.03.07香港科技大学(HKUST)在读博士生刘威Dr. Kernel: 突破大模型 GPU Kernel 生成的多轮 RL 训练瓶颈YouTube Bilibililink
2026.03.03香港城市大学数据科学系博士生王天乐线性轨迹:揭示 LLM 强化学习中的高效捷径YouTube Bilibililink
2026.02.28MIT本科生 Iris XuBOAD:引入多臂老虎机,自动化搜索层级结构的多 Agent 架构设计YouTube Bilibili
2026.02.03清华大学博士生何秉翔JustRL: 用"最笨"的 RL 方法刷新 1.5B 推理模型新基线YouTube Bilibililink
2026.01.30香港科技大学博士候选人、 NVIDIA 研究实习生刘诗扬GDPO:解决 GRPO 在多奖励 RL 训练中的"优势崩溃"问题YouTube Bilibililink
2026.01.27上海人工智能实验室具身智能中心青年科学家曾嘉InternVLA-A1,虚实贯通:理解、生成、执行一体化的具身操作大模型YouTube Bilibililink
2026.01.20南洋理工大学 MMLab 实验室博士生范洧辰The Prism Hypothesis 视觉统一表征假说:从语义到像素的统一自编码(UAE)H5 YouTube Bilibililink
2026.01.13阿里巴巴通义实验室实习生、西北工业大学本科&香港科技大学预备博士姜登阳Decoupled DMD & DMDR: 在扩散模型步数蒸馏的实践及 Z-Image-Turbo 应用H5 YouTube Bilibililink
2026.01.10通义千问算法工程师高畅从 TRPO 到 SAPO:大模型 RL 算法演进H5 YouTube Bilibililink
2026.01.06MiniMax算法工程师、通用模型后训练负责人程威宇MiniMax M2.1:Agent 后训练经验与认知H5 YouTube Bilibililink

2025

直播时间主讲人主题直播/回放观看链接PPT
2025.12.26青稞‘s2025 “青稞” AI 嘉年华YouTube Bilibili
2025.12.20大厂研究科学家Yingru LiTRPO重生:大模型时代的信任域策略优化YouTube Bilibili
2025.12.16香港大学MMLab博士生陈俊松SANA-Series:探索图像视频扩散模型的高效设计与加速H5 YouTube Bilibililink
2025.12.13SeaAI Lab 研究工程师、新加坡国立大学博士生齐朋辉从 BF16 到 FP16:如何解决RL训练-推理不匹配问题H5 YouTube Bilibililink
2025.12.09香港大学MMLab博士生吴成岳Fast-dLLM v2:高效训练推理的块扩散大语言模型框架H5 YouTube Bilibililink
2025.12.06北京大学博士生陈康从 $π_0$ 到 $π_{RL}$:面向流匹配 VLA 的强化学习后训练框架H5 YouTube Bilibililink
2025.12.02清华大学交叉信息研究院本科生臧宏之RLinf-VLA 实践:从零上手 VLA(OpenVLA )强化学习H5 YouTube Bilibililink
2025.11.29清华大学博士生张金涛SageAttention & Sparse-Linear Attention & SpargeAttention:通过量化与稀疏性实现高效注意力机制H5 YouTube Bilibililink
2025.11.25无问芯穹首席研究员林灏RLinf:面向具身智能的“渲训推一体化”开源强化训练框架H5 YouTube Bilibililink
2025.11.22清华大学计算机系副教授章明星、KTransformers项目核心参与者李沛KTransformers,在大模型微调与推理中的系统化实践H5 YouTube Bilibililink
2025.11.18同济大学计算机学院博士生刘洪博ShotBench: 面向增强MLLM摄影语言理解能力的训练与评估体系H5 YouTube Bilibili
2025.11.15北京大学博士生周嘉懿Generative RLHF-V: 面向多模态 RLHF 的人类意图对齐框架H5 YouTube Bilibililink
2025.11.11华中科技大学&华为联培博士生吴官骏UniLat3D:几何–外观统一VAE的单阶段 3D 生成框架H5 YouTube Bilibililink
2025.11.08香港大学直博生黄炜RL 训练框架:QeRL,量化技术增强强化学习 Reasoning 探索H5 YouTube Bilibililink
2025.11.06清华博士生程家乐从 DeepSeek-OCR 到 Glyph:深入理解图像-文本压缩技术H5 YouTube Bilibililink
2025.11.04NUS AI Researcher 倪瑾杰OpenMoE2 :Sparse Diffusion Language ModelsH5 YouTube Bilibililink
2025.11.01清华大学博士生李昊展SimpleVLA-RL:简单可拓展的VLA强化学习训练H5 YouTube Bilibililink
2025.10.28清华大学博士生吕兴泰统一 SFT & RL:迈向大型语言模型后训练的统一视角H5 YouTube Bilibililink
2025.10.25香港大学 XLANG Lab 计算机科学博士生王心远OpenCUA:用于构建 Computer-Use Agent 的开源框架H5 Youtube Bilibililink
2025.10.21清华大学博士生张开颜RL for LRMs:探讨面向推理模型的 RL 最新研究H5 YouTube Bilibililink
2025.10.18伊利诺伊大学香槟分校 (UIUC) 博士生钱成UserRL & UserBench-“知人者智”:以用户为中心的智能体交互与训练H5 YouTube Bilibililink
2025.10.16新加坡国立大学博士生张桂彬MemGen:生成式隐式记忆,Agent Memory 的第三种可能H5 YouTube Bilibililink
2025.09.18新加坡国立大学博士生张桂彬从 LLM-RL 到 Agentic RL:如何让语言模型成为自主智能体H5 YouTube Bilibililink
2025.09.09香港中文大学王鸿儒博士Theory of Agent: From Definition, to Behavior and ObjectiveH5 YouTube Bilibililink1 link2
2025.09.06英伟达NeMo团队高级深度学习算法工程师李之愈,以及高级产品经理高文雯NeMo RL:让大规模 MoE 模型权重 Refit 加速 10 倍H5 YouTube Bilibililink
2025.08.30加州大学圣地亚哥分校(UCSD)博士生姚峰FlashRL:探讨现代 RL 框架中推理与训练的错位问题及解决方案H5 YouTube bilibililink1 link
2025.08.23王维埙博士,淘天集团未来生活实验室 算法专家
熊绍潘硕士,爱橙科技智能引擎算法平台 大模型强化学习框架工程师
ROLL:面向 Agentic 场景的生产级大规模强化学习训练框架H5 YouTube Bilibililink
2025.08.19马里兰大学博士生陈玖海从BLIP3o到BLIP3o-NEXT:迈向统一生成与理解的多模态大模型H5 YouTube Bilibililink
2025.08.16西湖大学修宇亮实验室访问学生李博谦ETCH: 通过等变紧度向量将人体拟合推广到穿衣人体的方法H5 YouTube Bilibili
2025.08.12清华大学自然语言处理实验室博士生余天予RLPR:基于参考概率奖励的强化学习,推广 RLVR 到通用领域推理问题H5 YouTubelink
2025.08.09南洋理工大学MMLab博士生田淑琳Evaluation Agent:面向视觉生成模型的高效可提示的评估框架H5 YouTubelink
2025.08.07通义千问研究员,Qwen3、QwQ系列开源模型核心贡献者郑楚杰博士GSPO:大规模强化学习训练算法,迈向持续拓展的语言模型强化学习H5 YouTube
2025.08.05Sea AI Lab(新加坡)算法工程师,新加坡国立大学博士生万信逸大模型训练流水线并行四部曲:吞吐、内存、负载均衡与线性扩展H5 YouTubelink
2025.08.02智谱 AI RL Infra 工程师、slime 开源项目作者朱子霖slime:专为 RL Scaling 设计的大规模 RL 训练框架及实践H5 YouTubelink
2025.07.26香港城市大学计算机科学在读博士生陈胜庄SIMoE:稀疏插值混合专家,大模型升级再造的自动化专家发现框架H5 YouTubelink
2025.07.22香港中文大学(深圳)GAP实验室博士生叶崇杰Hi3DGen:法线为桥,为高清三维几何生成另辟蹊径H5 YouTube
2025.07.19纽约大学访问学生尹柏乔和西北大学博士生王启能MindCube:空间智能的实现路径,探究 VLMs 构建稳健空间心理模型的能力H5 YouTubelink
2025.07.15华南理工大学与IDEA 联合培养博士蒋擎ChatRex/RexSeek/Rex-Thinker:结合多模态大语言模型的目标检测模型构建H5 YouTubelink
2025.07.12英伟达公司研究员刁诗哲ProRL: 延长强化学习训练框架,拓展大语言模型的推理边界H5 YouTubelink
2025.07.08南洋理工大学MMLab博士生吴鹏浩GUI-Reflection:让多模态 GUI 智能体获得反思纠错能力的训练框架H5 YouTube
2025.07.05新加坡科技设计大学 博士生曾广韬Satori-SWE:用 Evolutionary Test-Time Scaling 让小语言模型解决复杂软件工程H5 YouTubelink
2025.07.01北京大学博士生张宇臣大模型推理强化学习中的熵机制H5 YouTubelink
2025.06.28马萨诸塞大学阿默斯特分校周沁泓博士和张洪鑫博士Virtual Community 虚拟社区:面向人、机器人与社会的开放世界H5 YouTube
2025.06.24香港大学MMLab博士生吴成岳Fast-dLLM:无需重训的扩散大语言模型推理加速H5 YouTubelink
2025.06.21复旦大学博士生王玮赟InternVL3,GPT-4o开源平替:探索多模态通用感知大模型的技术演进与应用探索H5 YouTubelink
2025.06.16新加坡国立大学博士生张扬生成模型中的极简概念擦除H5 YouTube
2025.06.12中国科学院博士黎昆昌BAGEL:统一生成理解的多模态基础模型H5 YouTubelink
2025.06.09微软亚洲研究院高级研究员宋恺涛Chain-of-Model (模型链):引入因果建模,全新的大模型 Scaling 结构H5 YouTubelink
2025.05.29加州大学伯克利分校计算机科学博士生席浩诚Sparse VideoGen:无需重新训练的 DiTs 推理加速框架H5 YouTube
2025.05.26青稞社区联合创始人高岱恒EraseAnything:在 Flux 等先进文生图架构的概念擦除方法H5 YouTubelink
2025.05.22北京大学智能学院博士生节世博MoLE & SpeCache:大语言模型端侧部署的架构与算法H5 YouTubelink
2025.05.19verl core contributor 童雨轩verl 源码解读 与 HybridFlow 编程范式讲解H5 YouTubelink
2025.05.14清华大学博士生张开颜从 TTS 到 TTRL:无标签数据强化学习探索与展望H5 YouTube
2025.04.26华中科技大学硕士在读、MMlab@NTU研究助理刘天齐Free4D:无需微调的 4D 场景生成新框架H5 YouTube
2025.04.22UC Berkeley 博士生潘家怡和李岫宇从 TinyZero 到 APR:语言模型推理能力的探索与自适应并行化H5 YouTubelink
2025.04.19香港科技大学(HKUST)计算机系博士生曾伟豪B-STaR & SimpleRL-Zoo:通过强化学习自我提升推理性能和效率H5 YouTubelink
2025.04.04加州大学圣地亚哥分校计算机科学与工程系副教授张怡颖InferCept、Preble & Cognify:面向下一代 AI Agent 工作流系统的构建H5 YouTubelink
2025.03.29UTS ReLER lab博士生杨向鹏VideoGrain:基于扩散模型的多粒度视频编辑的探索与应用H5 YouTubelink
2025.03.22加州大学伯克利分校计算机科学博士生席浩诚COAT:显存高效的 FP8 训练,实现高效深度学习H5 YouTubelink
2025.03.15阿里通义实验室高级算法工程师张熙PC-Agent:面向复杂 PL 任务的多模态智能体框架H5 YouTube
2025.03.08商汤科技大模型工具体系团队研究员、LightLLM 核心开发人员白世豪基于 LightLLM 的 DeepSeek R1/V3 模型部署实战H5 YouTubelink
2025.02.22上海人工智能实验室青年科学家崔淦渠PRIME: 结合隐式过程奖励的强化学习H5 YouTubelink
2025.02.15MIT博士生沈茂昊Satori:通过训练LLM做自回归搜索来增强推理能力H5 YouTubelink
2025.01.14香港科技大学(广州)博士生许添硕Motion Dreamer:面向自动驾驶与物理世界对齐的视频生成模型H5 YouTube bilibili
2025.01.04香港科技大学计算机博士生马跃Follow Family:可控视频生成方法探索与应用H5 YouTube bilibili
2024.12.28香港科技大学广州博士生周子凯Tuning-Free Enhence:通过噪声初始化和采样轨迹优化增强预训练扩散模型H5 YouTubelink
2024.12.24中国科学院自动化研究所博士生、新加坡国立大学访问博士生李志凯K-Sort Arena:视觉生成模型的高效人类偏好竞技场H5 YouTube bilibililink
2024.12.21CMU 博士生董易昕XGrammar:高效实现 LLM灵活且可移植的结构化生成H5 YouTubelink
2024.12.16商汤科技研究院模型压缩研究员谷石桥、雍洋LLMC:大语言模型压缩工具的开发实践H5 YouTube bilibililink
2024.12.14深度求索(DeepSeek)研究员、UT Austin博士刘星超Rectified Flow:矫正流生成式模型的概念及应用实践H5 YouTubelink
2024.11.30微软研究院 AI Frontiers 实验室高级研究员鲁亚东OminiParser:基于纯视觉的 GUI AgentH5
2024.11.23NVIDIA VILA 团队实习生方云浩VILA^2 : 视觉语言模型能力的自我提升H5 YouTubelink
2024.11.05中科院自动化所和香港城市大学联合培养博士生林浩坤DuQuant: 基于正交变换实现大型语言模型的 SOTA级 4 bit 量化H5 YouTubelink
2024.10.17香港科技大学在读博士高深远GenAD & Vista:构建通用可泛化的自动驾驶世界模型H5 YouTube
2024.10.14南京大学智能科学与技术学院研究员、助理教授傅朝友VITA:开源交互式多模态基础大模型H5
2024.10.11商汤科技算法实习生、香港科技大学准博士生黄雨石LLMC:大语言模型的量化基准H5 YouTube bilibili
2024.09.26Eigent AI Founding Engineer、CAMEL AI开源多智能体框架核心贡献者范文栋使用 CAMEL Agents 构建 GraphRAG 及应用实践H5 YouTube bilibili
2024.09.23智谱AI算法工程师,CogVideoX作者之一 张昱轩CogVideoX 视频生成开源模型上手实践H5 YouTube
2024.09.10阿里巴巴通义实验室高级算法工程师、华东师范大学博士叶加博mPLUG-Owl3:探索长序列模型架构的通用多模态大模型H5 YouTube
2024.09.03Databricks Mosaic Research研究科学家,斯坦福大学博士盛颖SGLang v0.2:面向 LLM 和 VLM 的快速、高效通用服务引擎H5link
2024.08.26UC Berkeley 博士生曹诗怡S-LoRA:实现多 LoRA 大模型的高效并行化推理H5 YouTube
2024.08.14麻省理工学院准博士生唐嘉铭AWQ:激活值感知的LLM低位权重量化H5 YouTube
2024.08.06香港中文大学博士后王文海InternVL 2.0:通过渐进式策略扩展开源多模态大模型的性能边界H5 YouTubelink
2024.07.30香港科技大学(广州)人工智能方向博士研究生杨帅SEED-Story:生成长篇图文故事的多模态大型语言模型H5 YouTube
2024.07.23华中科技大学博士生程天恒YOLO-World:基于视觉语言模型的实时开放词汇物体检测H5 YouTubelink
2024.07.15清华大学自然语言处理实验室博士生余天予MiniCPM-V:端侧可用的 GPT-4V 级多模态大模型H5 YouTubelink
2024.07.11阿里通义实验室高级算法专家徐海洋Mobile-Agent:基于多模态Agent架构的手机智能体H5 YouTubelink
2024.07.08北京航空航天大学博士生郑耀威LLaMA Factory:从预训练到RLHF,大模型高效训练框架H5 YouTubelink
2024.06.27浙江大学硕士研究生董玉博VillagerAgent:减少幻觉、提高任务分解效率的多智能协作体框架H5 YouTubelink
2024.06.17香港大学MMLAB在读博士吴成岳LLaMA Pro:扩展Transformer块优化的大型语言模型继续预训练H5 YouTubelink
2024.06.13北京大学在读博士孟繁续PiSSA:收敛快、误差小的大模型参数高效微调方法H5 YouTube
2024.06.06上海人工智能实验室青年研究员、OpenDriveLab具身智能方向负责人曾嘉博士具身多模态大模型的视觉表征预训练研究H5 YouTube
2024.05.29南洋理工大学 MMLab 实验室在读博士姜瑜铭VideoBooth:文本和图像提示共同驱动的视频生成H5 YouTube
2024.05.24新加坡国立大学Research Fellow倪瑾杰MixEval:混合评测数据集来拟合大语言模型的人类评估H5 YouTube
2024.05.21华南理工大学集合感知与智能实验室博士梁智灏实时渲染 3DGS 中的反走样及逆渲染应用H5 YouTube
2024.05.103D-VLA第一作者甄昊宇3D-VLA:构建生成式三维具身世界模型H5 YouTubelink
2024.04.24香港中文大学在读博士李彦玮Mini-Gemini:挖掘多模态视觉语言大模型的潜力H5 YouTubelink
2024.04.19加州大学洛杉矶分校在读博士洪逸宁从 3D LLM 到 MultiPLY ,3D 具身基础模型的构建H5 youtube
2024.04.15清华大学自然语言处理实验室(THUNLP)博士后钱忱ChatDev——大语言模型驱动的多智能体协作与演化H5 YouTubelink
2024.04.10慕尼黑工业大学视觉计算实验室博士陈振宇SceneTex:高质量三维室内场景纹理图生成H5 YouTubelink
2024.03.02DeepFaceLab(累计60,000 +⭐️)作者小黑兔
InstantID(huggingface space周榜第一)作者王浩帆
剑桥大学计算机系在读博士Andi Zhang
VBench 第一作者、南洋理工大学MMLab在读博士黄子琪
Sora迷思,AIGC的微积分时刻?H5

经典大模型公开课第二季


进群

青稞具身智能技术交流群青稞AI技术交流群

Contributors

wangguo113

70 commits