Paper2Chinese/NeurIPS2024-Reading-Paper-With-Code

27

7 commits

updated Oct 25, 2024

See the code

README

NeurIPS2024-Reading-Paper-With-Code


注1:欢迎各位作者大佬提交issue,分享NeurIPS 2024论文和开源项目!

注2:关于CV领域顶级期刊(TPAMI、IJCV等)论文解读大盘点,详见: https://github.com/Paper2Chinese/Paper2Chinese

【NeurIPS 2024 论文开源目录】

3DGS(Gaussian Splatting)

Mamba / SSM

Avatars

Backbone

CLIP

A Cat Is A Cat (Not A Dog!): Unraveling Information Mix-ups in Text-to-Image Encoders through Causal Analysis and Embedding Optimization

MAE

Federated Online Prediction from Experts with Differential Privacy: Separations and Regret Speed-ups

OCR

Occupancy

NeRF

DETR

GNN

Sequential Signal Mixing Aggregation for Message Passing Graph Neural Networks

Prompt

Beyond Prompts: Dynamic Conversational Benchmarking of Large Language Models

大语言模型(LLM)

Procedure-Aware Surgical Video-language Pretraining with Hierarchical Knowledge Augmentation

RouterDC: Query-Based Router by Dual Contrastive Learning for Assembling Large Language Models

Can Models Learn Skill Composition from Examples?

视觉语言模型(LLM)

Vision-Language Models are Strong Noisy Label Detectors

多模态大语言模型(MLLM)

多模态

Towards Robust Multimodal Sentiment Analysis with Incomplete Data

Towards Unified Multimodal Editing with Enhanced Knowledge Collaboration

NAS

A Hitchhikers Guide to Fine-Grained Face Forgery Detection Using Common Sense Reasoning

强化学习(Reinforcement Learning)

Boosting Sample Efficiency and Generalization in Multi-agent Reinforcement Learning via Equivariance

Abstract Reward Processes: Leveraging State Abstraction for Consistent Off-Policy Evaluation

ZSC-Eval: An Evaluation Toolkit and Benchmark for Multi-agent Zero-shot Coordination

ReID(重识别)

扩散模型(Diffusion Models)

Magnet: We Never Know How Text-to-Image Diffusion Models Work, Until We Learn How Vision-Language Models Function

Image Copy Detection for Diffusion Models

Simple and Fast Distillation of Diffusion Models

Gradient-free Decoder Inversion in Latent Diffusion Models

Vision Transformer

视觉和语言(Vision-Language)

目标检测(Object Detection)

数据增强(Data Augmentation)

Learning from Offline Foundation Features with Tensor Augmentations

异常检测(Anomaly Detection)

目标跟踪(Object Tracking)

Spiking Neural Network as Adaptive Event Stream Slicer

语义分割(Semantic Segmentation)

Unleashing the Potential of the Diffusion Model in Few-shot Semantic Segmentation

DarkSAM: Fooling Segment Anything Model to Segment Nothing

少样本学习(Few-Shot Learning)

FAST: A Dual-tier Few-Shot Learning Paradigm for Whole Slide Image Classification

生物工程(bioengineering)

FlexSBDD: Structure-Based Drug Design with Flexible Protein Modeling

Generalized Protein Pocket Generation with Prior-Informed Flow Matching

医学图像(Medical Image)

Physics-Regularized Multi-Modal Image Assimilation for Brain Tumor Localization

医学图像分割(Medical Image Segmentation)

视频目标分割(Video Object Segmentation)

人脸识别(Face Recognition)

CemiFace: Center-based Semi-hard Synthetic Face Generation for Face Recognition

3D点云(3D-Point-Cloud)

自监督学习(Self-supervised Learning)

Localizing Memorization in SSL Vision Encoders

Cross-video Identity Correlating for Person Re-identification Pre-training

联邦学习(Federated Learning)

Hierarchical Federated Learning with Multi-Timescale Gradient Correction

增量学习(Incremental Learning)

Task-recency bias strikes back: Adapting covariances in Exemplar-Free Class Incremental Learning

3D语义分割(3D Semantic Segmentation)

图像编辑(Image Editing)

图像补全/图像修复(Image Inpainting)

生成对抗网络(GAN)

Dual Encoder GAN Inversion for High-Fidelity 3D Head Reconstruction from Single Images

视频编辑(Video Editing)

Low-level Vision

超分辨率(Super-Resolution)

去噪(Denoising)

图像去噪(Image Denoising)

3D人体姿态估计(3D Human Pose Estimation)

Multi-hypotheses Conditioned Point Cloud Diffusion for 3D Human Reconstruction from Occluded Images

图像生成(Image Generation)

FlowTurbo: Towards Real-time Flow-Based Image Generation with Velocity Refiner

视频生成(Video Generation)

3D生成

DeBaRA: Denoising-Based 3D Room Arrangement Generation

视频理解(Video Understanding)

E.T. Bench: Towards Open-Ended Event-Level Video-Language Understanding

持续学习(Continual Learning)

Forgetting, Ignorance or Myopia: Revisiting Key Challenges in Online Continual Learning

行为识别(Action Recognition)

Beyond Euclidean: Dual-Space Representation Learning for Weakly Supervised Video Violence Detection

知识蒸馏(Knowledge Distillation)

图像压缩(Image Compression)

立体匹配(Stereo Matching)

场景图生成(Scene Graph Generation)

计数(Counting)

隐式神经表示(Implicit Neural Representations)

Towards Croppable Implicit Neural Representations

视频质量评价(Video Quality Assessment)

数据集(Datasets)

Towards Comprehensive Detection of Chinese Harmful Memes

T2Vs Meet VLMs: A Scalable Multimodal Dataset for Visual Harmfulness Recognition

Off to new Shores: A Dataset & Benchmark for (near-)coastal Flood Inundation Forecasting

反学习(Machine Unlearning)

Unified Gradient-Based Machine Unlearning with Remain Geometry Enhancement

新任务(New Tasks)

Most Influential Subset Selection: Challenges, Promises, and Beyond

模型加速(Improving Reasoning)

On the Inductive Bias of Stacking Towards Improving Reasoning

时间序列(Time Series)

Rethinking the Power of Timestamps for Robust Time Series Forecasting: A Global-Local Fusion Perspective

其他(Others)

Predictive Attractor Models

Maia-2: A Unified Model for Human-AI Alignment in Chess

PPLNs: Parametric Piecewise Linear Networks for Event-Based Temporal Modeling and Beyond

RMLR: Extending Multinomial Logistic Regression into General Geometries

An Accelerated Algorithm for Stochastic Bilevel Optimization under Unbounded Smoothness

On the Power of Decision Trees in Auto-Regressive Language Modeling

Autoregressive Policy Optimization for Constrained Allocation Tasks

Generative Retrieval Meets Multi-Graded Relevance

Decomposable Transformer Point Processes

Safe Time-Varying Optimization based on Gaussian Processes with Spatio-Temporal Kernel

Contributors

Paper2Chinese

7 commits

Paper2Chinese/NeurIPS2024-Reading-Paper-With-Code

27

7 commits

updated Oct 25, 2024

See the code

README

NeurIPS2024-Reading-Paper-With-Code


注1:欢迎各位作者大佬提交issue,分享NeurIPS 2024论文和开源项目!

注2:关于CV领域顶级期刊(TPAMI、IJCV等)论文解读大盘点,详见: https://github.com/Paper2Chinese/Paper2Chinese

【NeurIPS 2024 论文开源目录】

3DGS(Gaussian Splatting)

Mamba / SSM

Avatars

Backbone

CLIP

A Cat Is A Cat (Not A Dog!): Unraveling Information Mix-ups in Text-to-Image Encoders through Causal Analysis and Embedding Optimization

MAE

Federated Online Prediction from Experts with Differential Privacy: Separations and Regret Speed-ups

OCR

Occupancy

NeRF

DETR

GNN

Sequential Signal Mixing Aggregation for Message Passing Graph Neural Networks

Prompt

Beyond Prompts: Dynamic Conversational Benchmarking of Large Language Models

大语言模型(LLM)

Procedure-Aware Surgical Video-language Pretraining with Hierarchical Knowledge Augmentation

RouterDC: Query-Based Router by Dual Contrastive Learning for Assembling Large Language Models

Can Models Learn Skill Composition from Examples?

视觉语言模型(LLM)

Vision-Language Models are Strong Noisy Label Detectors

多模态大语言模型(MLLM)

多模态

Towards Robust Multimodal Sentiment Analysis with Incomplete Data

Towards Unified Multimodal Editing with Enhanced Knowledge Collaboration

NAS

A Hitchhikers Guide to Fine-Grained Face Forgery Detection Using Common Sense Reasoning

强化学习(Reinforcement Learning)

Boosting Sample Efficiency and Generalization in Multi-agent Reinforcement Learning via Equivariance

Abstract Reward Processes: Leveraging State Abstraction for Consistent Off-Policy Evaluation

ZSC-Eval: An Evaluation Toolkit and Benchmark for Multi-agent Zero-shot Coordination

ReID(重识别)

扩散模型(Diffusion Models)

Magnet: We Never Know How Text-to-Image Diffusion Models Work, Until We Learn How Vision-Language Models Function

Image Copy Detection for Diffusion Models

Simple and Fast Distillation of Diffusion Models

Gradient-free Decoder Inversion in Latent Diffusion Models

Vision Transformer

视觉和语言(Vision-Language)

目标检测(Object Detection)

数据增强(Data Augmentation)

Learning from Offline Foundation Features with Tensor Augmentations

异常检测(Anomaly Detection)

目标跟踪(Object Tracking)

Spiking Neural Network as Adaptive Event Stream Slicer

语义分割(Semantic Segmentation)

Unleashing the Potential of the Diffusion Model in Few-shot Semantic Segmentation

DarkSAM: Fooling Segment Anything Model to Segment Nothing

少样本学习(Few-Shot Learning)

FAST: A Dual-tier Few-Shot Learning Paradigm for Whole Slide Image Classification

生物工程(bioengineering)

FlexSBDD: Structure-Based Drug Design with Flexible Protein Modeling

Generalized Protein Pocket Generation with Prior-Informed Flow Matching

医学图像(Medical Image)

Physics-Regularized Multi-Modal Image Assimilation for Brain Tumor Localization

医学图像分割(Medical Image Segmentation)

视频目标分割(Video Object Segmentation)

人脸识别(Face Recognition)

CemiFace: Center-based Semi-hard Synthetic Face Generation for Face Recognition

3D点云(3D-Point-Cloud)

自监督学习(Self-supervised Learning)

Localizing Memorization in SSL Vision Encoders

Cross-video Identity Correlating for Person Re-identification Pre-training

联邦学习(Federated Learning)

Hierarchical Federated Learning with Multi-Timescale Gradient Correction

增量学习(Incremental Learning)

Task-recency bias strikes back: Adapting covariances in Exemplar-Free Class Incremental Learning

3D语义分割(3D Semantic Segmentation)

图像编辑(Image Editing)

图像补全/图像修复(Image Inpainting)

生成对抗网络(GAN)

Dual Encoder GAN Inversion for High-Fidelity 3D Head Reconstruction from Single Images

视频编辑(Video Editing)

Low-level Vision

超分辨率(Super-Resolution)

去噪(Denoising)

图像去噪(Image Denoising)

3D人体姿态估计(3D Human Pose Estimation)

Multi-hypotheses Conditioned Point Cloud Diffusion for 3D Human Reconstruction from Occluded Images

图像生成(Image Generation)

FlowTurbo: Towards Real-time Flow-Based Image Generation with Velocity Refiner

视频生成(Video Generation)

3D生成

DeBaRA: Denoising-Based 3D Room Arrangement Generation

视频理解(Video Understanding)

E.T. Bench: Towards Open-Ended Event-Level Video-Language Understanding

持续学习(Continual Learning)

Forgetting, Ignorance or Myopia: Revisiting Key Challenges in Online Continual Learning

行为识别(Action Recognition)

Beyond Euclidean: Dual-Space Representation Learning for Weakly Supervised Video Violence Detection

知识蒸馏(Knowledge Distillation)

图像压缩(Image Compression)

立体匹配(Stereo Matching)

场景图生成(Scene Graph Generation)

计数(Counting)

隐式神经表示(Implicit Neural Representations)

Towards Croppable Implicit Neural Representations

视频质量评价(Video Quality Assessment)

数据集(Datasets)

Towards Comprehensive Detection of Chinese Harmful Memes

T2Vs Meet VLMs: A Scalable Multimodal Dataset for Visual Harmfulness Recognition

Off to new Shores: A Dataset & Benchmark for (near-)coastal Flood Inundation Forecasting

反学习(Machine Unlearning)

Unified Gradient-Based Machine Unlearning with Remain Geometry Enhancement

新任务(New Tasks)

Most Influential Subset Selection: Challenges, Promises, and Beyond

模型加速(Improving Reasoning)

On the Inductive Bias of Stacking Towards Improving Reasoning

时间序列(Time Series)

Rethinking the Power of Timestamps for Robust Time Series Forecasting: A Global-Local Fusion Perspective

其他(Others)

Predictive Attractor Models

Maia-2: A Unified Model for Human-AI Alignment in Chess

PPLNs: Parametric Piecewise Linear Networks for Event-Based Temporal Modeling and Beyond

RMLR: Extending Multinomial Logistic Regression into General Geometries

An Accelerated Algorithm for Stochastic Bilevel Optimization under Unbounded Smoothness

On the Power of Decision Trees in Auto-Regressive Language Modeling

Autoregressive Policy Optimization for Constrained Allocation Tasks

Generative Retrieval Meets Multi-Graded Relevance

Decomposable Transformer Point Processes

Safe Time-Varying Optimization based on Gaussian Processes with Spatio-Temporal Kernel

Contributors

Paper2Chinese

7 commits