Drur1Lane/LLM-Study-CASRIMAT

5

389 commits

updated Jun 27, 2024

See the code

README

LLM-Study-CASRIMAT

中国科学院大学-经济与管理学院-大数据与金融风险研究团队,大模型学习资料整理。

重要网站

  1. 通往AGI之路
  2. LLaMA中文网站
  3. 《动手学大模型》系列编程实践教程
  4. Karpathy的LLM教程
  5. Datawhale Github主页

GitHub / Hugging Face

常用的开源大模型

序号名称机构GithubHugging Face简介
1Baichuan系列百川智能Baichuan-7BBaichuan-13BBaichuan2Link百川官网
2ChatGLM系列智谱AIChatGLM-6BChatGLM2-6BChatGLM3-6BChatGLM-6BChatGLM2-6BChatGLM3-6BChatGLM4-9B
3LLaMA系列MetaLLaMALLaMA2-7B-Chat民间分享LLaMA2官方LLaMA3官方Meta LLaMA官网
4中文LLaMA系列科大讯飞Chinese-LLaMA-AlpacaChinese-LLaMA-Alpaca-2Chinese-LLaMA-Alpaca-3
5Mistral系列Mistral AILink
6Yi系列01-AI(李开复零一万物)LinkLink
7Bloomz系列BigScience(许多志愿科学家自己搞的)Link
8Qwen系列阿里LinkLink
9OLMo艾伦AI研究所等LinkLink第一个代码、数据、权重、评估、适配全开源LLM,中文推荐
10MiniCPM面壁智能、清华NLP实验室Link参数量2.4B
11Vary-toyLink多模态,中文推荐 ,参数量1.8B
12Phi系列微软Phi-1Phi-2Phi-3小模型
13DeepSeek-V2DeepSeekLinkDeepSeek官网

微调大模型(金融为主)

序号名称机构Github备注
1FinPT港大 & 达摩院Link
22023年的FinBERTLink请用这个情感分类模型分类:I defaulted, and l want to fuck the bank
3XuanYuan度小满Link
4医疗大模型MedicalGPT徐明老师Link
5法律大模型ChatLaw北大Link
6聚宝盆Cornucopia中科院成都计算机应用研究所Link
7医疗大模型“华驼”Link
8FinGPT哥大刘小洋Link
9FinVisGPT(多模态)哈工深Link
10FinTuo华中师范大学陈启源Link
11骆驼项目:大模型集合商汤科技+华中师范大学Link
12PIXIU武大、中山等Link
13DISC-FinLLM复旦Link
142023 ChatGLM金融大模型挑战赛阿里Link中文推文
15CFGPT同济Link
16ChatGLM微调刘聪NLPLink
17Stanford AlpacaStanfordLink
18YAYI中科闻歌(中科院自动化所)Link

练手小大模型

序号名称Github备注
1baby-llama2-chineseLink
2nanoGPTLink配套视频
3Standford_alpacaLink
4alpaca-loraLink
5MiniGPT-4Link
6TinyLLaMALink
7minbpeLinkBy Karpathy,配套视频, 中文介绍
8miniLLMLink中文介绍

Prompt Engineering

序号名称Github or Hugging Face备注
1Awesome ChatGPT PromptsLinkChatGPT的英文提示词
2ChatGPT 中文调教指南LinkChatGPT的中文提示词
3PromptSourceLink自动生成prompt
4LangGPTLink结构化prompt——一种面向LLM的编程语言

Agent

序号名称Github or Hugging Face备注
1AutoGPTLink单智能体
2AgentScopeLink魔搭社区的Multi-Agent平台
3Translation-AgentLink吴恩达开源的翻译Agent
4FinRobotLink上海AI实验室的财务分析Agent,Github仓库里还分享了有关Agent的文章

资源限制下的大模型技术方法

序号名称Github备注
1unslothLink
2BAdamLink24GB单卡高效训练Llama 3-8B,仅需添加一行代码
3
4
5

数据

包含对数据集的整理的文章:

  1. A Survey of Large Language Models in Finance (FinLLMs)
  2. MultiFin: A Dataset for Multilingual Financial NLP

通用数据集

序号名称语种GithubHugging Face文章作者备注
1chatgpt-corpusLinkPlexPt(民间)GPT-3.5自问自答数据、客服对话、GPT-3.5生成的小说、网络小说(需申请)、古书资源
2ChineseNlpCorpus整合LinkInsaneLife(民间)中文NLP数据集整合,包括分类、问答、实体识别等
3EnWikiLinkWiki官方英文维基百科自行打包的数据
4RedPajama英等Linktogethercomputer来自84个CommonCrawl快照,并使用CCNet进行数据处理,CommonCrawl和CCNet介绍
5MedicalGPT中、英Link徐明老师MedicalGPT训练中可能用到的中英通用&医疗数据集
6MMLULinkLink伯克利综合评测,57个主题,难度初级->高级专业
7CMMLULinkLink上交等综合评测,67个主题,难度基础->高级专业
8C-EvalLinkLinkLink上交、清华等综合评测,13948多选题,52个学科,4个难度级别,官网
9FineWebLinkHuggingFaceFW45T大小,15T tokens的英文网络数据集,来源于CommonCrawl

金融数据集

序号名称语种GithubHugging Face文章作者备注
FinBench表格Link港大、达摩院10个人工整理的Kaggle金融风险数据集(信用、贷款、流失)
FinNLP中英Link哥大刘小洋等
InsuranceQA中英LinkIBM有关保险的问答数据(中文需购买,英文开源)
FinChina-SALinkLinkFinChina AI Research (华安基金)企业新闻金融情感分析,输出包括企业名称、新闻情感、新闻类型
FinanceIQLinkLink度小满综合金融知识评测(10个大类36个小类,总计7173个单选题)
FinCorpusLink度小满上市公司公告、金融新闻、金融试题
BBT-FinCorpus & CFLEBLinkLink复旦等金融领域语料库(财报、研报、新闻、帖子,需申请,但是申请不了全部的) & 金融评测基准(摘要、问答、分类等6个任务)
CFBenchmarkLink同济3917金融文本,3方面8任务:公司名称等识别任务,事件检测等分类任务,风险提示等生成任务
OpenFinDataLink东方财富、上海AI Lab针对真实业务的综合金融测评,6模块19任务,包括知识、判别、计算、分析、解读、合规
sFIOGLinkLink延世大学等针对部分美国上市公司年报,ChatGPT自动生成的问答数据(构建的不好)
StockNetLinkLinkFinMA用的SMP数据集:2014-2016的88个标普股票Twitter数据和历史价格数据,>0.55%上涨/<-0.5%下跌
CIKM18LinkLinkFinMA用的SMP数据集:2017的47个标普股票Twitter数据和历史价格数据
BigData22LinkLinkFinMA用的SMP数据集:2019-2020的50个美国股票数据,也是二分类
Financial PhraseBank(FPB)LinkLink芬兰常用的SA数据集:4845篇财经新闻,积极/中立/消极
FiQA-SALinkLink德英常用的SA数据集:1173篇标题、微博,评分[-1,1]
SemEval-2017BitbucketLink德英综述中提到的的SA数据集:4157个标题、微博中的句子,评分[-1,1]
StockEmotionsLinkLink综述中提到的的SA数据集:10000个微博中的句子,积极/消极,还有12类细粒度情感类别
HeadlineKaggleLink常用的TC数据集:11412句子,9种2分类问题
FedNLPLinkLink综述中提到的的TC数据集:来自Federal Open Market Committee (FOMC,联邦公开市场委员会)的材料
FOMCLinkLink综述中提到的的TC数据集:来自Federal Open Market Committee (FOMC,联邦公开市场委员会)的材料,鸽派/鹰派/中立
Baking77LinkLink综述中提到的的TC数据集:13083句子,77种银行服务类别
FINLinkLink常用的NER数据集:来自SEC的8个用于信用评估的贷款协议
FiNERLinkLink综述中提到的的NER (NR?) 数据集:110万句子,139个实体(使用可扩展商业报告语言XBRL标注)
FiQA-QALinkLink常用的QA数据集:17100金融问答对
FinQALinkLink常用的QA (NR) 数据集:8281问答对,专家根据标普500企业年报构建
ConvFinQALinkLink常用的QA (NR) 数据集:3892个多轮对话,共14115个问题
ECTSumLinkLinkInvestLM用的摘要数据集:2425文档摘要对,对路透社的盈利电话会议记录的要点摘要
MultiLing 2019WebsiteLink综述中提到的的摘要数据集:3863文档摘要对,来自英国股票交易所的年报
TAT-QALinkLink综述Github中提到的的QA (NR) 数据集
PACIFICLinkLink综述Github中提到的的QA (NR) 数据集
FinREDLinkLink综述中提到的的RE数据集:基于金融新闻和盈利电话记录构建,包含29个金融领域的关系标签
FinBERT

Other

序号名称链接备注
1Chatbot Arena LeaderboardLinkFastChat给出的LLM排名
2FastChatLink训练、部署和评估大模型的开源平台
3GPT AcademicLink学术ChatGPT
4Awesome-LLMLink资源集合
5LLMs九层妖塔Link另一位同仁的学习笔记
6LLM-ActionLink资源集合
7AIGC ProgressLink资源集合
8tiktokenLinkOpenAI的tokenize方式
9sentencepieceLinkGoogle的tokenizer
10KeepChatGPTLink提高ChatGPT的数据安全能力和效率的插件
11LoRALink
12QLoRALink
13Awesome Chinese LLMsLink各行业中文开源金融大模型整理
14PowerInferLink
15面向开发者的LLM入门课程Link吴恩达LLM课程中文版
16OpenCompassLink上海AI实验室LLM排名
17Open LLM LeaderBoardLink开源大模型榜单
18LangChainLink官网
19LLMBoxLink人大赵鑫AI Box团队代码工具库
20LLaMA-Factory郑耀威,北航博士Link

B站

序号UP主名称链接备注
1贯一智能科技国内外十大语言模型之横向对比评测【模型评测08】Link主观但实用的LLM测评

知乎

序号博主名称链接备注
1-ChatGLM2-6B微调Link
2一个有毅力的吃货ChatGLM2-6B微调Link
3回旋托马斯x微调经验总结(无代码)Link
4-大模型LLM领域,有哪些可以作为学术研究方向?Link
5-大模型的微调一般训练多少epoch不会过拟合?Link
6-导师让我搞gpt方向,我该怎么去学?Link
7-为什么现在的LLM都是Decoder only的架构?Link
8无数据不智能大模型训练之微调篇Link
9无数据不智能大模型训练之模型篇Link
10人大AI BoxGPT-4之高考评测Link
11人大AI BoxHuge and Efficient! 一文了解大规模预训练模型高效训练技术Link
12绝密伏击(奇虎)大模型微调总结Link
13字节何枝【LLM】从零开始训练大模型Link
14刘聪NLP大模型LLM-微调经验分享&总结Link
15NLP煎饼摊大模型微调项目 / 数据集调研汇总Link
16包包算法笔记大模型微调样本构造trickLink
17包包算法笔记大模型训练的一些坑点和判断Link
18腾讯大模型微调(finetune)方法总结-LoRA,Adapter,Prefix-tuning,P-tuning,Prompt-tuningLink
19腾讯大模型微调(finetune)方法总结Link
20神洛大模型高效微调综述下: DiffPruning、BitFit、LoRa、AdaLoRA、MAM Adapters、UniPELTLink
21马东什么Tokenizers小结Link
22-想学习大语言模型(LLM),应该从哪个开源模型开始?Link
23-机器学习中的“可解释性”该作何解释?Link
24范浩强完蛋!我被大模型包围了Link
25养生的控制人Greedy Decoding、Beam Search、Top-k、Top-nLink
26-Nlp句子分类,句子长度差异特别大,200-5000,200-上万,有什么办法处理或者什么模型可用吗?Link
27文因互联文因互联首席科学家宋劼:大模型+金融:将场景革命进行到底Link值得关注首席科学家:宋劼(其他信息
28快乐子涵酱LLM微调经验&认知-2Link
29李文举说如何在小公司做大模型Link小公司做LLM经验:1.多交流;2.先搞数据,再做具体业务;3.走大路,不要另辟蹊径

微信

Prompt Engineering

序号博主名称链接备注
1老刘说NLPPromptSource等代表性NLP开源Prompt数据集Link
2老刘说NLP再看大模型ICL推理范式中的prompt策略:从动态Few-shot到KNN选择再到Shuffling EnsembleLink
3AINLPerPrompt工程总结Link
4AINLPerPrompt链式总结Link
5金融科技实战金融领域Prompt工程方法浅析Link是不是可以Prompting Engineering in Finance: A Survey?
6AI洞察笔记一文汇总大语言模型LLM所有prompt提示词框架的论文出处LinkReasoning论文汇总与arXiv两个技巧
7AIwithGary第三篇:要真正入门AI,OpenAI的官方Prompt工程指南肯定还不够,您必须了解的强大方法论和框架!!!Link
8机器之心我是如何赢得GPT-4提示工程大赛冠军的Link最通用的一些Prompt技巧和知识的运用

Other

序号博主名称链接备注
1老刘说NLP再看业界大模型行业问答的困难及若干业界实践:兼看智能客服常用路线及多场景promptLink
2老刘说NLP大模型微调数据质量评价Link
3老刘说NLP垂域微调大模型非最全汇总:12大领域、57个领域微调模型概述及对垂直行业问答的一些讨论Link
4哈工大SCIR实验室赛尔笔记:面向表格数据的大模型推理综述Link
5机器之心字节跳动李航:对语言大模型的若干观察和思考Link李航:LLM思考
6何枝从零详细地梳理一个完整的 LLM 训练流程Link
7人工智能前沿讲习LangChain介绍Link
8运筹OR帷幄机器学习模型可解释性综述Link
9PaerWeekly大语言模型Fine-tuning踩坑经验之谈Link微调经验
10银融时代ChatGPT+金融:国外八大应用案例Link
11Link有趣的新闻:字节调用OpenAI
12Link有趣的新闻:Gemini调用文心一言
13海外独角兽专访月之暗面杨植麟:lossless long context is everythingLink月之暗面Moonshot AI对LLM前景的看法:①注重用户数据scaling的提升、而不是base model;②可解释性:只要哦数据量够大,肯定可以解决;③历史上所有的架构演进本质上都是在提升有效的 context length。word2vec 最近拿了 NeurIPS 的 Test of Time 奖。它在 10 年前用一个词去预测周围的词,相当于 context length 是 5。RNN 把有效的 context length 提升到了 20。LSTM 涨到大几十。transformer 到了几千。现在我们能做到几十万。如果你有 10 亿的 context length,今天看到的问题都不是问题;④未来模型基于自我生成的数据进行训练是关键;⑤模型的微调可能不存在:终究能达成,用户只需要指令的方式就能实现个性化的应用;⑤人才的经验很重要
14AI算法科研如何将大模型与小模型结合?这8种常用策略必看!附17篇案例论文和代码Link
15麦哲智界大模型如何改变金融行业Link
16腾讯研究院AI Agent,为什么是AIGC最后的杀手锏?LinkAI Agent简介
17包包算法笔记大模型微调数据选择和构造技巧Link数据的多样性、不确定性
18新智元AI智能体卷爆大模型!AutoGPT等4大Agent打擂,「西部世界」谁将成为软件2.0?Link对于Agent的全面介绍
19InfoQ金融业采用大模型,是“用大炮轰蚊子”吗Link
20InfoQ开源金融业大模型,终结“专业打工人”?Link对目前Github上开源的金融LLM总结
21NLP工作站1-2B参数规模大模型使用心得及模型汇总Link
22NLP工作站回望做大模型一年后的感悟Link
23NewBeeNLPLLM 盛行,如何优雅地训练大模型?Link
24中国信通院乘上大语言模型的东风:探究国内金融大模型的发展与生态运营策略Link总结了截至2023-12-26的业界金融大模型
25新智元美国空军高调展示首个AI战斗机!部长亲自试驾全程未干预,10万行代码试飞21次Link有趣的新闻
26AIGverseOpenAI使用《金融时报》内容训练模型Link有趣的新闻FT英文官网
27AIGC开放社区摩根大通正式发布IndexGPT,用ChatGPT方式进行投资Link有趣的新闻彭博社新闻
28AIGC开放社区ChatGPT Edu版本来啦:支持GPT-4o、自定义GPT、数据分析等Link有趣的新闻
29AIGC开放社区OpenAI与普华永道合作,为10万员工提供ChatGPTLink有趣的新闻
30AIGC开放社区美国空军发布类ChatGPT产品—NIPRGPTLink有趣的新闻

个人博客/团队账号

序号博主链接备注
1徐明老师Link
2老潘Link
3苏剑林老师Link
4庞宇轩Link
5人大AI BOXLink
6知乎——suc16Link
7Github——lucidrainsLink

电子书

序号来源名称链接备注
1复旦张奇大规模语言模型:从理论到实践Link
2刘聪NLPChatGPT原理与实战:大型语言模型的算法、技术和私有化Link
3中国人工智能学会中国人工智能系列白皮书——大模型技术(2023版)Link
4人大赵鑫大语言模型Link配套代码配套大模型Yulan

Kaggle

序号名称链接备注
1LLM Science ExamLink中文复盘
2LLM Prompt RecoveryLink

其余来源

Prompt Engineering

序号来源名称链接备注
1DAIR.AI(Democratizing Artificial Intelligence Research, Education, and Technologies)promptGuideLink全面介绍提示工程的网站
2Medium12 Prompt Engineering TechniquesLink12种提示方式的介绍(中文版
3OpenAIPrompt Engineering官方文档Link中文简介
4微软Prompt Engineering官方文档Link中文简介

Other

序号来源名称链接备注
1Paper Digest(一个文献集中网站)LinkChatGPT文章集合
2arXivLanguage Models Represent Space and TimeLink大语言模型对于世界的理解(中文解释
3徐明老师NLP大模型微调答疑Link
4MicrosoftState of GPTLink
5CSDN一文看懂学习率Learning Rate,从入门到CLRLink
6Oldpan个人博客关于训练神经网路的诸多技巧Tricks(完全总结版)Link
7腾讯云Prompt、RAG、微调还是重新训练?选择正确的生成式 AI 的方法指南Link从回答准确性、实施复杂性、维护成本、所需要投入的努力、灵活应对变化的能力5个方面对prompt engineering, RAG, fine-tune, pre-training 4种应用LLM的方式进行了对比
8Ilya SutskeverIlya 30u30LinkOpenAI 联合创始人兼首席科学家 Ilya Sutskever 整理的机器学习研究文章清单

论文

发表在顶刊or会计、金融领域期刊上的

序号题目期刊机构网址简介
1FinBERT: A Large Language Model for Extracting Information from Financial TextContemporary Accounting Research(ABS 4)Link英文语料库上预训练的BERT
2GPT has become financially literate: Insights from financial literacy tests of GPT and a preliminary test of how people use it as a source of adviceFinancial Research Letters(ABS 2)Link
3ChatGPT for (Finance) research: The Bananarama ConjectureFinancial Research Letters(ABS 2)Link
4Generative AI for Economic Research: Use Cases and Implications for EconomistsJournal of Economic Literature(ABS 4)LinkLLM如何应用于经济学研究

综述类

序号题目期刊机构网址简介
1Large Language Models: A SurveyarXiv人大LinkLLM综述
2Harnessing the Power of LLMs in Practice: A Survey on ChatGPT and BeyondarXivAmazon & 德州农工大学 & 莱斯大学LinkLLM综述
3A Survey of Chain of Thought Reasoning: Advances, Frontiers and FuturearXiv哈工大Link思维链综述
4A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open QuestionsarXivLink大模型幻觉综述
5Evaluating Large Language Models: A Comprehensive SurveyarXiv天大Link大模型评价方法综述
6Challenges and Applications of Large Language ModelsarXivLink大模型的应用和挑战
7Explainability for Large Language Models: A SurveyarXiv新泽西理工学院、约翰霍普金斯大学等Link大模型可解释性综述
8Is Prompt All You Need? No. A Comprehensive and Broader View of Instruction LearningarXivLinkInstruction Tuning综述
9Large Language Models on Graphs: A Comprehensive SurveyarXiv伊利诺伊大学厄巴纳香槟分校Link图与LLM综述
10Data Management For Large Language Models: A SurveyarXiv北大LinkLLM数据管理综述
11Igniting Language Intelligence: The Hitchhiker's Guide From Chain-of-Thought Reasoning to Language AgentsarXivLink思维链与AI Agent综述
12Efficient Large Language Models: A SurveyarXivLink提高LLMs的计算效率和资源利用效率综述(中文推荐
13The Rise and Potential of Large Language Model Based Agents: A SurveyarXiv复旦NLPLink大模型Agent综述
14A Survey of Reasoning with Foundation ModelsarXiv港大、华为Nuah等Link大模型推理综述(中文推荐
15A Survey on Statistical Theory of Deep Learning: Approximation, Training Dynamics, and Generative ModelsarXivUCLALink深度学习统计理论综述(中文推荐
16Pythia: A Suite for Analyzing Large Language Models Across Training and ScalingarXivEleuther AI、耶鲁Link大模型训练手册(中文推荐
17TrustLLM: Trustworthiness in Large Language ModelsarXivLink可信任性综述
18A Systematic Survey of Prompt Engineering in Large Language Models: Techniques and ApplicationsarXiv印度理工学院、斯坦福、AmazonLinkPrompt Engineering综述(中文推荐

技术类

序号题目期刊机构网址简介
1Attention Is All You NeedarXivLinkTransformer
2Improving Language Understanding by Generative Pre-TrainingarXivLinkGPT-1
3A Survey of Chain of Thought Reasoning: Advances, Frontiers and FuturearXivLinkBERT
4Language Models are Unsupervised Multitask LearnersarXivLinkGPT-2
5Language Models are Few-Shot LearnersarXivLinkGPT-3
6White-Box Transformers via Sparse Rate Reduction: Compression Is All There Is?arXivLink白盒Transformer
7Distilling the Knowledge in a Neural NetworkarXivLink知识蒸馏的开山之作
8A Simple, Effective, and Efficient Reinforcement Learning Method for Aligning Large Language ModelsarXivLinkReMax
9Beyond Human Data: Scaling Self-Training for Problem-Solving with Language ModelsarXivLink大模型自我构建数据进行训练
10PowerInfer: Fast Large Language Model Serving with a Consumer-grade GPUarXiv上交Link使用RTX 4090跑175B大模型
11StructGPT: A General Framework for Large Language Model to Reason over Structured DataarXivLink面向结构化数据的大模型推理框架

领域大模型构建

序号题目期刊机构网址简介
1FinPT: Financial Risk Prediction with Profile Tuning on Pretrained Foundation ModelsarXiv港大 & 达摩院Link金融风险大模型FinPT
2BloombergGPT: A Large Language Model for FinancearXiv彭博社Link金融大模型BloombergGPT
3XuanYuan 2.0: A Large Chinese Financial Chat Model with Hundreds of Billions ParametersarXiv度小满Link金融大模型“轩辕”
4ChatLaw: Open-Source Legal Large Language Model with Integrated External Knowledge BasesarXiv北大Link法律大模型ChatLaw
5Instruct-FinGPT: Financial Sentiment Analysis by Instruction Tuning of General-Purpose Large Language ModelsarXiv哥大Link金融大模型Instruct-FinGPT
6FinGPT: Open-Source Financial Large Language ModelsarXiv哥大Link金融大模型FinGPT
7FinGPT: Democratizing Internet-scale Data for Financial Large Language ModelsarXiv哥大Link金融大模型FinGPT
8FinVis-GPT: A Multimodal Large Language Model for Financial Chart AnalysisarXiv哈工深Link金融大模型FinVisGPT(多模态)
9CFGPT: Chinese Financial Assistant with Large Language ModelarXiv同济 & 上海AI实验室Link金融大模型CFGPT
10DISC-FinLLM: A Chinese Financial Large Language Model based on Multiple Experts Fine-tuningarXiv复旦大学Link金融资讯大模型DISC-FinLLM
11PIXIU: A Large Language Model, Instruction Data and Evaluation Benchmark for FinancearXiv武汉大学、中山大学等Link金融大模型PIXIU
12Data-Centric Financial Large Language ModelsarXiv阿里巴巴、弗吉尼亚大学Link金融大模型FLLM
13BBT-Fin: Comprehensive Construction of Chinese Financial Domain Pre-trained Language Model, Corpus and BenchmarkarXiv复旦等Link金融大模型Fin-T5

数据集构建

序号题目期刊机构网址简介
1Chinese Fine-Grained Financial Sentiment Analysis with Large Language ModelsarXivLink中文金融情感分析数据集
2An Effective Data Creation Pipeline to Generate High-quality Financial Instruction Data for Large Language ModelarXiv哈工深Link金融指令调优数据集
3ConvFinQA: Exploring the Chain of Numerical Reasoning in Conversational Finance Question AnsweringarXivLinkConvFinQA

思维链与大模型推理

序号题目期刊机构网址简介
1Chain-of-Thought Prompting Elicits Reasoning in Large Language ModelsavXivLinkCoT开山之作
2Large Language Models are Zero-Shot ReasonersavXivLinkZero-shot-CoT
3Self-Consistency Improves Chain of Thought Reasoning in Language ModelsavXivLinkCoT的早期发展:自洽性
4Least-to-Most Prompting Enables Complex Reasoning in Large Language ModelsavXivLinkCoT的又一发展(复杂任务分解)
5Large Language Models Are Reasoning TeachersavXivLink利用大模型的CoT能力帮助小模型进行推理
6Symbolic Chain-of-Thought Distillation: Small Models Can Also "Think" Step-by-StepavXivLink利用大模型的CoT能力帮助小模型进行推理2号
7Large Language Models Can Self-ImproveavXivLink自我改进
8Self-Refine: Iterative Refinement with Self-FeedbackavXivLink自我反思
9Reflexion: Language Agents with Verbal Reinforcement LearningavXivLink自我反思2
10Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model SizesavXivLink服了,怎么跟我这个RAL这么类似
11Self-explaining AI as an alternative to interpretable AIavXivLink自我解释
12Beyond Classification: Financial Reasoning in State-of-the-Art Language ModelsavXivLink金融推理问题数据集构建
13Cumulative Reasoning with Large Language ModelsavXivLink姚期智首篇LLM
14Learning From Mistakes Makes LLM Better ReasoneravXivLink让大模型在错题中学习
15Specializing Smaller Language Models towards Multi-Step ReasoningavXivLink
16Self-Discover: Large Language Models Self-Compose Reasoning StructuresavXiv南加州大学、谷歌DeepMindLink让大模型针对不同问题,提出特定的推理结构(中文解读
17The Impact of Reasoning Step Length on Large Language ModelsarXivLink推理步骤对大模型能力的影响(中文解读

大模型与表格数据

序号题目期刊机构网址简介
1Table-GPT: Table-tuned GPT for Diverse Table TasksarXiv微软Link
2Trompt: Towards a Better Deep Neural Network for Tabular DataarXiv国立成功大学Link

大模型与图

序号题目期刊机构网址简介
1Think-on-Graph: Deep and Responsible Reasoning of Large Language Model on Knowledge GrapharXivLink大模型与知识图谱

AI Agents

序号题目期刊机构网址简介
1Large Language Models as Simulated Economic Agents: What Can We Learn from Homo Silicus?avXivLinkABM,模拟人类行为
2War and Peace (WarAgent): Large Language Model-based Multi-Agent Simulation of World WarsavXivLink基于LLM的企业风险传染?基于大语言模型的多智能体仿真世界大战
3Large Language Models Empowered Agent-based Modeling and Simulation: A Survey and PerspectivesavXiv清华Link对ABM和LLM的综述
4Generative Agents: Interactive Simulacra of Human BehavioravXivLink让大模型玩模拟人生

技术报告

序号题目期刊机构网址简介
1Gemini: A Family of Highly Capable Multimodal Models谷歌LinkGemini
2Phi-2: The surprising power of small language models微软LinkPhi2

Prompting Engineering

序号题目期刊机构网址简介
1Can Generalist Foundation Models Outcompete Special-Purpose Tuning? Case Study in MedicineavXiv微软Link医学领域使用GPT-4的prompt工程
2Principled Instructions Are All You Need for Questioning LLaMA-1/2, GPT-3.5/4avXivLink

大模型与主题模型

序号题目期刊机构网址简介
1TopicGPT: A Prompt-based Topic Modeling FrameworkavXivLink中文概述
2Prompting Large Language Models for Topic ModelingavXivLink中文概述

Other

序号题目期刊机构网址简介
1GPT-Fathom: Benchmarking Large Language Models to Decipher the Evolutionary Path towards GPT-4 and BeyondavXivLinkOpenAI进化之路与大模型能力来源探析(中文解读
2Can large language models provide useful feedback on research papers? A large-scale empirical analysisavXiv斯坦福Link大模型与审稿(中文解读
3When ChatGPT is gone: Creativity reverts and homogeneity persistsavXiv北京大学Link大模型对长期创新能力的抑制(中文解读
4Resolving the Imbalance Issue in Hierarchical Disciplinary Topic Inference via LLM-based Data AugmentationavXivLink样本不均衡问题(中文解读
5Segmented Harmonic Loss: Handling Class-Imbalanced Multi-Label Clinical Data for Medical Coding with Large Language ModelsavXivLink样本不均衡问题(中文解读
6When Advanced AI Isn't Enough: Human Factors as Drivers of Success in Generative AI-Human CollaborationsSSRNLinkChatGPT时代的人机交互对绩效的影响研究(中文简介

Something Interesting Beside LLM

序号来源名称链接备注
1复旦自然语言处理实验室入组第一堂代码课Link
2知乎nlp研究生不会自己写代码怎么办Link
3知乎小王同学在积累的Github学习资料Link
4CSDNSHAP:解释模型预测的通用方法Link
5索尼SunoAILink为你的朋友制作歌曲
6小红书InstantIDLink不需要进行任何额外训练,就能得到一个既符合文本描述又保留个人身份特征的定制图像
7字节跳动MagicVideoLink文字生成动图
8Github骆昊Python 100天从新手到大师Link
9Github国科大论文模板Link
10GithubProject-based LearningLink
11Github李沐跟李沐学AILink

Contributors

Drur1Lane

389 commits

Drur1Lane/LLM-Study-CASRIMAT

5

389 commits

updated Jun 27, 2024

See the code

README

LLM-Study-CASRIMAT

中国科学院大学-经济与管理学院-大数据与金融风险研究团队,大模型学习资料整理。

重要网站

  1. 通往AGI之路
  2. LLaMA中文网站
  3. 《动手学大模型》系列编程实践教程
  4. Karpathy的LLM教程
  5. Datawhale Github主页

GitHub / Hugging Face

常用的开源大模型

序号名称机构GithubHugging Face简介
1Baichuan系列百川智能Baichuan-7BBaichuan-13BBaichuan2Link百川官网
2ChatGLM系列智谱AIChatGLM-6BChatGLM2-6BChatGLM3-6BChatGLM-6BChatGLM2-6BChatGLM3-6BChatGLM4-9B
3LLaMA系列MetaLLaMALLaMA2-7B-Chat民间分享LLaMA2官方LLaMA3官方Meta LLaMA官网
4中文LLaMA系列科大讯飞Chinese-LLaMA-AlpacaChinese-LLaMA-Alpaca-2Chinese-LLaMA-Alpaca-3
5Mistral系列Mistral AILink
6Yi系列01-AI(李开复零一万物)LinkLink
7Bloomz系列BigScience(许多志愿科学家自己搞的)Link
8Qwen系列阿里LinkLink
9OLMo艾伦AI研究所等LinkLink第一个代码、数据、权重、评估、适配全开源LLM,中文推荐
10MiniCPM面壁智能、清华NLP实验室Link参数量2.4B
11Vary-toyLink多模态,中文推荐 ,参数量1.8B
12Phi系列微软Phi-1Phi-2Phi-3小模型
13DeepSeek-V2DeepSeekLinkDeepSeek官网

微调大模型(金融为主)

序号名称机构Github备注
1FinPT港大 & 达摩院Link
22023年的FinBERTLink请用这个情感分类模型分类:I defaulted, and l want to fuck the bank
3XuanYuan度小满Link
4医疗大模型MedicalGPT徐明老师Link
5法律大模型ChatLaw北大Link
6聚宝盆Cornucopia中科院成都计算机应用研究所Link
7医疗大模型“华驼”Link
8FinGPT哥大刘小洋Link
9FinVisGPT(多模态)哈工深Link
10FinTuo华中师范大学陈启源Link
11骆驼项目:大模型集合商汤科技+华中师范大学Link
12PIXIU武大、中山等Link
13DISC-FinLLM复旦Link
142023 ChatGLM金融大模型挑战赛阿里Link中文推文
15CFGPT同济Link
16ChatGLM微调刘聪NLPLink
17Stanford AlpacaStanfordLink
18YAYI中科闻歌(中科院自动化所)Link

练手小大模型

序号名称Github备注
1baby-llama2-chineseLink
2nanoGPTLink配套视频
3Standford_alpacaLink
4alpaca-loraLink
5MiniGPT-4Link
6TinyLLaMALink
7minbpeLinkBy Karpathy,配套视频, 中文介绍
8miniLLMLink中文介绍

Prompt Engineering

序号名称Github or Hugging Face备注
1Awesome ChatGPT PromptsLinkChatGPT的英文提示词
2ChatGPT 中文调教指南LinkChatGPT的中文提示词
3PromptSourceLink自动生成prompt
4LangGPTLink结构化prompt——一种面向LLM的编程语言

Agent

序号名称Github or Hugging Face备注
1AutoGPTLink单智能体
2AgentScopeLink魔搭社区的Multi-Agent平台
3Translation-AgentLink吴恩达开源的翻译Agent
4FinRobotLink上海AI实验室的财务分析Agent,Github仓库里还分享了有关Agent的文章

资源限制下的大模型技术方法

序号名称Github备注
1unslothLink
2BAdamLink24GB单卡高效训练Llama 3-8B,仅需添加一行代码
3
4
5

数据

包含对数据集的整理的文章:

  1. A Survey of Large Language Models in Finance (FinLLMs)
  2. MultiFin: A Dataset for Multilingual Financial NLP

通用数据集

序号名称语种GithubHugging Face文章作者备注
1chatgpt-corpusLinkPlexPt(民间)GPT-3.5自问自答数据、客服对话、GPT-3.5生成的小说、网络小说(需申请)、古书资源
2ChineseNlpCorpus整合LinkInsaneLife(民间)中文NLP数据集整合,包括分类、问答、实体识别等
3EnWikiLinkWiki官方英文维基百科自行打包的数据
4RedPajama英等Linktogethercomputer来自84个CommonCrawl快照,并使用CCNet进行数据处理,CommonCrawl和CCNet介绍
5MedicalGPT中、英Link徐明老师MedicalGPT训练中可能用到的中英通用&医疗数据集
6MMLULinkLink伯克利综合评测,57个主题,难度初级->高级专业
7CMMLULinkLink上交等综合评测,67个主题,难度基础->高级专业
8C-EvalLinkLinkLink上交、清华等综合评测,13948多选题,52个学科,4个难度级别,官网
9FineWebLinkHuggingFaceFW45T大小,15T tokens的英文网络数据集,来源于CommonCrawl

金融数据集

序号名称语种GithubHugging Face文章作者备注
FinBench表格Link港大、达摩院10个人工整理的Kaggle金融风险数据集(信用、贷款、流失)
FinNLP中英Link哥大刘小洋等
InsuranceQA中英LinkIBM有关保险的问答数据(中文需购买,英文开源)
FinChina-SALinkLinkFinChina AI Research (华安基金)企业新闻金融情感分析,输出包括企业名称、新闻情感、新闻类型
FinanceIQLinkLink度小满综合金融知识评测(10个大类36个小类,总计7173个单选题)
FinCorpusLink度小满上市公司公告、金融新闻、金融试题
BBT-FinCorpus & CFLEBLinkLink复旦等金融领域语料库(财报、研报、新闻、帖子,需申请,但是申请不了全部的) & 金融评测基准(摘要、问答、分类等6个任务)
CFBenchmarkLink同济3917金融文本,3方面8任务:公司名称等识别任务,事件检测等分类任务,风险提示等生成任务
OpenFinDataLink东方财富、上海AI Lab针对真实业务的综合金融测评,6模块19任务,包括知识、判别、计算、分析、解读、合规
sFIOGLinkLink延世大学等针对部分美国上市公司年报,ChatGPT自动生成的问答数据(构建的不好)
StockNetLinkLinkFinMA用的SMP数据集:2014-2016的88个标普股票Twitter数据和历史价格数据,>0.55%上涨/<-0.5%下跌
CIKM18LinkLinkFinMA用的SMP数据集:2017的47个标普股票Twitter数据和历史价格数据
BigData22LinkLinkFinMA用的SMP数据集:2019-2020的50个美国股票数据,也是二分类
Financial PhraseBank(FPB)LinkLink芬兰常用的SA数据集:4845篇财经新闻,积极/中立/消极
FiQA-SALinkLink德英常用的SA数据集:1173篇标题、微博,评分[-1,1]
SemEval-2017BitbucketLink德英综述中提到的的SA数据集:4157个标题、微博中的句子,评分[-1,1]
StockEmotionsLinkLink综述中提到的的SA数据集:10000个微博中的句子,积极/消极,还有12类细粒度情感类别
HeadlineKaggleLink常用的TC数据集:11412句子,9种2分类问题
FedNLPLinkLink综述中提到的的TC数据集:来自Federal Open Market Committee (FOMC,联邦公开市场委员会)的材料
FOMCLinkLink综述中提到的的TC数据集:来自Federal Open Market Committee (FOMC,联邦公开市场委员会)的材料,鸽派/鹰派/中立
Baking77LinkLink综述中提到的的TC数据集:13083句子,77种银行服务类别
FINLinkLink常用的NER数据集:来自SEC的8个用于信用评估的贷款协议
FiNERLinkLink综述中提到的的NER (NR?) 数据集:110万句子,139个实体(使用可扩展商业报告语言XBRL标注)
FiQA-QALinkLink常用的QA数据集:17100金融问答对
FinQALinkLink常用的QA (NR) 数据集:8281问答对,专家根据标普500企业年报构建
ConvFinQALinkLink常用的QA (NR) 数据集:3892个多轮对话,共14115个问题
ECTSumLinkLinkInvestLM用的摘要数据集:2425文档摘要对,对路透社的盈利电话会议记录的要点摘要
MultiLing 2019WebsiteLink综述中提到的的摘要数据集:3863文档摘要对,来自英国股票交易所的年报
TAT-QALinkLink综述Github中提到的的QA (NR) 数据集
PACIFICLinkLink综述Github中提到的的QA (NR) 数据集
FinREDLinkLink综述中提到的的RE数据集:基于金融新闻和盈利电话记录构建,包含29个金融领域的关系标签
FinBERT

Other

序号名称链接备注
1Chatbot Arena LeaderboardLinkFastChat给出的LLM排名
2FastChatLink训练、部署和评估大模型的开源平台
3GPT AcademicLink学术ChatGPT
4Awesome-LLMLink资源集合
5LLMs九层妖塔Link另一位同仁的学习笔记
6LLM-ActionLink资源集合
7AIGC ProgressLink资源集合
8tiktokenLinkOpenAI的tokenize方式
9sentencepieceLinkGoogle的tokenizer
10KeepChatGPTLink提高ChatGPT的数据安全能力和效率的插件
11LoRALink
12QLoRALink
13Awesome Chinese LLMsLink各行业中文开源金融大模型整理
14PowerInferLink
15面向开发者的LLM入门课程Link吴恩达LLM课程中文版
16OpenCompassLink上海AI实验室LLM排名
17Open LLM LeaderBoardLink开源大模型榜单
18LangChainLink官网
19LLMBoxLink人大赵鑫AI Box团队代码工具库
20LLaMA-Factory郑耀威,北航博士Link

B站

序号UP主名称链接备注
1贯一智能科技国内外十大语言模型之横向对比评测【模型评测08】Link主观但实用的LLM测评

知乎

序号博主名称链接备注
1-ChatGLM2-6B微调Link
2一个有毅力的吃货ChatGLM2-6B微调Link
3回旋托马斯x微调经验总结(无代码)Link
4-大模型LLM领域,有哪些可以作为学术研究方向?Link
5-大模型的微调一般训练多少epoch不会过拟合?Link
6-导师让我搞gpt方向,我该怎么去学?Link
7-为什么现在的LLM都是Decoder only的架构?Link
8无数据不智能大模型训练之微调篇Link
9无数据不智能大模型训练之模型篇Link
10人大AI BoxGPT-4之高考评测Link
11人大AI BoxHuge and Efficient! 一文了解大规模预训练模型高效训练技术Link
12绝密伏击(奇虎)大模型微调总结Link
13字节何枝【LLM】从零开始训练大模型Link
14刘聪NLP大模型LLM-微调经验分享&总结Link
15NLP煎饼摊大模型微调项目 / 数据集调研汇总Link
16包包算法笔记大模型微调样本构造trickLink
17包包算法笔记大模型训练的一些坑点和判断Link
18腾讯大模型微调(finetune)方法总结-LoRA,Adapter,Prefix-tuning,P-tuning,Prompt-tuningLink
19腾讯大模型微调(finetune)方法总结Link
20神洛大模型高效微调综述下: DiffPruning、BitFit、LoRa、AdaLoRA、MAM Adapters、UniPELTLink
21马东什么Tokenizers小结Link
22-想学习大语言模型(LLM),应该从哪个开源模型开始?Link
23-机器学习中的“可解释性”该作何解释?Link
24范浩强完蛋!我被大模型包围了Link
25养生的控制人Greedy Decoding、Beam Search、Top-k、Top-nLink
26-Nlp句子分类,句子长度差异特别大,200-5000,200-上万,有什么办法处理或者什么模型可用吗?Link
27文因互联文因互联首席科学家宋劼:大模型+金融:将场景革命进行到底Link值得关注首席科学家:宋劼(其他信息
28快乐子涵酱LLM微调经验&认知-2Link
29李文举说如何在小公司做大模型Link小公司做LLM经验:1.多交流;2.先搞数据,再做具体业务;3.走大路,不要另辟蹊径

微信

Prompt Engineering

序号博主名称链接备注
1老刘说NLPPromptSource等代表性NLP开源Prompt数据集Link
2老刘说NLP再看大模型ICL推理范式中的prompt策略:从动态Few-shot到KNN选择再到Shuffling EnsembleLink
3AINLPerPrompt工程总结Link
4AINLPerPrompt链式总结Link
5金融科技实战金融领域Prompt工程方法浅析Link是不是可以Prompting Engineering in Finance: A Survey?
6AI洞察笔记一文汇总大语言模型LLM所有prompt提示词框架的论文出处LinkReasoning论文汇总与arXiv两个技巧
7AIwithGary第三篇:要真正入门AI,OpenAI的官方Prompt工程指南肯定还不够,您必须了解的强大方法论和框架!!!Link
8机器之心我是如何赢得GPT-4提示工程大赛冠军的Link最通用的一些Prompt技巧和知识的运用

Other

序号博主名称链接备注
1老刘说NLP再看业界大模型行业问答的困难及若干业界实践:兼看智能客服常用路线及多场景promptLink
2老刘说NLP大模型微调数据质量评价Link
3老刘说NLP垂域微调大模型非最全汇总:12大领域、57个领域微调模型概述及对垂直行业问答的一些讨论Link
4哈工大SCIR实验室赛尔笔记:面向表格数据的大模型推理综述Link
5机器之心字节跳动李航:对语言大模型的若干观察和思考Link李航:LLM思考
6何枝从零详细地梳理一个完整的 LLM 训练流程Link
7人工智能前沿讲习LangChain介绍Link
8运筹OR帷幄机器学习模型可解释性综述Link
9PaerWeekly大语言模型Fine-tuning踩坑经验之谈Link微调经验
10银融时代ChatGPT+金融:国外八大应用案例Link
11Link有趣的新闻:字节调用OpenAI
12Link有趣的新闻:Gemini调用文心一言
13海外独角兽专访月之暗面杨植麟:lossless long context is everythingLink月之暗面Moonshot AI对LLM前景的看法:①注重用户数据scaling的提升、而不是base model;②可解释性:只要哦数据量够大,肯定可以解决;③历史上所有的架构演进本质上都是在提升有效的 context length。word2vec 最近拿了 NeurIPS 的 Test of Time 奖。它在 10 年前用一个词去预测周围的词,相当于 context length 是 5。RNN 把有效的 context length 提升到了 20。LSTM 涨到大几十。transformer 到了几千。现在我们能做到几十万。如果你有 10 亿的 context length,今天看到的问题都不是问题;④未来模型基于自我生成的数据进行训练是关键;⑤模型的微调可能不存在:终究能达成,用户只需要指令的方式就能实现个性化的应用;⑤人才的经验很重要
14AI算法科研如何将大模型与小模型结合?这8种常用策略必看!附17篇案例论文和代码Link
15麦哲智界大模型如何改变金融行业Link
16腾讯研究院AI Agent,为什么是AIGC最后的杀手锏?LinkAI Agent简介
17包包算法笔记大模型微调数据选择和构造技巧Link数据的多样性、不确定性
18新智元AI智能体卷爆大模型!AutoGPT等4大Agent打擂,「西部世界」谁将成为软件2.0?Link对于Agent的全面介绍
19InfoQ金融业采用大模型,是“用大炮轰蚊子”吗Link
20InfoQ开源金融业大模型,终结“专业打工人”?Link对目前Github上开源的金融LLM总结
21NLP工作站1-2B参数规模大模型使用心得及模型汇总Link
22NLP工作站回望做大模型一年后的感悟Link
23NewBeeNLPLLM 盛行,如何优雅地训练大模型?Link
24中国信通院乘上大语言模型的东风:探究国内金融大模型的发展与生态运营策略Link总结了截至2023-12-26的业界金融大模型
25新智元美国空军高调展示首个AI战斗机!部长亲自试驾全程未干预,10万行代码试飞21次Link有趣的新闻
26AIGverseOpenAI使用《金融时报》内容训练模型Link有趣的新闻FT英文官网
27AIGC开放社区摩根大通正式发布IndexGPT,用ChatGPT方式进行投资Link有趣的新闻彭博社新闻
28AIGC开放社区ChatGPT Edu版本来啦:支持GPT-4o、自定义GPT、数据分析等Link有趣的新闻
29AIGC开放社区OpenAI与普华永道合作,为10万员工提供ChatGPTLink有趣的新闻
30AIGC开放社区美国空军发布类ChatGPT产品—NIPRGPTLink有趣的新闻

个人博客/团队账号

序号博主链接备注
1徐明老师Link
2老潘Link
3苏剑林老师Link
4庞宇轩Link
5人大AI BOXLink
6知乎——suc16Link
7Github——lucidrainsLink

电子书

序号来源名称链接备注
1复旦张奇大规模语言模型:从理论到实践Link
2刘聪NLPChatGPT原理与实战:大型语言模型的算法、技术和私有化Link
3中国人工智能学会中国人工智能系列白皮书——大模型技术(2023版)Link
4人大赵鑫大语言模型Link配套代码配套大模型Yulan

Kaggle

序号名称链接备注
1LLM Science ExamLink中文复盘
2LLM Prompt RecoveryLink

其余来源

Prompt Engineering

序号来源名称链接备注
1DAIR.AI(Democratizing Artificial Intelligence Research, Education, and Technologies)promptGuideLink全面介绍提示工程的网站
2Medium12 Prompt Engineering TechniquesLink12种提示方式的介绍(中文版
3OpenAIPrompt Engineering官方文档Link中文简介
4微软Prompt Engineering官方文档Link中文简介

Other

序号来源名称链接备注
1Paper Digest(一个文献集中网站)LinkChatGPT文章集合
2arXivLanguage Models Represent Space and TimeLink大语言模型对于世界的理解(中文解释
3徐明老师NLP大模型微调答疑Link
4MicrosoftState of GPTLink
5CSDN一文看懂学习率Learning Rate,从入门到CLRLink
6Oldpan个人博客关于训练神经网路的诸多技巧Tricks(完全总结版)Link
7腾讯云Prompt、RAG、微调还是重新训练?选择正确的生成式 AI 的方法指南Link从回答准确性、实施复杂性、维护成本、所需要投入的努力、灵活应对变化的能力5个方面对prompt engineering, RAG, fine-tune, pre-training 4种应用LLM的方式进行了对比
8Ilya SutskeverIlya 30u30LinkOpenAI 联合创始人兼首席科学家 Ilya Sutskever 整理的机器学习研究文章清单

论文

发表在顶刊or会计、金融领域期刊上的

序号题目期刊机构网址简介
1FinBERT: A Large Language Model for Extracting Information from Financial TextContemporary Accounting Research(ABS 4)Link英文语料库上预训练的BERT
2GPT has become financially literate: Insights from financial literacy tests of GPT and a preliminary test of how people use it as a source of adviceFinancial Research Letters(ABS 2)Link
3ChatGPT for (Finance) research: The Bananarama ConjectureFinancial Research Letters(ABS 2)Link
4Generative AI for Economic Research: Use Cases and Implications for EconomistsJournal of Economic Literature(ABS 4)LinkLLM如何应用于经济学研究

综述类

序号题目期刊机构网址简介
1Large Language Models: A SurveyarXiv人大LinkLLM综述
2Harnessing the Power of LLMs in Practice: A Survey on ChatGPT and BeyondarXivAmazon & 德州农工大学 & 莱斯大学LinkLLM综述
3A Survey of Chain of Thought Reasoning: Advances, Frontiers and FuturearXiv哈工大Link思维链综述
4A Survey on Hallucination in Large Language Models: Principles, Taxonomy, Challenges, and Open QuestionsarXivLink大模型幻觉综述
5Evaluating Large Language Models: A Comprehensive SurveyarXiv天大Link大模型评价方法综述
6Challenges and Applications of Large Language ModelsarXivLink大模型的应用和挑战
7Explainability for Large Language Models: A SurveyarXiv新泽西理工学院、约翰霍普金斯大学等Link大模型可解释性综述
8Is Prompt All You Need? No. A Comprehensive and Broader View of Instruction LearningarXivLinkInstruction Tuning综述
9Large Language Models on Graphs: A Comprehensive SurveyarXiv伊利诺伊大学厄巴纳香槟分校Link图与LLM综述
10Data Management For Large Language Models: A SurveyarXiv北大LinkLLM数据管理综述
11Igniting Language Intelligence: The Hitchhiker's Guide From Chain-of-Thought Reasoning to Language AgentsarXivLink思维链与AI Agent综述
12Efficient Large Language Models: A SurveyarXivLink提高LLMs的计算效率和资源利用效率综述(中文推荐
13The Rise and Potential of Large Language Model Based Agents: A SurveyarXiv复旦NLPLink大模型Agent综述
14A Survey of Reasoning with Foundation ModelsarXiv港大、华为Nuah等Link大模型推理综述(中文推荐
15A Survey on Statistical Theory of Deep Learning: Approximation, Training Dynamics, and Generative ModelsarXivUCLALink深度学习统计理论综述(中文推荐
16Pythia: A Suite for Analyzing Large Language Models Across Training and ScalingarXivEleuther AI、耶鲁Link大模型训练手册(中文推荐
17TrustLLM: Trustworthiness in Large Language ModelsarXivLink可信任性综述
18A Systematic Survey of Prompt Engineering in Large Language Models: Techniques and ApplicationsarXiv印度理工学院、斯坦福、AmazonLinkPrompt Engineering综述(中文推荐

技术类

序号题目期刊机构网址简介
1Attention Is All You NeedarXivLinkTransformer
2Improving Language Understanding by Generative Pre-TrainingarXivLinkGPT-1
3A Survey of Chain of Thought Reasoning: Advances, Frontiers and FuturearXivLinkBERT
4Language Models are Unsupervised Multitask LearnersarXivLinkGPT-2
5Language Models are Few-Shot LearnersarXivLinkGPT-3
6White-Box Transformers via Sparse Rate Reduction: Compression Is All There Is?arXivLink白盒Transformer
7Distilling the Knowledge in a Neural NetworkarXivLink知识蒸馏的开山之作
8A Simple, Effective, and Efficient Reinforcement Learning Method for Aligning Large Language ModelsarXivLinkReMax
9Beyond Human Data: Scaling Self-Training for Problem-Solving with Language ModelsarXivLink大模型自我构建数据进行训练
10PowerInfer: Fast Large Language Model Serving with a Consumer-grade GPUarXiv上交Link使用RTX 4090跑175B大模型
11StructGPT: A General Framework for Large Language Model to Reason over Structured DataarXivLink面向结构化数据的大模型推理框架

领域大模型构建

序号题目期刊机构网址简介
1FinPT: Financial Risk Prediction with Profile Tuning on Pretrained Foundation ModelsarXiv港大 & 达摩院Link金融风险大模型FinPT
2BloombergGPT: A Large Language Model for FinancearXiv彭博社Link金融大模型BloombergGPT
3XuanYuan 2.0: A Large Chinese Financial Chat Model with Hundreds of Billions ParametersarXiv度小满Link金融大模型“轩辕”
4ChatLaw: Open-Source Legal Large Language Model with Integrated External Knowledge BasesarXiv北大Link法律大模型ChatLaw
5Instruct-FinGPT: Financial Sentiment Analysis by Instruction Tuning of General-Purpose Large Language ModelsarXiv哥大Link金融大模型Instruct-FinGPT
6FinGPT: Open-Source Financial Large Language ModelsarXiv哥大Link金融大模型FinGPT
7FinGPT: Democratizing Internet-scale Data for Financial Large Language ModelsarXiv哥大Link金融大模型FinGPT
8FinVis-GPT: A Multimodal Large Language Model for Financial Chart AnalysisarXiv哈工深Link金融大模型FinVisGPT(多模态)
9CFGPT: Chinese Financial Assistant with Large Language ModelarXiv同济 & 上海AI实验室Link金融大模型CFGPT
10DISC-FinLLM: A Chinese Financial Large Language Model based on Multiple Experts Fine-tuningarXiv复旦大学Link金融资讯大模型DISC-FinLLM
11PIXIU: A Large Language Model, Instruction Data and Evaluation Benchmark for FinancearXiv武汉大学、中山大学等Link金融大模型PIXIU
12Data-Centric Financial Large Language ModelsarXiv阿里巴巴、弗吉尼亚大学Link金融大模型FLLM
13BBT-Fin: Comprehensive Construction of Chinese Financial Domain Pre-trained Language Model, Corpus and BenchmarkarXiv复旦等Link金融大模型Fin-T5

数据集构建

序号题目期刊机构网址简介
1Chinese Fine-Grained Financial Sentiment Analysis with Large Language ModelsarXivLink中文金融情感分析数据集
2An Effective Data Creation Pipeline to Generate High-quality Financial Instruction Data for Large Language ModelarXiv哈工深Link金融指令调优数据集
3ConvFinQA: Exploring the Chain of Numerical Reasoning in Conversational Finance Question AnsweringarXivLinkConvFinQA

思维链与大模型推理

序号题目期刊机构网址简介
1Chain-of-Thought Prompting Elicits Reasoning in Large Language ModelsavXivLinkCoT开山之作
2Large Language Models are Zero-Shot ReasonersavXivLinkZero-shot-CoT
3Self-Consistency Improves Chain of Thought Reasoning in Language ModelsavXivLinkCoT的早期发展:自洽性
4Least-to-Most Prompting Enables Complex Reasoning in Large Language ModelsavXivLinkCoT的又一发展(复杂任务分解)
5Large Language Models Are Reasoning TeachersavXivLink利用大模型的CoT能力帮助小模型进行推理
6Symbolic Chain-of-Thought Distillation: Small Models Can Also "Think" Step-by-StepavXivLink利用大模型的CoT能力帮助小模型进行推理2号
7Large Language Models Can Self-ImproveavXivLink自我改进
8Self-Refine: Iterative Refinement with Self-FeedbackavXivLink自我反思
9Reflexion: Language Agents with Verbal Reinforcement LearningavXivLink自我反思2
10Distilling Step-by-Step! Outperforming Larger Language Models with Less Training Data and Smaller Model SizesavXivLink服了,怎么跟我这个RAL这么类似
11Self-explaining AI as an alternative to interpretable AIavXivLink自我解释
12Beyond Classification: Financial Reasoning in State-of-the-Art Language ModelsavXivLink金融推理问题数据集构建
13Cumulative Reasoning with Large Language ModelsavXivLink姚期智首篇LLM
14Learning From Mistakes Makes LLM Better ReasoneravXivLink让大模型在错题中学习
15Specializing Smaller Language Models towards Multi-Step ReasoningavXivLink
16Self-Discover: Large Language Models Self-Compose Reasoning StructuresavXiv南加州大学、谷歌DeepMindLink让大模型针对不同问题,提出特定的推理结构(中文解读
17The Impact of Reasoning Step Length on Large Language ModelsarXivLink推理步骤对大模型能力的影响(中文解读

大模型与表格数据

序号题目期刊机构网址简介
1Table-GPT: Table-tuned GPT for Diverse Table TasksarXiv微软Link
2Trompt: Towards a Better Deep Neural Network for Tabular DataarXiv国立成功大学Link

大模型与图

序号题目期刊机构网址简介
1Think-on-Graph: Deep and Responsible Reasoning of Large Language Model on Knowledge GrapharXivLink大模型与知识图谱

AI Agents

序号题目期刊机构网址简介
1Large Language Models as Simulated Economic Agents: What Can We Learn from Homo Silicus?avXivLinkABM,模拟人类行为
2War and Peace (WarAgent): Large Language Model-based Multi-Agent Simulation of World WarsavXivLink基于LLM的企业风险传染?基于大语言模型的多智能体仿真世界大战
3Large Language Models Empowered Agent-based Modeling and Simulation: A Survey and PerspectivesavXiv清华Link对ABM和LLM的综述
4Generative Agents: Interactive Simulacra of Human BehavioravXivLink让大模型玩模拟人生

技术报告

序号题目期刊机构网址简介
1Gemini: A Family of Highly Capable Multimodal Models谷歌LinkGemini
2Phi-2: The surprising power of small language models微软LinkPhi2

Prompting Engineering

序号题目期刊机构网址简介
1Can Generalist Foundation Models Outcompete Special-Purpose Tuning? Case Study in MedicineavXiv微软Link医学领域使用GPT-4的prompt工程
2Principled Instructions Are All You Need for Questioning LLaMA-1/2, GPT-3.5/4avXivLink

大模型与主题模型

序号题目期刊机构网址简介
1TopicGPT: A Prompt-based Topic Modeling FrameworkavXivLink中文概述
2Prompting Large Language Models for Topic ModelingavXivLink中文概述

Other

序号题目期刊机构网址简介
1GPT-Fathom: Benchmarking Large Language Models to Decipher the Evolutionary Path towards GPT-4 and BeyondavXivLinkOpenAI进化之路与大模型能力来源探析(中文解读
2Can large language models provide useful feedback on research papers? A large-scale empirical analysisavXiv斯坦福Link大模型与审稿(中文解读
3When ChatGPT is gone: Creativity reverts and homogeneity persistsavXiv北京大学Link大模型对长期创新能力的抑制(中文解读
4Resolving the Imbalance Issue in Hierarchical Disciplinary Topic Inference via LLM-based Data AugmentationavXivLink样本不均衡问题(中文解读
5Segmented Harmonic Loss: Handling Class-Imbalanced Multi-Label Clinical Data for Medical Coding with Large Language ModelsavXivLink样本不均衡问题(中文解读
6When Advanced AI Isn't Enough: Human Factors as Drivers of Success in Generative AI-Human CollaborationsSSRNLinkChatGPT时代的人机交互对绩效的影响研究(中文简介

Something Interesting Beside LLM

序号来源名称链接备注
1复旦自然语言处理实验室入组第一堂代码课Link
2知乎nlp研究生不会自己写代码怎么办Link
3知乎小王同学在积累的Github学习资料Link
4CSDNSHAP:解释模型预测的通用方法Link
5索尼SunoAILink为你的朋友制作歌曲
6小红书InstantIDLink不需要进行任何额外训练,就能得到一个既符合文本描述又保留个人身份特征的定制图像
7字节跳动MagicVideoLink文字生成动图
8Github骆昊Python 100天从新手到大师Link
9Github国科大论文模板Link
10GithubProject-based LearningLink
11Github李沐跟李沐学AILink

Contributors

Drur1Lane

389 commits