DataSci Ocean
所有文章
標籤
分類
繁體中文
繁體中文
English
淺色
深色
系统預設
DataSci Ocean
取消
所有文章
標籤
分類
淺色
深色
系统預設
繁體中文
繁體中文
English
Large Language Model
2025
[論文介紹] OctoTools: An Agentic Framework with Extensible Tools for Complex Reasoning
06-02
[論文介紹] Steering Large Language Models Between Code Execution and Textual Reasoning
05-25
[論文介紹] Pre-Act: Multi-Step Planning and Reasoning Improves Acting in LLM Agents
05-20
[論文介紹] MemGPT: Towards LLMs as Operating Systems
05-18
[論文介紹] Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory
05-13
[論文介紹] PLAN-AND-ACT: Improving Planning of Agents for Long-Horizon Tasks
05-11
LangMem 基本概念介紹
05-06
[論文介紹] HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs
01-31
[論文介紹] HuggingGPT: Solving AI Tasks with ChatGPT and its Friends in Hugging Face
01-27
[論文介紹] EHRAgent: Code Empowers Large Language Models for Few-shot Complex Tabular Reasoning on Electronic Health Records
01-26
2024
[論文介紹] REPLUG: Retrieval-Augmented Black-Box Language Models
10-31
[論文介紹] RAFT: Adapting Language Model to Domain Specific RAG
10-31
[論文介紹] Better & Faster Large Language Models via Multi-token Prediction
07-18
[論文介紹] Tuning LayerNorm in Attention: Towards Efficient Multi-Modal LLM Finetuning
07-08
[論文介紹] GAIA: A Benchmark for General AI Assistants
06-27
[論文介紹] ChatEval: Towards Better LLM-Based Evaluators Through Multi-Agent Debate
06-23
[論文介紹] Branch-Train-MiX: Mixing Expert LLMs into a Mixture-of-Experts LLM
04-24
[論文介紹] Sparse Upcycling: Training Mixture-of-Experts from Dense Checkpoints
04-10
解密 LLM 訓練三部曲:深入解析 SFT 與關鍵的 RLHF 技術
02-27
[論文介紹] DPO:Direct Preference Optimization
02-27
1
2
3
4