Phân tích chi tiết benchmark DeepPlanning (Qwen/Alibaba)
Python
0
4 commits
updated Feb 23, 2026
Repo này tổng hợp tài liệu phân tích chi tiết benchmark DeepPlanning của Qwen Team (Alibaba):
docs/01-paper-review.md: Review paper và contribution.docs/02-benchmark-metrics-map.md: Benchmark design, metric, công thức và mapping file.docs/03-codebase-architecture.md: Kiến trúc mã nguồn DeepPlanning.docs/04-inference-eval-pipeline.md: Luồng inference -> conversion -> evaluation -> aggregation.docs/05-experiment-guide.md: Playbook chạy thí nghiệm và tái lập kết quả.Phân tích trong repo này dựa trên:
QwenLM/Qwen-Agent (nhánh main, commit 0460a18 ngày 2026-02-14 local sync)./Users/admin/TuanDung/repos/Qwen-Agent.Đã thêm bộ khung chuẩn hóa và publish lên Hugging Face Hub:
/Users/admin/TuanDung/repos/deepplanning-analysis/etl/build_deepplanning_parquet.py/Users/admin/TuanDung/repos/deepplanning-analysis/etl/validate_deepplanning_parquet.py/Users/admin/TuanDung/repos/deepplanning-analysis/hf/README.dataset_card.md/Users/admin/TuanDung/repos/deepplanning-analysis/scripts/prepare_hf_publish_dir.sh/Users/admin/TuanDung/repos/deepplanning-analysis/scripts/publish_to_hf.py/Users/admin/TuanDung/repos/deepplanning-analysis/docs/07-hf-publish-runbook.md4 commits
Python
97.3%
Shell
2.7%
Phân tích chi tiết benchmark DeepPlanning (Qwen/Alibaba)
Python
0
4 commits
updated Feb 23, 2026
Repo này tổng hợp tài liệu phân tích chi tiết benchmark DeepPlanning của Qwen Team (Alibaba):
docs/01-paper-review.md: Review paper và contribution.docs/02-benchmark-metrics-map.md: Benchmark design, metric, công thức và mapping file.docs/03-codebase-architecture.md: Kiến trúc mã nguồn DeepPlanning.docs/04-inference-eval-pipeline.md: Luồng inference -> conversion -> evaluation -> aggregation.docs/05-experiment-guide.md: Playbook chạy thí nghiệm và tái lập kết quả.Phân tích trong repo này dựa trên:
QwenLM/Qwen-Agent (nhánh main, commit 0460a18 ngày 2026-02-14 local sync)./Users/admin/TuanDung/repos/Qwen-Agent.Đã thêm bộ khung chuẩn hóa và publish lên Hugging Face Hub:
/Users/admin/TuanDung/repos/deepplanning-analysis/etl/build_deepplanning_parquet.py/Users/admin/TuanDung/repos/deepplanning-analysis/etl/validate_deepplanning_parquet.py/Users/admin/TuanDung/repos/deepplanning-analysis/hf/README.dataset_card.md/Users/admin/TuanDung/repos/deepplanning-analysis/scripts/prepare_hf_publish_dir.sh/Users/admin/TuanDung/repos/deepplanning-analysis/scripts/publish_to_hf.py/Users/admin/TuanDung/repos/deepplanning-analysis/docs/07-hf-publish-runbook.md4 commits
Python
97.3%
Shell
2.7%