前沿代码基准与大模型训练任务设计
Python
Docker
Pytest
Git
微趋势
↗ AI Agent
排名 #197
▲ +100% 环比
2 次提及 · 本周
$20 预算中位
正在基于该需求推演落地方案…
需求痛点(公开)
AI 模型研发团队在评测和微调代码生成智能体时,缺乏具备确定性验证逻辑、无数据污染且贴近工业界复杂度的前沿编程测试用例,难以有效衡量或提升模型在真实项目中的多步推理与代码修复能力。
切入方向(公开)
组织资深工程师针对真实代码仓库构建端到端的复杂工程任务,提供包含 Git 上下文、标准修复补丁以及基于 Docker 和 pytest 的自动化单元测试套件,用于大模型的高质量微调与防污染基准评测。
统计(公开)
统计窗口:周度(2026-08-21) · 数据更新时间:2026-08-21
本期提及
2
环比涨幅
+100%
预算中位
$20
领先地域
🌐 全球
原始需求溯源 · 2 条
"Software Engineering Task Author (Contract) About the Role We're looking for an experienced softwar"
"Software Engineering Task Author (Contract) About the Role We're looking for an experienced softwar"
仅展示任务摘要与外链,不转载原文全文;个人信息已脱敏。数据来源已登记,可溯源。
💬 社区讨论