跳转至

大模型建模外设项目任务

本项目分为 STM32F103 建模和 Agent 构建与 Benchmark 两个阶段,目标是形成从硬件资料、驱动代码到外设模型和验证结果的可复现闭环。开始前请先阅读讲义中的大模型建模外设

第一阶段:STM32F103 建模

  • 以 STM32F103 为目标芯片,梳理 QEMU 中 MCU、SoC、board 与外设模型的组织方式。
  • 选择一组典型外设作为建模入口,完成寄存器映射、reset 默认值、MMIO 访问、中断触发和最小行为模型。
  • 通过固件样例、驱动访问回放或单元测试验证模型可运行、可观测、可复现。
  • 可合入 QEMU 的 STM32F103 机器、SoC、外设模型和测试用例,应按 QEMU 社区规范整理为 patch series,直接贡献至 QEMU 上游。

第二阶段:Agent 构建与 Benchmark

  • 构建面向 QEMU 外设建模的大模型 Agent,使其能够读取参考手册、数据手册和驱动代码,辅助生成寄存器结构、行为逻辑、测试用例和验证报告。
  • Benchmark 用于评价 Agent 在外设建模任务中的有效性,而不是单纯评价第一阶段手写模型。
  • Benchmark 由项目统一提供或指定,学员不需要自行设计;需要使用该 Benchmark 评估不同提示词、工具链、模型版本或 Agent 策略的建模效果。

第二阶段建议围绕一个清晰、可复现的闭环独立完成:输入硬件资料与驱动代码,Agent 生成或辅助生成外设模型,随后使用统一 Benchmark 对生成结果进行验证和评分。

考核标准

  1. 第一阶段成果:STM32F103 相关建模代码能够运行,并提供对应的测试或固件验证记录。
  2. 第二阶段成果:Agent 能够完成至少一个可复现的外设建模任务,并通过 Benchmark 给出量化或半量化评估。
  3. 工程质量:代码结构清晰,脚本可复现,输入资料、生成结果、人工修改和测试日志有明确记录。

交付物

  1. Agent 工作流:说明 Agent 如何拆解建模任务、读取资料、调用工具、生成代码和记录中间结果。
  2. Benchmark 结果:记录运行方式、评分结果、失败样例和可复现实验日志。
  3. 建模产物:提供 Agent 生成或辅助生成的外设模型、寄存器定义、测试用例和验证日志。
  4. 代码链接:提交可复现的代码仓库、运行脚本和必要的数据说明。