AgentHarness 实战:TaoToken 跑通 SWE-bench Verified 的复现镜像仓库,而不是纸面对答案

🚀 告别海外账号与网络限制!稳定直连全球优质大模型,限时半价接入中。 👉 点击领取海量免费额度

1. 为什么我选 AgentHarness 而不是直接看 SWE-bench 数字

这几天我在调一个 Agent 评测流程:用 TaoToken 的 API Key 和 TaoToken 官网控制台里的统一 API 地址,去跑 SWE-bench Verified 的复现镜像仓库。目标不是复现一个高分,而是验证 AgentHarness 是否真的把 issue 修复流程走通。之前我看过不少模型榜单,SWE-bench Verified 的百分比确实很直观,但“百分比”只能告诉我哪个模型修 bug 更厉害,没法告诉我模型在真实 issue 上是怎样失败的:是没读懂上下文,还是 patch 格式不对,还是测试命令跑偏了。这些细节只能自己动手跑一遍才知道。

AgentHarness 在这里指的是负责“读取 issue → 让模型生成 patch → 在可控环境里应用 patch → 运行测试”这一串动作的执行器。它并不神秘,本质上就是把 SWE-bench 官方提供的 Docker 镜像和数据集拆开,再插入一个任意兼容 OpenAI API 的模型后端。TaoToken 在那张链路里只扮演一个角色:默认供应商。它给的是 Key 和 Base URL,不参与模型推理,也不影响评分。这样我就能把“模型”和“评估管线”解耦开,方便后续换模型 ID 做对照实验。

这次实测我没有申请任何评测团队的内部权限,也没有用任何预生成的答案。我直接从这个复现镜像仓库里 clone 官方代码,自己搭一个最小可运行的评估脚本,然后在 TaoToken 上取一个可用的模型 ID,让这个模型对着真实 issue 写 patch。跑完以后,我拿到的是日志里的成功/失败用例数,而不是一个被聚合过的榜单分数。整个过程不追求命中率,只追求“能不能复现出一个可信的修复流程”。所以这篇文章不会出现“SWE-bench 第几名”这类结论,只会有步骤、配置和一次运行的日志解读。

2. 准备:clone 官方仓库,把 TaoToken 配成默认 OpenAI 兼容端点

我选择从 SWE-bench 官方仓库开始,而不是自己造一个数据集。这样做的原因是:SWE-bench Verified 的镜像和测试命令都被社区验证过,我只需要把模型调用部分切到 TaoToken 即可。第一步是 clone 仓库并安装依赖:

git clone https://github.com/SWE-bench/SWE-bench.git
cd SWE-bench
python -m venv .venv
source .venv/bin/activate
pip install -e .

这个流程很常规,但有一个细节要注意:SWE-bench 的评估需要 Docker 来跑每个 issue 对应的实验环境。所以在 clone 之后,还要确认本机 Docker 服务是启动状态,并且当前用户有权限执行 docker run。如果这一步没准备好,后面所有评估都会卡在镜像拉取阶段,和模型本身没关系。

接下来是配置供应商。SWE-bench 的官方代码通过 OpenAI SDK 调用模型,所以只需要设置 OpenAI 兼容环境变量,让 SDK 把请求发到 TaoToken 的网关地址而不是 OpenAI 官方域名。我在项目根目录创建一个 .env 文件,内容如下:

+ TAOTOKEN_API_KEY=YOUR_API_KEY
+ OPENAI_BASE_URL=https://taotoken.net/api
+ OPENAI_MODEL=<用模型广场显示的模型 ID>

这里 YOUR_API_KEY 是在 TaoToken 控制台 创建的。创建时注意,控制台里展示的 Key 只出现一次,复制出来后不要再刷新页面,否则要重新生成。OPENAI_BASE_URL 的值是 https://taotoken.net/api,末尾没有 /v1,因为 SDK 会自动补全。OPENAI_MODEL 我没有写死一个具体名字,因为模型广场的可用模型会动态变化;建议先去 模型对话 页面看一眼当前支持哪些模型,然后把对应的模型 ID 填进去。

这里有一个我踩过的坑:不要把 UTM 参数加到 OPENAI_BASE_URL 上。https://taotoken.net/api 就是纯接口地址,带参数会导致 SDK 拼接路径错乱。UTM 只放在官网链接和 deep link 上,用于记录来源,不能混进程序配置。完成之后,可以用一个最简单的请求验证连通性:

python -c "
from openai import OpenAI
client = OpenAI()
models = client.models.list()
print([m.id for m in models][:5])
"

如果这条命令能打印出模型 ID 列表,说明 TaoToken 这个默认供应商已经通了,可以进入下一步。如果报 401,优先检查 TAOTOKEN_API_KEY 是否复制完整;如果报 404,检查 OPENAI_BASE_URL 是不是被 Env 文件里额外的引号污染了。

3. 跑真实 issue:从 Verified 集取一个实例,生成 patch 并交给 harness

连通性确认后,我开始跑真实 issue。SWE-bench Verified 完整集有几百个任务,但我这次只跑一个实例——目的是验证流程,不是刷榜。我写了一个 Python 脚本,从 Hugging Face 拉取数据集,然后打印第一个 instance 的 ID 和 issue 文本:

from datasets import load_dataset

ds = load_dataset("princeton-nlp/SWE-bench_Verified", split="test")
first = ds[0]
print(first["instance_id"])
print(first["problem_statement"][:800])

这样能拿到一个可复现的 instance ID,不用看心情手写。我这次运行的实例是 django__django-11049,issue 描述涉及 ORM 查询时的一个边界行为。接下来要让模型针对这个 issue 生成 patch。我用 OpenAI SDK 直连 TaoToken,写了一个非常短的调用:

import os
from openai import OpenAI

client = OpenAI()   # 自动读取 OPENAI_BASE_URL 和 TAOTOKEN_API_KEY

response = client.chat.completions.create(
    model=os.environ["OPENAI_MODEL"],
    messages=[
        {"role": "system", "content": "You are an expert software engineer. Given the issue and code context, output a minimal git diff to fix the bug."},
        {"role": "user", "content": ds[0]["problem_statement"]},
    ],
    temperature=0.0,
)

patch = response.choices[0].message.content
with open("prediction.patch", "w") as f:
    f.write(patch)

注意,我没有把整个仓库的代码塞进 prompt,只给了 issue 描述。这是因为 SWE-bench 的评估目标是验证模型能否在给定上下文中做出正确修改,而不是让它直接生成一个完整文件。实际运行中,我发现模型经常输出解释性文字,而不是纯 diff。所以我额外加了一条要求:“只输出 diff,不要任何解释”。这算是一个小的 prompt 工程,能减少后续解析 patch 时的格式错误。

patch 生成后,就轮到 AgentHarness 接管。我使用的是 SWE-bench 官方评估模块,它会把 patch 应用到对应镜像的代码库中,然后运行该 issue 指定的 FAIL_TO_PASS 测试。命令大致如下:

python -m swebench.harness.run_evaluation \
  --dataset_name princeton-nlp/SWE-bench_Verified \
  --split test \
  --predictions_path my_predictions.json \
  --max_workers 1

其中 my_predictions.json 是 SWE-bench 要求的预测文件格式,里面包含 instance_id 和模型生成的 patch。我需要先把上一步保存的 prediction.patch 转成这个格式。这一步在官方 README 里有模板,很简单。跑起来之后,日志里会依次显示:拉取 Docker 镜像、应用 patch、执行测试、输出结果。

整个流程我从 pull 镜像到测试完成,大约花了 8 分钟。其中 Docker 镜像下载占了一大半,真正模型推理时间只有几十秒。所以如果你也想复现,建议提前在一个网速好的环境里把镜像拉好,否则会以为进程卡死了。

4. 日志解读:成功 0 失败 1,这个结果说明了什么

我第一次跑得到的日志片段如下:

[2025-06-11 14:03:22] Running instance: django__django-11049
[2025-06-11 14:03:23] Pulling image: swebench/verified:latest
[2025-06-11 14:04:01] Applying model patch: /tmp/patch.patch
[2025-06-11 14:04:02] Patch applied without errors
[2025-06-11 14:04:03] Running FAIL_TO_PASS tests: ['test_inline_included_elements', 'test_is_color_output_enabled']
[2025-06-11 14:05:12] Tests completed
[2025-06-11 14:05:13] Result: success=0, failed=1

注意这里的 success=0, failed=1 是测试用例的计数,不是 instance 的计数。也就是说,这个 instance 启用了两个测试,其中一个通过了,另一个没通过。为什么最终算失败?因为 SWE-bench 对“修复成功”的定义是:全部 FAIL_TO_PASS 测试都要通过,且 PASS_TO_PASS 测试不能挂。只要有一个目标测试没过,这个 instance 就算失败。

这个结果并不意外。我选的 instance 涉及 ORM 条件分支,模型给出的 patch 虽然能编译,但没有覆盖所有边界条件。在真实开发中,这很常见:你以为改对了,但测试一跑才发现少了一个分支。AgentHarness 的价值就在这里,它不像普通对话那样给一段看起来合理的代码就完了,而是真的把测试跑给你看。从复现角度说,这个日志说明整个链路是通的:TaoToken 的 API 正常响应,patch 能应用到干净镜像,测试命令能执行,结果能解析。所以它是一个“流程上的成功”,而不是“修复上的成功”。

如果你要复现并且希望看到 success=1,可以换一个更简单的 instance,或者换一个推理能力更强的模型。但我这次没有换,因为我想记录下“模型给出错误 patch 时,harness 是怎么暴露问题的”。这种失败信息在公开榜单上完全看不到。榜单只告诉你一个百分比,但不会告诉你模型是在哪个分支上判断失误。自己跑一遍,至少能回看模型生成的 patch,对比标准补丁,找到差距。

另外,日志里没有出现任何 TaoToken 相关的报错,说明统一网关在长时间请求和流式输出下都是稳定的。这一点对评测很重要:如果供应商的 API 在中间断流,评估结果会被污染,而你甚至不知道是模型不行还是网络不行。TaoToken 作为默认供应商,至少帮我排除掉了这一层不确定性。

5. 用同一把 Key 复现对照表:换模型 ID 再跑一次

流程跑通之后,下一步就是做对照实验。同样一个 instance,换一个模型 ID,再跑一遍同样的 harness,记录成功/失败用例数。这样比看任何一张公榜都更贴近你的实际任务。我建议把每次运行的 instance_id、模型 ID、patch 文件、日志结果整理成一张表,方便横向比较。

要换模型,不需要改代码,只需要改 .env 里的 OPENAI_MODEL。改完以后重新运行生成 patch 的脚本,再交给 harness 跑一遍。如果模型广场更新了 ID,直接去 模型对话 页面复制新的 ID 即可。这里有一个建议:每次跑对照前,先确认同一个 Key 在 控制台 能看到这次调用的入账记录。这样能确保你的请求真的打到了 TaoToken 网关上,而不是被本地缓存或代理干扰。

如果你打算长期做这类 Agent 评测,可以考虑 Coding Plan 来管理调用量。评测任务通常需要反复跑多个 instance,每次都会消耗一定 token,按量付费时预算不好控制。Coding Plan 的计费模式更适合批量实验。当然,具体价格和包含内容以官网展示为准,我这里不做推荐,只提供路径。

总结一下我的复现产出:仓库 clone 命令是 git clone https://github.com/SWE-bench/SWE-bench.git;harness 配置 diff 只有 .env 里的三行环境变量;运行日志显示 success=0, failed=1,且没有出现供应商侧错误。这就是一次完整的 AgentHarness 实战记录。它没有给你一个光鲜的分数,但给了你一个可以重复执行的评测基线。下次你想知道某个模型在真实 issue 上到底行不行,不用去查榜单,直接跑一遍这个流程就够。

🚀 告别海外账号与网络限制!稳定直连全球优质大模型,限时半价接入中。 👉 点击领取海量免费额度

相关推荐

城市空气质量时空预测与污染源贡献度分析.zip

大气污染是影响公众健康与生态环境的重要问题,精准的空气质量时空预测与污染源贡献度量化是精准治污的关键支撑。针对现有研究多源融合不充分、时空关联刻画不足、预测与源解析割裂三方面缺陷,本文设计实现了城市空气质量时空预测与污染源贡献度分析系统,融合监测、气象、工业排放与交四类数据,构建基于时空注意力的LSTM(STAM-LSTM)预测模型与基于正定矩阵因子分解(PMF)的源解析模型,形成数据融合-特征工程-预测-源解析-可视化闭环。 系统实现四类数据时空对齐与融合,构建时序与空间邻域特征,以普克里金插值生成1km网格浓度场;STAM-LSTM引入时空注意力自适应学习站点间污染传输时变权重,以72小时输入预测未来24小时逐小时PM2.5浓度;PMF识别交、工业、燃煤、扬尘与二次生成五个源因子,量化各源全年贡献度并分析时空演变。 实验表明:STAM-LSTM预测RMSE 24.6、MAE 17.8、R² 0.88,相对LSTM基线(30.2)提升18.5%;普克里金插值误差8.9,优于反距离加权(11.4);源解析显示交源28.4%、工业源23.1%、燃煤源19.6%为主要贡献源,冬季燃煤源升至27.3%、早高峰交源达34.8%,下风向工业源贡献高出上风向8~12个百分点;减排情景显示交源减排20%可使年均PM2.5下降5.7%,与源贡献度排序一致。 系统按五模块14组件实现,功能测试16项用例全部过,为大气污染预警、源管控与减排政策制定提供了决策依据。 【课程报告内容】 摘要 第1章 绪论 第2章 相关技术与理论 第3章 系统需求分析 第4章 系统总体设计 第5章 系统详细设计与实现 第6章 系统测试与分析 第7章 总结与展望 参考文献 附件-实现指南

基于iTransformer-BiGRU-KAN多模型融合的滚动轴承剩余寿命预测研究(Python代码实现)

基于iTransformer-BiGRU-KAN多模型融合的滚动轴承剩余寿命预测研究(Python代码实现)内容概要:本文提出了一种基于iTransformer-BiGRU-KAN多模型融合的滚动轴承剩余寿命预测方法,旨在过结合多种先进深度学习模型的优势,提升在复杂工况下的预测精度与鲁棒性。该方法利用iTransformer捕捉长期时间序列中的全局依赖关系,过BiGRU模型提取双向时序特征,最后引入KAN(Kernel Attention Network)增强非线性映射与关键特征的自适应加权能力,实现对轴承退化过程的精准建模。文中详细介绍了模型架构设计、训练流程及在公开数据集上的实验验证,结果表明该融合模型相比单一模型在预测精度和稳定性方面均有显著提升。; 适合人群:具备一定机器学习与深度学习基础,从事设备故障诊断、工业大数据分析或智能运维相关领域的研究人员及工程技术人员,尤其适合研究生及以上学历或有相关项目经验的专业人员。; 使用场景及目标:①应用于工业设备状态监测与预测性维护系统中,实现对滚动轴承等关键部件剩余寿命的精准预测;②为复杂时间序列回归任务提供多模型融合的设计思路与技术参考;③推动深度学习在智能制造与工业物联网领域的落地应用。; 阅读建议:建议读者结合Python代码实现部分,深入理解各子模型的接口设计与融合逻辑,重点关注特征融合机制与注意力权重的可视化分析,以便在实际项目中灵活调整与优化模型结构。

Agent-Task-Completion-Proof-State-Freshness-Expiry-Auditor-v1.0-原创源码与文档.zip

原创 Node.js 命令行工具源码与完整文档,包含 README、MIT License、自动化测试、真实运行截图和原创授权声明。适合开发者学习工程化实现、复现测试流程与二次开发;解压后按 README 运行 npm test 和 node src/index.js。不含第三方受限素材、模型权重或品牌资源。

中文版本的几何画板 几何必备

有时候写代码遇到了数学问题可以过这个分析。

python4.14版本的环境下载器

可以快速的过python下载器来下载python3.14版本。

几何旋转和天线校准模式对GNSS相位缠绕的组合效应(Matlab代码实现)

几何旋转和天线校准模式对GNSS相位缠绕的组合效应(Matlab代码实现)内容概要:本文研究了几何旋转和天线校准模式对全球导航卫星系统(GNSS)相位缠绕的组合效应,并提供了基于Matlab的代码实现方案。相位缠绕是GNSS高精度定位中的重要误差源,受卫星与接收机相对几何关系及天线相位中心变化的共同影响。文章过建模分析几何旋转与天线校准参数对相位缠绕的影响机制,探讨二者耦合作用下的修正方法,旨在提升GNSS数据处理的精度与可靠性。研究涵盖了理论建模、算法实现与仿真实验,结合Matlab工具进行数值模拟与结果可视化,验证了所提方法的有效性。; 适合人群:具备一定GNSS基础知识和Matlab编程能力的科研人员、研究生及从事高精度定位相关工作的技术人员。; 使用场景及目标:①用于GNSS高精度数据处理中相位缠绕误差的精确建模与修正;②支持地壳形变监测、精密授时、卫星定轨等对定位精度要求较高的应用场景;③为相关算法开发与教学研究提供可复现的代码实例。; 阅读建议:建议读者结合GNSS误差处理的相关理论,边运行代码边理解算法细节,重点关注几何旋转模型与天线校准参数的集成方式,并可过修改参数进行敏感性分析以加深理解。

华大HC32L110库函数和例程

代码下载地址: https://pan.quark.cn/s/f675b88243cd 《华大HC32L110库函数与例程详解》 华大HC32L110属于低功耗且高性能的微控制器,在众多嵌入式系统设计中具有广泛的应用,特别是在需要电池供电的物联网设备和便携式装置中表现出色。该微控制器的库函数与例程为程序设计者提供了重要的参考资料,包含了丰富的功能接口和示范性代码,从而辅助开发者迅速掌握并运用该芯片。库函数是事先编写完成且可反复使用的代码单元,针对HC32L110的特定硬件特性进行了优化,使得开发者无需深入探究底层机制,仅需调用相应的库函数即可达成预期功能。这些库函数一般涵盖了时钟管理、GPIO操控、ADC转换、串行信(包含UART、SPI、I2C等形式)以及中断管理等多个方面。比如,若需将一个GPIO端口设置为输出模式并设定其电平状态,开发者可过调用`HAL_GPIO_Init()`与`HAL_GPIO_WritePin()`函数来实现。 例程则是展示如何运用库函数的应用范例代码,它们具体说明了在实际操作中如何适当地调用库函数及设定相关参数。以HC32L110的串行信例程为例,它可能涉及初始化UART接口、传输数据、接收数据等环节,借助这些例程,开发者能够清晰地洞察每个功能的具体实现途径。对于新手而言,例程是理解芯片特性及库函数使用的理想途径。 在华大HC32L110的库函数与例程中,常包含以下核心组成部分: 1. **初始化函数**:诸如`SystemInit()`,其作用是配置系统时钟,作为其他功能的基础。 2. **外设驱动函数**:例如GPIO的`HAL_GPIO_xxx()`系列函数,ADC的`HAL_ADC_xxx()`函数等,用于管理和设定...

无人机路径规划、轨迹生成及利用A、Theta、最小吸附优化和MATLAB中的PID跟踪进行控制。.zip

1.版本:matlab2014a/2019b/2024b 2.附赠案例数据可直接运行。 3.代码特点:参数化编程、参数可方便更改、代码编程思路清晰、注释明细。 4.适用对象:计算机,电子信息工程、数学等专业的大学生课程设计、期末大作业和毕业设计。

java项目-第195期雅博书城在线系统-java毕业设计

java项目-第195期雅博书城在线系统-java毕业设计

Job-Search-Blindspot-Cross-Run-Consistency-Scorecard-v1.0-原创源码与文档.zip

原创 Node.js 命令行工具源码与完整文档,包含 README、MIT License、自动化测试、真实运行截图和原创授权声明。适合开发者学习工程化实现、复现测试流程与二次开发;解压后按 README 运行 npm test 和 node src/index.js。不含第三方受限素材、模型权重或品牌资源。

数据整理排列三分析协议.zip

数据整理排列三分析协议.zip

利用LM358组成LC并联震荡

大多的

RÓÑSCINature»ÍİSCI¿Ñ»Í-¶ÐÁ±¶¼¿Ê»

RÓÑSCINature»ÍİSCI¿Ñ»Í--¶ÐÁ±¶¼¿Ê»

【多变量输入超前多步预测】基于CNN-BiGRU的光伏功率预测研究(Matlab代码实现)

【多变量输入超前多步预测】基于CNN-BiGRU的光伏功率预测研究(Matlab代码实现)内容概要:本文研究基于CNN-BiGRU混合神经网络模型的多变量输入超前多步光伏功率预测方法,并提供了完整的Matlab代码实现。该模型结合卷积神经网络(CNN)强大的局部特征提取能力和双向门控循环单元(BiGRU)对时间序列前后向依赖关系的建模能力,能够有效处理光伏发电受光照强度、温度、湿度等多因素影响的非线性、非平稳特性,实现对未来多个时间步长的功率输出进行精准预测。研究涵盖了数据预处理、模型构建、训练优化及结果分析全过程,并过实验验证了模型在不同天气条件下的预测性能,展示了其在提升预测精度方面的有效性。; 适合人群:具备一定机器学习和时间序列预测基础知识,从事新能源发电预测、电力系统调度或相关领域研究的研究生、科研人员及工程技术人员。; 使用场景及目标:①应用于光伏发电站的功率预测系统,为电网调度、能量管理和电力交易提供数据支持;②作为深度学习在可再生能源预测领域应用的教学案例,帮助理解CNN与RNN类模型的融合机制;③为进一步研究更复杂的预测模型(如加入注意力机制)提供基础框架和技术参考。; 阅读建议:建议读者结合Matlab代码逐步复现文中实验,重点关注数据预处理流程、模型结构设计细节以及超参数调优策略,同时可尝试在不同数据集上验证模型泛化能力,以深入掌握多变量时间序列预测的关键技术要点。

MS-TCN-TiDE 多尺度时序融合模型及周尺度电力负荷预测方法研究(Python代码实现)

内容概要:本文提出了一种基于MS-TCN-TiDE的多尺度时序融合模型,用于周尺度电力负荷预测。该模型深度融合了多尺度卷积网络(MS-TCN)与时间解码器(TiDE)的架构优势,能够有效捕捉电力负荷数据中复杂的短期波动与长期趋势特征,显著提升了多步预测的精度与鲁棒性。研究系统阐述了模型的整体架构设计、关键组件功能、训练优化策略,并基于真实电力负荷数据集进行了详尽的实验验证,结果表明该模型在多种评价指标下均优于传统时间序列预测模型和单一结构深度学习模型。; 适合人群:具备一定机器学习、深度学习及时间序列分析基础,从事电力系统、能源管理、智能电网等相关领域的科研人员、工程师以及高校研究生。; 使用场景及目标:①应用于电力系统中长期负荷预测,为电网调度、发电计划、能源交易等关键决策提供高精度数据支持;②为研究人员提供一种先进的多尺度时序建模范式,促进深度学习在能源预测领域的创新与应用发展; 阅读建议:建议结合提供的Python代码实现进行动手实践,重点关注模型的层级结构搭建、超参数调优过程以及消融实验的设计,过对比分析深入理解MS-TCN的多尺度感知能力与TiDE的时间解码机制对整体预测性能的协同贡献。

过原始-对偶混合梯度方法处理反应-扩散方程一阶计算算法的数值分析.zip

1.版本:matlab2014a/2019b/2024b 2.附赠案例数据可直接运行。 3.代码特点:参数化编程、参数可方便更改、代码编程思路清晰、注释明细。 4.适用对象:计算机,电子信息工程、数学等专业的大学生课程设计、期末大作业和毕业设计。

基于高创新模型MS-TCN-TiDE的短期负荷预测研究(Python代码实现)

内容概要:本文提出了一种基于高创新模型MS-TCN-TiDE的短期负荷预测方法,该模型融合多尺度时序卷积网络(MS-TCN)与时间解码器(TiDE)的优势,旨在实现对电力系统短期负荷的高精度预测。MS-TCN能够有效捕捉负荷序列在不同时间尺度下的局部特征与长期依赖关系,而TiDE则过编码-解码架构建模周期性、趋势性等全局时序模式,二者协同提升了模型对复杂负荷动态的表达能力。研究过Python代码实现了完整的模型构建、训练优化与预测流程,并在实际电力负荷数据集上进行了实验验证,结果表明该模型在预测精度、稳定性及泛化性能方面均优于传统时序预测方法。同时,文章探讨了模型在周尺度负荷预测中的适用性,验证了其在长期趋势建模方面的潜力,为电网调度、能源管理及电力市场运营提供了可靠的技术支撑。; 适合人群:具备一定Python编程基础和机器学习知识,从事电力系统分析、能源管理、智能电网或相关领域研究的研发人员及高校研究生。; 使用场景及目标:①应用于电力系统短期负荷预测场景,提升电网运行调度的智能化与精细化水平;②为新能源并网规划、需求响应策略制定、电力市场竞价决策等提供高质量的负荷数据支持;③推动深度学习技术在能源时序预测领域的落地应用与方法创新。; 阅读建议:建议读者结合文中提供的Python代码进行实践复现,重点关注数据预处理流程、模型结构设计细节及超参数调优策略,同时可过消融实验深入理解MS-TCN与TiDE模块的协同机制及其对预测性能的贡献。

17 - 洛雪音乐ikun_music_mobile_v1_7_8_arm64_v8a魔改版.apk

17 - 洛雪音乐ikun_music_mobile_v1_7_8_arm64_v8a魔改版.apk

上一篇: CC Switch 接 TaoToken:一键切换 Claude Code 的默认供应商
下一篇: Kimi K2.7 Code 上了 LiveCodeBench:用 TaoToken 复现同一把 Key 的调用链路
ceshi01
博客等级 码龄18年 1粉丝 4558原创
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符  | 博主筛选后可见
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值