
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
这次问题的核心经验是:评测大模型时,不能只看模型能力,还要看输出协议是否和评测程序一致。先确认 prompt 是否明确要求输出格式。再确认服务端是否真的关闭了 thinking。对选择题设置较短的max_tokens,但前提是模型已经不会先输出长篇解释。加 stop token,减少答案后继续生成。将设为 0,保证评测可复现。并发不要一开始拉满,先稳定格式,再提高 workers。
加上之后,发现问题解决不了,其实是因为在运行代码时用的是conda环境中的egg里的代码,要进入环境的目录,解压、改代码、重新压缩才行。features.py里这一行缺一个方括号,加上就好。
这次问题的核心经验是:评测大模型时,不能只看模型能力,还要看输出协议是否和评测程序一致。先确认 prompt 是否明确要求输出格式。再确认服务端是否真的关闭了 thinking。对选择题设置较短的max_tokens,但前提是模型已经不会先输出长篇解释。加 stop token,减少答案后继续生成。将设为 0,保证评测可复现。并发不要一开始拉满,先稳定格式,再提高 workers。
1.注意!上述的“model”与在项目中调用时所填内容不一样,用azure所提供的接口时,项目中的model一般只写部署名,因为部署与所用的模型是一一对应的2.有时会有报错说:xml.etree.ElementTree.ParseError: no element found: line 90, column 32经测试,大概率是因为azure的接口限速所导致的,因为限速1000而原来的代码里设置

这次问题的核心经验是:评测大模型时,不能只看模型能力,还要看输出协议是否和评测程序一致。先确认 prompt 是否明确要求输出格式。再确认服务端是否真的关闭了 thinking。对选择题设置较短的max_tokens,但前提是模型已经不会先输出长篇解释。加 stop token,减少答案后继续生成。将设为 0,保证评测可复现。并发不要一开始拉满,先稳定格式,再提高 workers。
1.注意!上述的“model”与在项目中调用时所填内容不一样,用azure所提供的接口时,项目中的model一般只写部署名,因为部署与所用的模型是一一对应的2.有时会有报错说:xml.etree.ElementTree.ParseError: no element found: line 90, column 32经测试,大概率是因为azure的接口限速所导致的,因为限速1000而原来的代码里设置

加上之后,发现问题解决不了,其实是因为在运行代码时用的是conda环境中的egg里的代码,要进入环境的目录,解压、改代码、重新压缩才行。features.py里这一行缺一个方括号,加上就好。
ubuntu的共享文件夹总是莫名其妙打不开,昨天还能用,今天开机后发现/mnt/hgfs下的文件夹不存在了。

sudo rsync -avz --progress /mnt/d/downloads/WAllmdataset/datasets/乔雨-20250409-security-paper-datasets /mnt/nfs_server/dataset/网上教程都是面向Windows11专业版,自带NFS客户端的,可以很轻松上传文件夹,但是由于我的系统是家庭版,没有NFS这个选项,那么只能用WSL,
小区楼下的电动车充电桩(某小程序)太卷了。规则是这样的:必须扫码才能通电。但我回家太晚,22点之后充电桩停止工作,想等到第二天早上6点再充吧,我又起不来。更惨的是,如果我先把插头插上占位,等到下午才想起来扫码,插头早就被大爷大妈拔掉扔地上了……能不能让我晚上插好插头,拍个照,然后程序在第二天早上6:05自动帮我扫码通电?为了这个需求,我经历了一场从安卓自动化到Web逆向,最后回归SMTP协议的奇妙







