word文档参考文献按引用顺序自动调整编号
最近在写毕业论文,因为不断的修改添加了大量了引用,导致编号非常混乱,显得非常不美观,
又恰逢女朋友学校强制要求引用目录按照引用顺序排序,因此不得已开发了一个程序来对引用进行自动编号,
开发过程一波三折,难度也比一开始的设想大了很多,
因为需要处理书签引用和纯手写的引用,本来是想使用PyDocX的,测试后发现PyDocX读取书签引用有问题,
最后只能手写个简单的代码解析docx,虽然很麻烦但是总算是搞定了。
最近在写毕业论文,因为不断的修改添加了大量了引用,导致编号非常混乱,显得非常不美观,
又恰逢女朋友学校强制要求引用目录按照引用顺序排序,因此不得已开发了一个程序来对引用进行自动编号,
开发过程一波三折,难度也比一开始的设想大了很多,
因为需要处理书签引用和纯手写的引用,本来是想使用PyDocX的,测试后发现PyDocX读取书签引用有问题,
最后只能手写个简单的代码解析docx,虽然很麻烦但是总算是搞定了。
最近看到知乎上,关于最让自己印象深刻的一次bug的经历,的讨论,不禁让我回想起了研一时,那一次libc依赖损坏的事故。
在部署模型时,对于输入数据的预处理是一个非常耗时的操作,其实可以将预处理一同打包到模型中,在转换为ONNX或者Tensorrt模型后这些操作就可以随着模型一起被加速执行。
以最简单的归一化操作为例
在处理数据时,时常会遇到需要处理json数据的情况, 可以使用get_json_object, regexp_replace, split来组合对json数组进行处理
在使用triton时,可以使用shared memory方式加速数据传输的过程