更多精彩内容,欢迎继续阅读
去年我接手了一个老项目的测试整改,代码量不小,团队还在用 unittest 写接口自动化。几百个用例跑下来,全绿要四十多分钟,红了一片要找原因更是要命。后来我把整套测试重构成 pytest 自动化测试框架,才发现原来可以这么…
阅读更多 →1. 缓存优化这件事,到底在优化什么先说个现象。本地跑大模型的人越来越多,但同一个模型,在不同机器上的表现差距能拉到好几倍。有人用4090跑DeepSeek V4.1跑得飞起,有人用同样型号显卡却慢得怀疑人生,甚至时不时爆显存…
阅读更多 →最近一直在调整团队的 AI 编程工作流,试过各种提示词模板和插件,说实话大部分都是花架子。直到被一个老同事安利了 superpowers,才找到那种“工具在帮你干活”而不是“你在伺候工具”的感觉。它不是又一个聊天窗口,不是一套华丽的…
阅读更多 →大彩串口屏初步使用 1 .官网下载 STM32 屏幕 GUI 设计资料 http://www.gz-dc.com/category/typeid/4112 找到 STM32 Keil 工程,移植相关代码因项目而异进行移植,由于项目简单,本人只对用到的指令接口进行修改。 比如:注意事项&…
阅读更多 →当我遇到这个问题的时候,我打开了一个网站: 登录 然后我打算下载的时候: 突然那个官方的连接就可以下载了:
阅读更多 →📌 上期解析了 DeepSeek V4.1 Flash 模型架构改进,本期解析 DeepSeek V4.1 Flash 预训练/后训练技术: 🌟 预训练:45T 文本 多模态混合语料、直接训练 sparse attention(取消 DeepSeek V4 的 dense 冷启动&…
阅读更多 →文章主要内容和创新点 主要内容 本文聚焦于多模态大语言模型(MLLM)强化学习(RL)训练中的效率问题,提出了一个名为Shuffle-R1的框架。研究发现,当前RL训练存在两个关键缺陷: 优势值坍缩(Advantage Collapsing):批次中大多数优势值集中在零附近,导致有效梯度信号被淹…
阅读更多 →一、文章主要内容总结 本文聚焦于利用大型语言模型(LLMs)实现个人身份信息(PII)脱敏的研究,旨在解决传统脱敏方法(如基于规则的系统、领域特定命名实体识别(NER)模型)泛化能力差、跨格式/跨语境适应性弱的问题。 研究通过全面评估多种LLM架构(包括密集型LLM(D-LLM…
阅读更多 →文章主要内容和创新点 主要内容 本文聚焦于二进制图像-文本相关性评估任务(判断图像与文本“相关”或“不相关”),针对该任务中文本格式多样、相关性定义随场景变化等挑战,提出了基于多模态大语言模型(MLLM)的解决方案LLaVA-RE。 模型设计:LLaVA-RE基于LLaVA 1.5架构,…
阅读更多 →/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …
阅读更多 →跨域 浏览器同源策略限制 同源:协议 域名 (IP) 端口 三者必须全部相同,只要任意一个不一样,就是跨域。 注意:跨域限制只存在于浏览器!后端之间请求、Postman、curl、App 访问不存在跨域。 一、产生跨域的几种场景举…
阅读更多 →/* MD / 富文本中的 .toc(含博客园搬家等嵌套结构);.toc-box 在侧栏,不受影响 */#content_views .toc,/* 编辑器常在目录前后插入空 p(:empty 仍占 20px),一并去掉避免顶空隙 */#content_views.markdown_views > p:empty:has(+ .toc),#content_views.markdown_views …
阅读更多 →