RaBitQ 落地 Zvec:量化原理、索引设计与性能实测

博主头像 Zvec × RaBitQ:量化不再盲目,误差有据可依。 痛点: 传统向量量化(PQ/SQ)近似距离可能改变候选排序,影响召回率。 解法: Zvec 集成 HNSW-RaBitQ 与 IVF-RaBitQ,通过随机旋转降低量化误差,利用概率误差界辅助剪枝,减少无效计算。 战绩: ✅ ... ...

Linux 服务常驻+开机自启实战:以 AIDBM 离线备份工具为例

博主头像 很多小伙伴部署自研程序、后端服务、工具程序时,都会遇到一个高频问题:程序手动能跑,重启服务器就挂、进程意外退出不会自动重启。 靠 nohup、screen 后台运行不仅不规范,还不稳定,无法实现自动保活、开机自启、统一运维管理。 今天就以 AIDBM AI Database Backup Manag ...

登录框不能只会弱口令——记一次从SPA路由到Swagger泄露的漏洞挖掘(二)

博主头像 免责声明: 用途限定 本文档内容仅供网络安全技术人员及合规从业者于授权环境下进行学术交流、技术研讨与防御能力建设之用,旨在提升网络安全防护意识。 禁止行为 文中涉及的所有技术原理、操作步骤、代码示例及工具说明,严禁直接或间接用于以下任何行为: 未经授权的网络扫描、渗透测试或系统入侵; 非法获取、篡改 ...

Kueue + HAMi vGPU 实战:显存与算力配额管理

博主头像 上一篇我们用 Kueue + NVIDIA 原生 DRA 跑通了 GPU 整卡配额:Job 先进入队列,Kueue 判断配额够不够,够了再放行给调度器。 但整卡只是第一步。真实的 GPU 集群里,一张 GPU 往往不会只给一个 Pod 用,HAMi 可以继续按显存和算力切成 vGPU。问题也跟着来了 ...

基于增强QUIC协议优化弱网下的直播观看体验

博主头像 如今,直播已成为电商、教育、娱乐等各领域信息传递与线上消费的重要载体,而网络质量则是决定直播体验的核心命脉。然而,当用户一旦置身于地铁、户外等弱网环境中,画面卡顿、画质模糊、音画错位等问题便接踵而至,原本精彩的直播瞬间变得支离破碎,用户观看体验随之直线下降。 基于此,HarmonyOS SDK远场通 ...

AI工具整理:收藏不如会用

博主头像 收藏了100个AI工具,天天在用的没几个 我收藏夹里的AI工具,估计比大部分人的菜谱还多。刷到推荐就保存收藏,真到干活的时候,还是打开最早记住的那一个。工具越攒越多,效率却一点没涨。 其实问题不在工具不够,而在不知道什么活该用哪个。按任务选工具,比按名气靠谱。我把自己常用的工具按干活场景分了六类,做 ...

前端小白进阶之路:50个实战案例全解析(1)

前端小白进阶之路:50个实战案例全解析(1) 前言:写给正在迷茫的你 很多新手跟我一样,看教程觉得懂了,一关掉视频,面对空白编辑器就大脑空白。其实前端技术不是“背”出来的,而是“敲”出来的。为了巩固基础,我这些天完成了50个从易到难的前端实战项目,踩过了无数的坑(最典型的就是“漏写点号”、“中文路径 ...

把Git Bash的提示符搬到Linux上,用了就回不去了

博主头像 用过Git Bash的朋友应该都有同感——那个默认的提示符,简直是为一眼看清自己在哪里量身定做的。 用户名、主机名、当前目录,颜色分明,换行整齐,尤其是目录层级一多,/home/project/src/module/feature 这种长串也能一目了然,不会和前面的信息挤成一团。 可一旦切到Linu ...

GPT6 Astra 的几点小建议

博主头像 GPT6 Astra 的几点小建议 前几天,GPT-6 Astra 上线了,我马上开了。 正好手上有个小程序「AI 徐公雷达」要优化,我就把任务交给了 Astra。 结果呢? 一个任务做下来,1 个小时,100 刀的额度已经少了约 10%,是真的贵。 其实,对于我们日常的工作,大部分不需要用到 GP ...

DeepSeek Harness(DSH)入门

博主头像 大家对"本地 Agent"这词儿应该不陌生, 用过 Claude Code、Codex或者其他类似的工具。DSH (DeepSeek Harness) 是同一个赛道的新玩家,但它的野心很直白:Everything is a Plugin,一切皆插件。工具、模型、界面、权限,几乎全挂在插件体系上——意 ...

CURD系统怎么做出技术含量惊艳面试官完善版

博主头像 引子 十几年前的一天,有段时间在读张爱玲的小说,同事看见了就说原来你爱看这种东西。我到现在都不知道他说的是哪种东西。那时候我只是单纯的觉得张爱玲写的东西有种特质,这种特质掌握了做什么事情都不会太差。后来我想明白了,这种特制叫做:善于运用技巧。 举个例子,张爱玲有个神作《金锁记》,女主经历了不幸的一生 ...

.NET上位机踩坑:BOOL和BIT

博主头像 前言 大家好,我是 wacky。 今天这篇文章,来源于一个真实的疑问,什么疑问呢?就是我一个BOOL类型的数据,它的值是TRUE或者FALSE;而一个Bit类型的数据,它的值,也是TRUE或者FALSE,那么它们二者是一样的吗?能否互相替换使用? 答案是不能的,今天我们这一篇就来聊一聊,BOOL和B ...

9 个开源 App,治好了我的 vibe coding 焦虑

博主头像 本周 aihot 热度榜第 9 名,加上 GitHub 上 claude-code 生态那一波讨论,把「10 个开源 App」这个话题又顶到了风口。 我 3 月写过一篇《Vibe Coding 越写越乱?GitHub 用这个工具把 AI 编码变成了工程》,那篇讲的是一个反面,光 vibe 不工程,代 ...

ARM64端到端再提速40%:SimdPaddleOCR 1.2 发布!

博主头像 前两天连载了 SimdPaddleOCR 的发布 和 C# 手写向量化的底层逻辑。1.1 版本在 win-x64 上已经基本站稳了脚跟,但短板也很明显:ARM64 环境下虽然能跑,但速度明显慢了一截。 现在 ARM64 早就不是小众平台了——MacBook、手机、Windows on ARM 以及越 ...

持续打磨适合自己的AI Agent

博主头像 过去一个月,我在一个 agent 配置仓库里改动了 51 个文件、约 2500 行。改的不是业务代码,而是 AI agent 自己的"运行环境":模型路由、权限矩阵、提示词缓存、上下文压缩、技能治理。这些问题很少出现在业务开发教程里,但每一个都真实地烧过 token、坑过行为。这里挑九件事记录一下, ...

高并发下的排行榜系统:如何用Redis快速实现千万用户实时排名

博主头像 详解基于Redis ZSet实现千万级用户实时排行榜的工业级方案!从数据结构选型、分层架构到渐进式优化全覆盖,解决高并发写入、大key、同分排序、查询延迟等核心痛点。整合Kafka削峰、分桶分片、Caffeine热点缓存、Lua原子操作、小顶堆归并等技术,实现读写性能大幅跃升,内存成本直降90%。附... ...

123···100>