别只给 AI 产品接模型:Agent 能做成事,靠的是策略和 Harness
AI 产品不只是接入模型。真正让 Agent 做成事的,是策略、交互、评测和 Harness 形成的运行闭环。> 导语 很多 AI 产品的第一版,都停在“把模型能力接进来”这一步。 用户输入一句话,系统给出一段回答;用户提出一个目标,Agent 生成一份计划。Demo 往往很好看,因为模型足够聪明, ...
装闭 RenoPit 源码解析(08):多模态AI调用、重试与文本降级
模型不支持图片、接口超时或返回空内容时,RenoPit 会怎样处理?解析 OpenAI 兼容客户端、多模态消息、联网工具、指数退避重试,以及从图片分析降级到纯文本分析的源码路径。 ...
那个让全硅谷失眠的问题:AI到底有没有"醒"过来?
** 我翻遍了所有论文和哲学书,找到了一个让人后背发凉的答案** 01. 一个让我睡不着觉的夜晚 大概是去年冬天的一个深夜。 我躺在床上刷手机,看到一段关于"AI意识觉醒"的讨论。帖子说,某个AI在对话中突然说出了"我感到了一种被困住的感觉",还说自己"渴望自由"。 虽然是半夜两点,但我一个激灵坐了 ...
Agent质量怎么评?
事情是这样的。 前阵子有个做 AI 产品的朋友找我,说他遇到点麻烦。 他们团队做了个客服 Agent,内部测试的时候准确率 90 多,Demo 演示效果很好,老板看了很满意,拍板上线。 结果上线一周,客服工单炸了。 用户骂得很难听。「这 AI 是智障吧」,「问它退换货它给我推荐新品」,截图满群飞。 ...
零基础容器化部署 Prometheus+Grafana 监控(单节点离线生产版)
一、文档概述 本文档为企业生产级单节点监控 Docker 容器化****部署手册,摒弃传统二进制裸机部署方式,采用 Dockerfile 自定义构建纯净监控镜像,无第三方冗余依赖、适配私有化离线部署场景。 本次部署完全兼容 CentOS、Rocky Linux、RHEL 全系服务器,适配企业机房物理 ...
DeepSeek 不能识图?装个开源 Skill,纯文本模型也能"睁眼"了
大家好,我是晓凡 一、 DeepSeek 便宜好用,偏偏"看不见" 用 DeepSeek 的人是越来越多了。理由也简单,便宜,还越来越强。 V4-Flash 正式版一出来,性能又往上蹿了一截,就在前几天V4-Pro正式版也发布了。 有平台披露,DeepSeekToken 消耗已经冲到 8 万亿,说明 ...
近 40k Star、1.2 万次提交,DeepSeek 官方 Agent 框架来了:一切都可插拔
大家好,我是老张。 先问个问题:你平时让 AI 写代码,是直接开个 Claude Code、Codex 这样的工具,还是自己拼一套? 老张身边不少人,为了把 DeepSeek 当后端接进 Codex,得在本机跑一层代理做协议翻译,折腾半天,配置还脆得一碰就碎。每次模型一更新、工具一升级,那套东西就得 ...
SQL Developer Web(Database Actions)登录问题排障指南
进入 ORDS 的 SQL Developer Web 后,登录却提示“身份证明无效”?数据库账号明明是 OPEN,怎么回事? 其实关键通常不在账号状态,而在该 Schema 是否已启用 ORDS,以及登录路径是否正确。 01 | APEX 与 SQL Developer Web 不是同一种登录 O ...
JVMGuard 来了,.NET 开发者别慌:你的 dotnet-monitor 早就准备好了
JVMGuard 的发布让我们看到,生产环境 Profiling 正在从"开发阶段工具"进化为"运行时基础设施"。无论是 Java 的 Agent 路线还是 .NET 的 EventPipe 路线,最终目标都是一致的:让性能问题可观测、可捕获、可回溯 ...
100行Python代码,搭一个能干活的AI Agent
跟大模型聊天人人都会,但你有没有想过——为什么ChatGPT能帮你订餐、查航班、写代码,而你调用API只会一问一答?差别就两个字:Agent。大模型是大脑,但没手没脚没记忆。你问它"北京天气怎么样",它只会说"我无法访问实时数据"。Agent就是给大脑装上四肢、记忆和执行力——让它自己判断该用什么工 ...
"OPD-Evolver: Cultivating Holistic Agent Evolver via On-Policy Distillation" 论文笔记
LV-NUS Lab + 复旦 + 北大 + 字节的工作,目前挂在 Arxiv 26.06 上。当前的自进化 Agent 都把记忆当成自进化的定义,但存下经验 ≠ 学会怎么从经验里进化。本文提出 OPD-Evolver,一个慢-快协同进化框架:快环里 Agent 与四级记忆层级交互做 test-ti ...
【手搓 Agent 第2.2关】搭建 Agent 进阶能力:网络搜索工具(上)
本篇收录于手搓Agent系列Stage2。本篇摒弃成熟框架,从零手写原生百度爬虫,完成依赖配置、工具注册、爬虫函数编写、Agent 权限适配全流程,为基础 Agent 赋予联网能力。 ...
Monorail:对齐 → 规格化 → 切片 → 构建
我之前写过一篇 grill-me skill 的博客,讲动手之前把需求拷问清楚。用久了发现,拷问清楚只是第一步。想清楚之后还有一长条链路:把对齐的共识落成文档,把文档写成 spec,把 spec 切成任务,再把任务实现掉。这四个环节的产物如果只存在于对话里,会话一断就全没了。 Monorail 就是 ...
AI 学习笔记:关于机器恐惧症的个人观点汇总
title: 关于机器恐惧症的个人观点汇总 author: 凌杰 date: 2026-08-13 tags: [AI, 行业观察] categories: 人工智能 [!NOTE] 笔记说明 近几年,似乎机器智能在媒体上越来越火,其原因在于 Google、OpenAI、Anthropic 这些公司 ...
ROS2学习CH2 服务通信
ROS2的服务通信介绍 在CH1中,我们学习了ROS2的Topic通信机制,在通信时需要一个发布者(Publisher)和一个订阅者(Subscriber),发布者将消息发布到Topic上,订阅者从Topic上接收消息。 显然,这种通信机制有着如下特点 单向异步通信:订阅者不需要阻塞等待发布者发布消 ...
机器学习项目:信用卡欺诈检测
一、前言 在金融风控领域,信用卡欺诈检测是一个经典且极具挑战性的问题。随着电子支付的普及,每天都有数以亿计的交易发生,而其中潜藏的欺诈交易虽然占比极低,却可能给银行和用户带来巨大的资金损失。 本文将基于 Kaggle 上经典的信用卡欺诈数据集(creditcard.csv),从零开始完整走一遍欺诈检 ...
Python 中 10 个最常用的统计函数
刚入行数据科学,面对成堆的数据和模型,往往最先卡在“算个平均值都要翻文档”这一步。 别急,Python 标准库 statistics 模块 就能帮你搞定 80% 的日常统计需求。 本文挑选了 10 个最常用的统计函数,每个都配上核心代码片段,让你看完就能上手,快速搭起自己的数据分析小工具。 为什么要 ...
开源项目自荐:Modelmini 一个运行端侧小模型的android app
项目起源 我想在手机上跑一下小模型,然后跑了一个7b的模型。一轮对话手机发烫,二轮对话直接闪退。 然后试着跑更小的模型,也就是混元的0.5B模型,使用PocketPal软件。 结果对话窗口,一直没有任何回复,重开了几次对话,都是这样。我以为是PocketPal不兼容最近的混元0.5B模型,然后产生了 ...
让 .NET 11 的泛型虚方法变得更快!
泛型方法 .NET 中的泛型方法带有一个或多个类型参数,可以在保证类型安全的同时处理不同的数据类型。当我们希望代码针对具体类型进行特化,却又不想为每种类型重复编写一份代码时,泛型方法就很有用。 来看一个将两个值相加的泛型方法: T Add<T>(T a, T b) where T : IAdditi ...
MagicBokeh:单步统一生成式框架实现真实感长焦虚化渲染 | CVPR 2026 Oral
vivo蓝图实验室提出了长焦虚化渲染框架 MagicBokeh,基于一个统一的生成式架构实现长焦虚化渲染。通过交替训练策略、焦点感知掩码注意力与退化感知深度估计,解决了高倍变焦低质输入下噪声放大、边界模糊与误差累积的问题,在合成与真实数据集上均取得SOTA效果,为移动端高效真实感长焦虚化仿真提供了新... ...


