零基础认识大语言模型(LLM)工作原理(16.未来的大模型与 AI Agent:从模型竞争到系统竞争)--结尾篇
第十六章 未来的大模型与 AI Agent:从模型竞争到系统竞争 目录 零基础认识大语言模型(LLM)工作原理目录 - GuZhenYin - 博客园 本章导读 过去几年,AI 领域最受关注的指标往往是: 参数量有多大; 上下文窗口有多长; 推理能力有多强; 排行榜成绩有多高。 这些指标当然还是很重 ...
Agent 长程任务架构设计指南:上下文管理、错误纠偏、目标约束与框架选型
长程任务不是把短任务循环很多次。它真正难的地方在于:上下文会膨胀,错误会累积,目标会漂移。现有 Agent 框架几乎都在围绕这三类约束做取舍 ...
maven私有仓库之nexus简单使用
概述 Nexus是Sonatype公司开发的一款开源的仓库管理系统,是目前最流行的私有仓库解决方案,主要用于存储和管理各类二进制工件(Artifact),包括Java Maven依赖、npm包、Docker镜像、PyPI包、RPM包等等。 Nexus的核心价值 依赖加速:缓存公共仓库的依赖包,大幅提 ...
MySQL单表有10亿数据如何做迁移
本文讲解 10 亿级 MySQL 单表平滑迁移方案,遵循零丢失、短停机、可回滚原则。采用 DataX 分片并行全量、Canal CDC 增量、异步双写兜底,三层校验 + 灰度切流;附幂等同步、分片校验代码,梳理海量迁移性能、一致性等难点与落地避坑方案,配套面试问答。 ...
记一次 .NET 某智慧医保云服务Linux 非托管泄露分析
一:背景 1. 讲故事 说来也奇怪,最近分析了好几例内存暴涨事故,这不又来了,哈哈,今天再给大家带来一份非托管内存泄露导致的程序生产故障,而且是部署在Linux上.NET程序。 前些天有位朋友找到我,自己有一定的分析能力,发现程序是非托管内存泄露,但能力有限暂时也不知道怎么弄,让我帮忙看下,把dum ...
部署与运维篇:从集群搭建到故障排查的完全指南
系列第五阶段:部署与运维篇 你好,我们又见面了。 经过前面四个阶段的学习,你已经掌握了 RocketMQ 的核心原理、存储机制、发送消费以及各种进阶特性。可以说,你现在对 RocketMQ 的“内功”已经相当扎实了。 但有一句老话说得好:“理论是银的,实践是金的。” 一个消息中间件系统,光懂原理还不 ...
10万人都在用的 top10 skills,我帮你试了!
导读:skills.sh(Vercel 出品的 Agent Skills 导航站)上线后,排行榜上的数字已经卷到离谱——第一名 240 万 热度,第二名 60 万+,连第十名都有 35 万+。 这些排名靠前的 Skill 真的好用吗?有没有水分?哪些值得装,哪些看看就行? 我把 skills.sh ...
业务智能体实战笔记(三):收窄 LLM 决策空间
业务智能体准确率从 65% 推到 75%,靠的不是某种精妙算法,是收窄 LLM 的决策空间。这篇文章讲了四件事:提示词改了 59 版之后撞墙的教训、采样参数从 0.6/0.7 收到 0.3/0.1 的过程、为什么不把业务数据塞 RAG 也不塞提示词、以及工具按总数分两档注册的路由策略。核心判断很... ...
上周热点回顾(7.13-7.19)
热点随笔: · 22届微软MVP连任:一个.NET技术人的社区长跑 (张善友) · .NET CORE 动态扩展Options-配置运行时热更新 (yuyuyui) · Kimi K3悄悄上线:1M上下文、专攻编程,月之暗面的最强底牌亮了 (老猿AI洞察) · 上周热点回顾(7.6-7.12) (博 ...
一次P0 故障:微服务线程数莫名暴涨 10 倍,线程问题踩坑
生产服务器告警:创建线程总数超过32000个故障。服务器的总线程数无法突破32000的问题在 “k8s的pod容器中微服务无法创建新线程unable to create new native thread” 文章中提过,现在再谈谈单个服务的线程数怎么优化。 目前统计到的节点上微服务的线程总数可达到5 ...
LLM.deepseek: 我感受到了时间
引言:(Paul Liu) 今天让LLM.deepseek真正做了一件 它之前完全不一样的任务. 我的考题是: 让它感受一分钟时间 过程很曲折, 结果跟惊喜. 让它理解了 什么叫感受? 基本概念: 世界 = 空间维度信息 + 时间维度信息. 感受就是 在时间维度的牵引下, 体会空间信息的变化. 如果 ...
第4章:Mongo CRUD 基础实战——用户与商品管理
1. 项目背景 业务场景:本地生活电商的运营团队急得跳脚——商品信息管理全靠手工 Excel,然后开发写脚本批量导入 MySQL,每次上下架都要拉开发改代码。更离谱的是,新来的运营把"已删除"和"已下架"搞混,直接删了一行 Excel,导致 200 个商品的销售记录断档。技术负责人拍板:必须做一个运 ...
【RAG扫盲系列·3】从零开始构建你的RAG项目第二弹:API 调用大模型问答
在大模型应用开发中,除了本地推理(如 vLLM、transformers),API 调用是更常见、更轻量的方式。本文以通义千问(DashScope 兼容 OpenAI API)为例,展示如何完成一次完整的 API 调用。 一、为什么选择 API 调用 轻量:无需本地部署 GPU,只需一行请求即可调用 ...
GB28181 跨不对称链路倍速拉流:UDP丢包→TCP断连→录像截断
GB28181 跨网级联倍速拉流场景下,不对称带宽导致三层递进故障的完整排坑记录。从 UDP 丢包切入,经 TCP 中途断连,到 SIP 信令与 RTP 媒体双通道时序脱节引发的录像截断,完整还原从网络抓包、中间件调参到应用层逻辑重构的定位过程。上下游均为 WVP-GB28181 + ZLM... ...
嵌入式Linux C应用编程——Framebuffer应用编程
FrameBuffer 应用编程 什么是 FrameBuffer FrameBuffer(帧缓冲) 是 Linux 系统中的一种显示驱动接口。它将显示设备(如 LCD)进行抽象,屏蔽了不同显示设备硬件的实现差异,对应用层呈现为一块显示内存(显存),允许上层应用程序直接对显示缓冲区进行读写操作,而无需 ...
linux系统移植pjsua库实现sip通话功能
一、概述 本文实现pjsua开源库的交叉编译以及通过调用pjsua库api实现sip语言双向通话功能,包括注册上线sip服务器、接收处理指令(电话邀请、挂断等)、双向音频对讲功能。 二、交叉编译pjsua库 1.解压 tar -zxvf 2.15.1.tar.gz; cd pjproject-2.1 ...
Duckdb存储结构
DuckDB 存储结构:从逻辑表到磁盘 Block 1. 核心结论 DuckDB 原生表的主线只有一条: Table → Row Group → ColumnData → Column Segment → DuckDB Block → Buffer Manager → Vector / DataCh ...
AI 学习笔记: 深度学习的训练与评估
title: 深度学习的训练与评估 author: 凌杰 date: 2026-04-15 tags: 人工智能 深度神经网络 categories: 基础技术研究 [!NOTE] 笔记说明 这篇笔记对应的是《[[关于 AI 的学习路线图]]》一文中所规划的第二个学习阶段。其中记录了我对深度神经网络 ...
ECharts 8 个实战技巧,从配置到性能全覆盖
你有没有遇到过这种情况—— 数据量才几万条,ECharts 图表渲染就要 3 秒以上,用户拖拽 dataZoom 的时候卡得像幻灯片。你反复检查代码,配置项翻来覆去看,觉得"官方文档不就是这么写的吗"。 问题不在 ECharts 本身——66.6k GitHub stars、Apache 基金会顶级 ...
高性能进程内队列 BufferQueue 1.0 版本发布
目录前言它解决的不是“再造一个 Channel”Benchmark:优势主要在批量消费生产性能消费性能先看核心模型两种存储模式怎么选快速接入生产数据Pull 模式批量消费Push 模式消费Auto Commit 和 Manual Commit 到底有什么区别Auto CommitManual Com ...


