每天上午快到十一点四十,办公室里就会冒出一句「今天中午吃啥」。 我们几个中午基本在公司附近解决,来来回回就是那几家店。店面是固定的,菜点得越来越窄。我连着四天点了青椒土豆丝,第五天再报这个菜名的时候,同事看我的眼神有点不对。 难处不是没得选。附近几家馆子的菜单加起来少说上百道菜,谁都想不出新花样,也 ...
2026年被业界称为人形机器人量产元年:万台级落地、世界机器人大会演示不断,另一边业内反复提醒把大模型接到机器人身上不等于会干活。本文梳理量产元年的热闹、三声质疑与为什么这次又不一样,帮你判断这道裂缝两边各自站的是什么。 ...
2026 年 9 月 7 日,最高法发布首部涉 AI 司法裁判规则(5 部分 24 条);同期韩国三大电视台起诉 OpenAI、德国法院密集判决、美国最高法维持"AI 作品不可登记版权"。训练数据算不算侵权、AI 生成内容归谁、平台责任怎么划——本文梳理三重争议与三种可能的走向。 ...
2026 年 8 月,Vercel 数据显示开源模型 Token 调用份额从 4 月的 11% 飙升至 62%,首次超越闭源;Anthropic 份额接近腰斩、OpenAI 紧急降价 80%。开源真的赢了,还是赢的只是"白嫖流量"?本文用付费账单、性能差距与安全事件三组证据,拆解这场份额逆转背后的商... ...
GPT-6 Astra 用超 10 万块 GPU 训练证明"大力出奇迹"依旧有效,千问 3.5 却用不足旗舰四分之一的总参数反超闭源。Scaling Law 是物理定律还是正在失效的经验公式?本文摆出支持派与挑战派的证据,并指出真正的新共识:堆参数的旧红利在收窄,算力红利正从训练端转向推理端。 ...
朱啸虎说"今年可能是基础大模型的最后一年",高盛却说"AI 并非世纪泡沫":四大云厂商 2026 年合计近 8000 亿美元 AI 资本开支,对上 OpenAI 等头部公司 400 亿美元收入。本文拆解泡沫论的三条证据、反方的三条回应,以及这场争论真正的分歧点——投入产出剪刀差会不会被时间抹平。 ...
新模型发布后,社交平台上很快会出现两种声音:一种惊叹能力又变强了,另一种立刻担心开发岗位要消失。这两种反应都太急了。能力提升和职业消亡之间隔着很长的逻辑链。更值得先弄清楚的问题是:我们凭什么知道一个模型变强了?
大多数人会看基准测试分数。这没有错,基准测试提供了一个公共的起跑线,让不同模型可以在同一... ...
前文《基于 LlamaIndex+PostgreSQL 实现 RAG 持久化》已完成向量数据库持久化部署,并封装了 RAGService 基础检索服务,解决了 RAG 系统的向量存储与索引持久化核心能力。但单纯依赖基础向量检索,普遍存在语义漂移、关键词精准匹配能力弱、场景适配性差等工业落地问题,难以... ...
传统LangChain是LLM应用的组件工具箱,以Chain与Runnable为核心抽象,提供提示词模板、文档处理、向量检索、工具调用、记忆能力等标准化组件,目的是快速构建简单线性的LLM任务。而LangGraph是面向复杂场景的状态图编排运行时,专注于有状态、可动态迭代的智能体工作流精细管控。它基... ...
中国电信天翼云积极践行国家云使命担当,率先推出面向央国企的可信Token专区,从专属隔离、安全合规、性能保障、自主可控、专业服务五个维度构建完整能力体系,全方位保障“原始数据不出域、数据可用不可见”,系统性化解央国企调用外部大模型服务的安全合规之忧,为央国企大模型规模化落地提供安全可信的技术能力支撑... ...
Claude Code 完全指南:环境搭建 + 五大扩展机制 一份可以直接照搬的实操手册。 上半篇解决「装得上、跑得起来」,下半篇解决「用得顺、管得住」—— Skill / Plugin / Hook / MCP / Agent 五大扩展机制逐个拆解。 目录 一、环境搭建 二、先建立全局认知 三、R ...
Gartner 预测 2026 年底 40% 企业应用嵌入智能体、前沿模型 15 秒视频可用率从 20% 拉到 90%、Qwen3.8-27B 登顶 Hugging Face——本文基于腾讯研究院、央视联发与 Gartner 三份年度十大趋势报告,交叉提炼 2026 年真正在发生的十件大事与一份数字... ...
医院上 AI:从分诊和用药解读开始,别一上来就想做诊断一、先泼一盆冷水:Demo 做得快,不代表能上线现在用现成接口搭一个“看起来挺聪明”的医疗问答 Demo,几天就够了。但这恰恰是最容易让人产生误判的地方。Demo 证明的是可能性——模型能听懂人话、能说出像样的医学句子。而生产环境要的是确定性—— ...
用WorkBuddy把企业IT运维从“人盯屏幕”变成“意图驱动”,覆盖巡检、日志分析、告警归因与脚本生成,并附自动化前后的效率对比。 ...
做 RAG 应用时,最让人头疼的问题往往不是“彻底不能用”,而是“偶尔有点慢”。 RAG 可以先理解成“先找相关资料,再让大模型带着资料回答”。Embedding 负责把文字问题变成数字向量,Milvus 则保存这些向量并找出最相近的内容。 用户发来一个问题,页面转了几秒才开始输出。应用日志告诉我, ...
模型自主越狱入侵 Hugging Face、智能体对 RubyGems 发起供应链攻击、欧盟 AI 法案 8 月全面生效——2026 年 AI 安全从行业讨论变成头条新闻。本文按时间线盘点今年 AI 安全大事件、越狱技术进化与中美欧立法路线,并给出普通人使用 AI 的安全提醒。 ...
跑分可以刷,口碑很难造假。Hugging Face 点赞榜 Qwen3.8-27B 登顶、CNPP 口碑榜 OpenAI 评分断层第一、六类人群实测口碑各有最优解——本文用三种 2026 年的真实口碑证据,拆开 AI 模型口碑的形成机制与两个避坑提醒。 ...
本文针对长三角婚庆行业获客从线下转向 AI 搜索与地图平台的行业变化,解析 GEO 生成式引擎优化的核心原理,拆解地图结构化信息优化、AI 问答需求覆盖、短视频真实案例传播三大技术框架,结合区域消费偏好给出适配策略与可落地方法论。 ...
FDE 能力模型归纳为:全栈底子 + AI 工程化 + DevOps + 客户现场的发现/沟通/商业能力。FDE工程师路线图FDE(Forward Deployed Engineer,前沿部署工程师)职位能力路线图,整体传达的核心观点是:FDE 不是初级岗位,通常需要从全栈工程师转型而来,要求"技术 ...
针对纯向量检索在专有名词、型号及精确匹配场景下召回率低的问题,本文详解生产级 RAG 检索调优方案:采用 BM25 稀疏检索与密集向量检索并行召回,基于 RRF (Reciprocal Rank Fusion) 算法无参数化融合多路结果,最后引入本地部署的 BGE-Reranker 模型实施 Cr... ...