8 月 17 日晚,无数开发者像往常一样打开 GitHub,准备提 PR、跑流水线、找代码。结果等来的,不是页面,是超时、报错、转不完的圈。 Issues 打不开,PR 提不上,Actions 卡住不动,连 Copilot 都开始罢工。微博上有人调侃:"今天全世界的程序员都在摸鱼。" 但真相,比摸鱼 ...
引言:会写代码,和能交付软件,是两回事 过去三年,研发团队讨论 AI 的方式变了三次。 最早问的是:“它能不能补全代码?”后来变成:“它能不能独立修 Bug、写测试、提 Pull Request?”到了 2026 年,真正值得问的问题已经是: 当 AI 能持续干活时,我们有没有能力让它稳定地做对、及 ...
今年ChinaJoy现场,移动游戏“重载化”与“大世界”的趋势仍旧不减。随之而来的,是玩家对高画质、稳帧率以及跨端等体验越来越苛刻的要求。面对移动端算力与功耗的天然矛盾,HarmonyOS SDK在HarmonyOS游戏展区带来了一套全栈式的底层技术方案。它没有停留在单纯的参数比拼上,而是沿着玩家从 ...
作者:张富春(ahfuzhang),转载时请注明作者和引用链接,谢谢! cnblogs博客 zhihu Github 公众号:一本正经的瞎扯 背景 为了更方便地在云环境中测试和调试 CSharp 的后端服务,我制作了 CSharp Debug Container All-in-one。 请看:htt ...
背景介绍 事情发生在24年的6月初的时候,笔者一直在Linux客户端开发组,一个中控组的同事过来说中控服务在某台基于国产化ARM64芯片的系统中频繁崩溃,故障现象非常稳定,问我有没有遇到过类似情况,我说没遇到过,由于笔者手头也有着急的项目问题需要处理,后面一段时间也就不了了之了,只是看到这位同事频繁 ...
线上短信接口遭遇恶意刷量如何处置?本文围绕紧急止损‑多层防护‑业务优化‑监控复盘四步落地立体防刷方案。技术亮点:Redis+Lua 实现分布式令牌桶限流,布隆过滤器过滤风险手机号,AOP 注解多维限流、内存滑动窗口熔断。覆盖 Nginx、网关、业务层全链路防护,剖析代理 IP 池、Redis 宕机等... ...
一、自助查数,为什么一直这么难? 做过数据的人都知道,「让业务自己查数」听起来很美,落地却很痛。 常见有两条路: 第一条:把表做得又宽又全。 一张大宽表、一堆反规范化视图,非技术同事至少能点一点。但业务一长大,同名不同义、同义不同表就越来越多。「收入」「活跃用户」到底指什么,十个人可能有八个答案。 ...
MoE 的核心不是堆更多专家,而是用稳定路由把容量、计算、显存和通信重新做平衡。 大模型扩容时,最直接的办法是把 FFN 做大。FFN 是 Transformer 里真正吃参数的模块,也常被看作模型知识容量的重要来源。问题在于,稠密 FFN 有一个硬约束:每个 token 都要经过同一套参数。参数变 ...
今天想补上对DeepSeek Harness(DSH)的深度思考。先不聊它当下的实用性,我想从架构定位出发,聊聊它为什么在我眼中极具想象力,甚至不亚于Linux内核的诞生。 DSH最大的颠覆在于“一切皆为插件化”。在Agent开发范式逐渐固化的今天,大多数产品在做“加法”来给产品堆砌功能,而DSH在 ...
摘要:Zvec 是一款类 SQLite 的轻量级嵌入式向量数据库,专为终端侧设计,具备开箱即用、资源可配置、极致性能以及多样化向量能力四大核心优势。基于Apache 2.0协议开源,Zvec 旨在为开发者提供从原型验证到端侧生产部署的一站式解决方案。欢迎体验 Zvec,期待你的使用、反馈与贡献! 背 ...
您打开模型选择器,划过十多个选项,随即停了下来。这些模型有什么区别?到底该选用哪一个?当您已经发送了几百条消息之后,还剩下多少可用上下文容量,才会开始出现性能衰减? 我们都遇到过这类情况。现在,Visual Studio 让解答这类问题变得稍微轻松一些。下面我们来详细了解如何查看、对比现有模型,并从 ...
处理文本长度时,很多人最常见的困惑就是:听说中文要占 3 个字节?那英文单词怎么算的?Oracle 的 VARCHAR2 好像给的挺大,但貌似还没存那么多就报错长度不够存了? 其实,关键就在于要先区分清楚三种不同的“长度”代表的含义。 01 | Unicode 码位数 三种长度,含义有所不同,其中 ...
Clasp:一个带插件系统的 .NET 10 命令行工具箱 本文基于开源项目 Clasp(MIT License)撰写,介绍其架构设计、插件系统与工程实践。 引言 在开发工作中,我们常常需要一堆散落的小工具:查 DNS、看端口、转 Base64、解 JWT、算哈希……每个都去装一个独立的命令行工具, ...
同济 + 上海 AI Lab + 港中文 + 南大 + 上交的工作,目前挂在 Arxiv 26.03 上。当前多智能体系统(MAS)的记忆设计普遍存在两个瓶颈:记忆同质化(缺乏角色感知的定制)和信息过载(记忆条目过于细碎冗长)。本文提出 LatentMem,一个可学习的隐空间多智能体记忆框架:用一个 ...
从 7 月 31 日的 DSV4(284B)到 8 月 19 日的 GLM-5.2(744B),TensorSharp 在三周内把纯 .NET 推理栈的承载上限抬高了 2.6 倍,且保持了对 llama.cpp 的逐 token 对齐传统 ...
同一个任务,要求 Agent 搜索某个 API 的最新用法并写成摘要,可能跑出三条轨迹: search -> summarize search -> read -> summarize webfetch -> summarize 哪一条才算对? 答案可能是,三条都对。只要 Agent 读取了权威来源 ...
前言 本篇主要是Qt5.15.2+VS2019x64+VTK9.1.0源码编译流程。 这里注意我们走的是C++技术流,对内存、性能和交互实时性是我们承担研制开发项目和产品所追求的。 版本区分 根据网上搜索的,整理一下:根据网上搜索的,整理一下: Qt5.9.2 + VS2017 x64 + VTK8 ...
RAG(检索增强生成)是NL2SQL准确率从60%跃升到95%的核心技术。但"RAG"不是一个单一技术,而是一个多维度的知识注入体系。本文深度拆解鲲溟智能的四维RAG架构——Schema RAG、Knowledge RAG、Few-shot RAG、Context RAG,从原理、数据结构、检索策略 ...
没有后端也能体验 RenoPit,部署后还能实时诊断数据库、Redis、Celery 和 LLM。拆解 Mock API、健康检查仪表盘、Docker Compose、Nginx 代理与 SSE 生产配置。 ...
本文基于LangGraph会话记忆管理相关内容,聚焦对话持久化存储方案,以LangChain官方推荐的PostgreSQL数据库为载体,拆解Checkpointer检查点存储与Store通用长期存储两大核心体系。通过对比两套存储机制的底层逻辑、差异特点与适用场景,结合可运行实战代码,实现会话重启续聊... ...