让AI处理十几万行Excel、生成上百MB的SQL,是否意味着模型必须"读完"全部内容,并消耗同等规模的Token?答案是否定的。关键在于:模型负责思考和编排,程序负责批量计算。 01 | Token到底花在哪里 Token可以简单理解为模型读取和生成文本时使用的计量单位。只有进入模型上下文的内容, ...
「你骂它两句,它就变聪明了。」这个说法在群里传了很久,而且大家都有体感支持——骂完那一轮,回答确实好了。 体感是真的,归因大概错了。 拆开看,你骂的时候通常顺手带进去了一句具体指正。「我问的是苹果公司股价,你给我扯水果」,这半句才是起作用的东西。至于「你真笨」那半句,模型读到的是一串 token,它 ...
场景:Docker Swarm 集群,MariaDB 10.4 服务异常重启,启动失败;数据库日志发现残留 XA Prepared 事务,常规重启无法自动恢复,业务无法连接数据库。 环境:Docker Swarm + MariaDB 10.4,业务使用XA分布式事务。 一、故障现象 MariaDB ...
过去几年,我们似乎习惯了一件事情: 只要系统里需要一点“智能”,就塞进去一个大模型。 用户意图识别,用 LLM。 选择哪个 Tool,用 LLM。 判断任务是否完成,用 LLM。 评估 Agent 输出是否正确,还是用 LLM。 甚至只是判断一个操作“危险不危险”,很多 Agent 框架也会专门再调 ...
服务器卡了,老板问你为什么,你说"我看看",然后敲了一堆命令,最后还是不知道问题在哪——这个场景是不是很熟? 本文把常用的排查思路和命令整理成一套可复用的剧本。从最基础的 top/free/iostat/ss 四件套,到进阶的 perf、strace、火焰图,按"先定方向、再选工具、读图定位、交叉验 ...
近期,全球首款阔直板手机HUAWEI Pura X View亮相,在6.68mm的轻薄机身和201g的轻盈重量下,Pura X View内置了7000mAh高硅负极大电池,让超长续航与阔屏体验兼得。但真正让这块屏幕“活起来”的,是HarmonyOS 7在系统底层的大屏交互逻辑——通过界面元素的自适应 ...
OctaFuse Gateway 2.11.0 为文本流式请求补齐首包、流中空闲和记账三档保护,并增加可选的首事件超时故障转移。同时,用户级模型倍率支持新的组合策略,代理错误也有了更稳定的判断方式。 一句话看懂 2.11.0: 长流式请求有了明确的等待边界和故障转移策略,用户折扣更容易运营,客户端也 ...
上周朋友发我一个小餐馆的订单文件:restaurant_orders.parquet。 他说是外卖平台导出的,想看看总共多少单、赚了多少钱、哪个菜卖得好、大家怎么付款。 文件几百 MB,不算大,但也不想为了看几个数去折腾数据库。 我直接用了 DuckDB,它有几个好处: 不用建表,不用导入,直接 r ...
最近用GPT-5.6 Sol分析了几份Android SO,感受比较明显:AI已经可以承担不少二进制静态分析中的重复工作。把ELF头、节区、符号、字符串、重定位和函数展开信息交给它批量整理,再回到工具输出逐项核对,效率比手工来回翻结果高很多。 这次我选择了两款手游中的安全模块,分别来自FairGua ...
Agent 平台的两种哲学:从 WeKnora 和 Molio 聊起 WeKnora 最近开源了,也加入了 Wiki 这条路。 这个事让我重新开始想一个问题:我们到底需要一个什么样的 Agent 平台? 过去聊 AI 平台,习惯从模型、RAG、知识库、Workflow、MCP 这些能力出发。但 Ag ...
主从复制扩展应用:延时从库 概念介绍说明: 表示人为主动方式将一个从库进行配置,使从库可以按照指定的时间延时后,再进行和主库完成相应数据信息同步; 功能作用说明: 通常对于数据库服务中的数据信息产生损坏,可能有两方面因素造成: 物理损坏:主机故障、磁盘异常、数据文件损坏...,可以利用传统主从复制方 ...
详解 10G 大文件上传完整落地方案,采用分片并发、断点续传、秒传能力。前端 WebWorker 增量哈希 + Promise 并发池;后端基于 MinIO+Redis+RabbitMQ,搭配零拷贝合并、分布式锁。附带 Java/JS 核心代码与面试问答,覆盖性能优化、异常兜底,可直接用于生产。 ...
一年前的十月份,我写了一篇[《央企程序员AI创业一个月感受》](https://www.cnblogs.com/yubaolee/p/19150334/gantt),那时[星甘StarGantt](https://stargantt.cn)第一次与大家见面,注册用户从零开始。弹指一挥一年间。它还顽强... ...
同一个系列的芯片,型号后面几个字母和数字为什么会影响实际使用?一块看似简单的最小系统板,启动时还要先确认哪些事情? ...
笔者在服务器上执行 docker images 时,发现列表里堆了一排 <none> 镜像,占用从 511 MB 到 826 MB 不等。它们既没有仓库名,也没有标签,看起来像“幽灵”。这篇文章记录笔者如何定位根源并清理掉它们。 01 | none 镜像从哪来 <none>:<none> 常见于以下 ...
如果你维护着跑在 Kestrel 上的高并发服务,HTTP/2/3 相关的三项改进值得在升级后第一时间压测验证;如果你在探索 AI 应用,MCP + Blazor AI 组件的组合值得现在就开始尝鲜 ...
Cloudflare 有个存在多年的小功能:一条命令,就能把电脑上的 localhost 变成公网 HTTPS 地址。以前它只是方便开发者临时分享网站,到了 AI Coding 时代,却突然有了新的价值。 ...
发布日期: 2026年09月19日 阅读时间: 约 12-15 分钟 分类:技术杂谈 专栏:主流AI工具指南 关键词:上下文工程 收口 中间迷失 LLM 长期记忆 AI 你有没有过这种体验:跟 AI 聊了四五十轮,从"帮我写个函数"一路拐到"顺便把数据库也调一下",又或者“这个项目有什么思路”直到“ ...
目录 0. 从上一篇继续 1. 三种语言的锁规则分别保证什么? 2. 下一篇:互斥锁是怎么实现的? 本文首发于 ThinkerQAQ 的个人博客,由作者本人同步发布。 0. 从上一篇继续 这一篇直接从语言内存模型层的规则讨论 Mutex。 1. 三种语言的锁规则分别保证什么? 1.1 Java:sy ...
背景 我这边总结两种方法,主要的思路都是让电脑上的chatgpt(codex)将与后端大模型的流量通过一个正向代理或反向代理软件,然后在这个代理软件上就能查看到经过的流量。 charles 开启代理端口 charles/fiddler/mitmproxy这类软件属于正向代理,当然,像charles/ ...