给微信装个AI大脑
一个开源微信AI助手,通过微信官方iLink协议接入DeepSeek V4 Flash模型,实现合规不封号、有持久记忆、白名单防刷、扫码即用的功能。项目用Docker一键部署,仅200多行Python代码,适合个人在NAS上运行。
20 篇公开文章
一个开源微信AI助手,通过微信官方iLink协议接入DeepSeek V4 Flash模型,实现合规不封号、有持久记忆、白名单防刷、扫码即用的功能。项目用Docker一键部署,仅200多行Python代码,适合个人在NAS上运行。
ACK集群中两套节点池因共用可用区导致Terway网络隔离失效,Pod IP混杂、公网出口错乱。根因是Terway的eni-config按可用区分配IP,无法区分同可用区内不同网段的交换机。解决方案是将节点池2迁移至eni-config未配置的可用区E/F,利用Terway降级回退机制,使Pod IP从节点eth0所在交换机分配,实现物理隔离。
文章提出知识图谱实现方案,采用4种节点(文章、标签、概念、实体)和6种语义边(链接、归属、相似、引用、构建、矛盾),并引入来源追踪机制(auto/manual/both)支持增量更新。通过LLM提取实体增强语义层,过滤低置信度结果。渲染选用D3.js替代ReactFlow以提升力导向交互流畅性。图谱还作为搜索的结构化扩展通道,与embedding和rerank协同。核心设计哲学包括来源追踪、渐进增强、图谱即检索和交互优先。
RRF(倒数排名融合)是一种多路召回结果融合方法,核心是抛弃原始分数,仅依赖每路结果的排名。通过公式 `score(d) = Σ 1/(k + rank_i(d))`(k默认60),将不同量纲的分数(如cosine、BM25、概率等)统一为排名倒数累加,消除量纲差异和超参调优问题。其有效性在于:无量纲、无超参、强化多路共识文档、自然降级。k=60控制头部与尾部差距,使排名差异温和但可区分。工作流程中,四路召回独立排序后,RRF融合得到最终分数,截断Top-20返回。设计哲学强调排名优于分数、多路投票、理论经验结合、可降级,成为现代搜索系统融合多路召回的事实标准。
containerd 2.1.6 不再支持 Docker V1 镜像格式,导致 K8s 业务 Pod 拉取镜像失败。根因是 Jenkins 使用旧版 Docker 19.03.9 构建出 V1 格式镜像,而新版 containerd 已彻底移除对 V1 的支持。临时修复可通过 Docker 重新推送镜像自动转换为 V2 格式;长期方案是使用 buildx 或开启 BuildKit 构建 V2 标准镜像。
家饭小记是一款轻量微信小程序,旨在解决家庭日常“今天吃什么”的难题。它帮助家庭成员收集用餐意向、共同确定菜单,并支持家庭成员管理、查看每日用餐安排。无需下载APP,打开微信即可使用,让家庭吃饭安排更清晰、轻松。
本文介绍了通过Mac作为网关代理,实现办公内网跨网段访问OpenVPN远程内网的方案。核心矛盾在于办公内网用户无法直接路由到远程内网。方案经历了三个阶段:PF防火墙NAT方案(L3层)仅解决同网段访问,跨网段因路由器缺少回程路由而失败;路由器静态路由方案(L3层补充)需管理权限且不够灵活;最终采用端口映射方案(L4层),在Mac上运行nginx stream模块监听本地端口,通过四层代理绕开路由问题,实现稳定可靠的跨网段访问,支持HTTP和Samba等服务。
文章总结了Nginx高并发短连接日志反向代理的优化实践。核心问题包括:出站端口耗尽、TIME-WAIT堆积(最高近8万)、499客户端断连、配置不规范及路由权限漏洞。优化方案:配置上启用HTTP/1.1长连接复用、缩短代理超时至10秒、修复WebSocket配置错误、添加IP白名单;内核层面开启tcp_tw_reuse、调整端口范围、缩短TCP超时参数;可选iptables跳过连接跟踪。最终解决了连接资源耗尽问题,并指出云上CLB/ALB无法替代Nginx外联代理能力。
我因常忘记重要日子而开发小程序“记日宝”,旨在帮助用户记录亲友生日、纪念日等关键节点及礼物偏好。它像一份“惦记清单”,通过提前提醒避免遗忘,让在乎变得具体。未来计划融入AI辅助送礼建议,但强调技术不替代真心。文章呼吁用户试用,以在忙碌生活中维系珍贵关系。
本文介绍了Function Calling与MCP两种技术。Function Calling是大模型调用预设函数与外部系统交互的能力,用于扩展模型能力、结构化输出和动态决策,适合简单原子化任务。MCP是Anthropic推出的开放通用协议,采用客户端-服务器架构,提供Resources、Tools、Prompts三大能力,支持跨模型跨平台复杂场景。通过门票助手、高德地图MCP、Tavily搜索MCP等案例展示应用。对比显示,Function Calling适合简单低延迟任务,MCP适合复杂多工具联动场景,两者可组合使用。
本文介绍了两种AI Agent类型:Workflow Agent和ReAct Agent。Workflow Agent通过人工定义规则和工具赋能,解决LLM的幻觉、无执行能力等缺陷,适用于高准确性场景,采用RAG技术、预设工作流和工具调用实现可控性。ReAct Agent则通过“推理→行动→反馈”循环动态完成任务,适用于非固定步骤的任务,如文件查找和故障排查,核心是思维链技术支撑推理过程。文章还通过案例展示了ReAct Agent如何通过多轮工具调用完成复杂任务,并讨论了相关技术架构和产品。
本文介绍了Agent进阶与集成技术,涵盖批处理、数据表、知识库、多Agents和复杂工作流等核心能力。通过5个实战案例(古诗词绘画、智能投顾、客户分层营销、智能客服、市场舆情监测)展示应用,并涉及Coze API和Dify API的集成对接。
本文介绍了AI时代软件开发从SDD(规格驱动开发)到TDD(测试驱动开发)的范式转变,强调规格作为可执行表达和测试作为质量保障核心。通过正整数判断和AI投研工具实战案例,展示了TDD的红-绿-重构循环。核心概念“Harness Engineering(驭缰工程)”提出Agent = Model + Harness,强调通过告知、约束、验证三支柱构建可靠系统,包括AGENTS.md导航、Lint规则机械化执行、仓库即记录系统等实践。文章指出,约束越严AI越可靠,需通过自动化规则防止Agent复制坏模式,并介绍了Guides x Sensors矩阵区分计算性与推理性任务。
本文介绍了AI编程工具,重点讲解Cursor编辑器的核心功能与配置。Cursor Rules分为全局规则(适用于所有项目)和项目规则(仅当前项目生效,优先级更高),用于定制AI编码行为。Cursor提供四种工作模式:Agent(自主多文件编辑)、Plan(先规划后执行)、Debug(自动分析报错)和Ask(纯咨询)。文章还涵盖主流AI编程工具分类(如Cursor、Claude Code、Trae等),以及通过实战案例(Excel报表处理、疫情监控)掌握AI编程流程。
本文介绍了AI大模型原理及API使用,涵盖AI分类(分析式与生成式)、大语言模型(LLM)核心能力、ChatGPT训练流程(基于RLHF的SFT、RM、PPO三步)、Token定义、Temperature与Top P参数控制生成多样性,以及AI聊天产品的超能力(联网搜索、读取文件、记忆)。学习目标包括掌握LLM基础、API调用方法及完成四大实战案例。
本文介绍了从提示工程到RAG的核心内容。提示工程是应用层核心技术,通过设计Prompt(包括身份设定、背景、参考资料、样例、指令和限制条件)与大语言模型交互,分为Zero-Shot、One-Shot和Few-Shot三种范式。RAG(检索增强生成)通过构建可检索知识库,解决Prompt字数限制和性能下降问题,执行流程包括知识库构建和检索生成。高级技巧强调“双向奔赴”:优化用户Query(如改写上下文依赖、对比型问题)和适配知识库处理(基于场景和技术理解,构建多维度专属知识库),协同提升检索精度和答案质量。
Coze是字节跳动推出的低代码/零代码AI Agent开发平台,核心由智能体、工作流、插件系统和记忆系统组成。它支持快速搭建基于大模型的Bot,集成60多款内置插件,具备知识库和持久化记忆能力。Coze 2.0新增了云端Vibe Coding开发环境(Coze编程),用户可通过自然语言构建应用并一键部署。平台还提供低代码开发模式,与Dify、n8n相比技术门槛低、字节生态集成强。文章通过搭建五子棋网页和AI新闻助手等实战案例,展示了Coze从创建智能体到配置插件、调试部署的完整流程。
本文介绍了Dify开源LLM应用开发平台的部署与应用。核心内容包括:Dify平台定义及五种应用类型(聊天助手、文本生成、Agent、对话流、工作流);Docker Compose本地化部署步骤(克隆代码、配置环境变量、启动服务、初始化);Chatflow与Workflow的核心区别(对话式交互vs批处理);以及四个实战案例之一——LLM联网搜索工作流的搭建方法(开始→LLM提取关键词→Tavily搜索→LLM总结→结束)。
本文围绕多模态AI展开,分为三大模块:视觉与语言打通、视觉识别与视觉推理、视觉生成。首先,多模态模型实现跨模态理解与生成,核心价值包括视觉转译、融合推理和视觉编辑。其次,对比传统视觉模型(如Yolo、UNet)与多模态模型(如Gemini、GPT):传统模型精度高、成本低,但需单独训练;多模态模型开箱即用、具备推理能力,但成本高、纯视觉精度中等。最后,聚焦视觉生成,针对电商场景提出解决方案:通过工具、流程和人机协作,解决海报和视频生成痛点。电商视频生成采用视频片段组合方法,结合底层模型库、数据支撑层和业务场景层,实现全流程自动化,降低成本并提升效率。
本文介绍了开源项目OpenClaw的安装配置与使用,旨在帮助用户搭建私人助理。内容涵盖前置组件(Node.js、Git、PowerShell等)的安装验证、源码安装步骤(克隆、构建、全局链接)、初始化配置(包括安全设置、网关参数、模型选择),以及飞书集成配置。重点包括Skill技能的配置与调用,以PPT制作为案例,并涉及量化相关技能(如akshare-kline、talib、backtrader)的自定义实现。文章还提及大厂衍生产品及生态应用,并强调工作空间核心文件与加载逻辑。