相关文章
1248 篇高质量内容千问办公开源MyContext个人工作记忆图谱,Cactus Compute发布14MB端侧工具调用模型Needle 2
千问办公开源MyContext构建个人记忆图谱,Cactus Compute发布14MB端侧工具模型Needle 2,聚焦办公与端侧智能升级。 核心内容: 1. MyContext:本地优先的个人工作记忆图谱构建(数据采集、关系提取与冲突处理) 2. Needle 2:14MB端侧工具调用模型(结构化信息提取与低资源场景适配) 3. EVOKE:开放可动态切换提示词的世界模型(支持连续生成与运行中切换)
AIOps落地:告警降噪到底怎么做?我落地了一套方案
本文提出告警降噪“四板斧”方案:第一板斧是写对PromQL与阈值,强调平滑、for分级和相对阈值;第二板斧用Alertmanager分组与抑制规则收敛告警;第三板斧通过标签建依赖实现上下游事件聚合;第四板斧才引入AI聚类,仅处理critical级别告警,依赖标签上下文与结构化system prompt输出根因判断与处置建议。
GPT-Live 英语口语陪练教程
本文提供一套基于 GPT-Live 的结构化英语口语训练方法:先用10–15分钟对话测试CEFR等级;明确陪练规则(如不抢话、只纠错三次);聚焦真实场景(点餐、酒店入住等)进行角色扮演;每次练习后仅复盘三个关键问题并重说;每日15分钟分段执行。强调其适合作为日常陪练工具,但不能替代正式考试或专业校准。
用 WorkBuddy 跑通「虚拟评审会」方法论
本文介绍一种基于 WorkBuddy 的「虚拟评审会」实践:用三个角色明确的智能体(用户/风险/表达视角)加一位真人主持人,模拟真实评审流程。通过固定提示词结构实现独立质疑、冲突显化与待决问题收敛,解决单人写作时的盲区问题,并引用腾讯云与麦肯锡案例中「3人AI小队+1真人」提速12倍的实践佐证。
Codex 和 WorkBuddy 的全局规则设置教程
本文详解如何为 Codex 和 WorkBuddy 设置全局规则,解决重复叮嘱、交付标准模糊、覆盖已有工作、高风险动作失控等四类高频返工问题;提供两工具具体配置路径、可直接复用的精简版规则模板,以及内容、软件、数据、高风险动作四类场景的项目级补充规则,并总结七条实用编写技巧。
Claude Code神级技巧:让AI编程更省心
本文系统梳理了Claude Code在企业级AI编程落地中的工程化实践,重点介绍CLAUDE.md配置规则、Hook自动化机制、子代理与分支会话等核心能力。强调通过持久化行为规范、事件驱动的强制执行、上下文隔离等手段,解决AI工具在长周期协作中出现的意图偏差、操作越界、上下文污染和安全失控问题。
爆火的腾讯WorkBuddy发了篇论文,公开了自家底牌
腾讯WorkBuddy团队开源其内部Agent评测基准WorkBuddy Bench,包含Code、Web、Office、Security四大子集共260个任务,强调真实业务分布对齐与抗污染设计。该基准采用双Harness评分、刻意欠规格提示词、赛后隔离评测等方法,揭示多模型在不同赛道表现差异显著:Claude Opus综合最强,GLM-5.2在Security双榜领先,GPT-5.5为全场最省高分模型。
Claude 新模型的上下文工程:从堆规则到设计上下文
Anthropic 在 Claude Opus 5 和 Claude Fable 5 中大幅删减提示词(删除 Claude Code 中 80% 以上提示词),代码评测性能未明显下降。这标志着上下文工程范式转变:从堆叠硬性规则转向分层设计上下文,强调模型自主判断、渐进式披露、工具自描述、自动 Memory 及复合参考资料。
Graph Engineering:一个提示词,跑起1000+的智能体循环(完整5步教程)
本文介绍Graph Engineering(图工程)方法论,即通过将线性智能体流程重构为节点(任务)与边(数据依赖)组成的有向图,实现多智能体并行协作。核心包含5步:识别虚假依赖、用Claude Code搭建首个动态工作流、规避自验证与资源踩踏两类失败、复用6类典型图结构、设置测试/证据/规则三类锚点保障诚实性,并明确图不适用的四类场景。
OpenAI 把语音转录拆成两条路:实时贵 3.8 倍,差在哪?
OpenAI 推出 GPT-Transcribe(文件转录)和 GPT-Live-Transcribe(实时转录)两套独立模型。前者按分钟计费 0.0045 美元,后者 0.017 美元,价格相差 3.8 倍。二者均支持 prompt、keywords 和 languages 三类上下文提示,但接入方式、延迟控制、适用场景及批量处理能力存在本质差异。
别再手写提示词:Loop 工程14步
Loop 工程将提示词升级为可重复、可验证、可审计的自动化循环系统,核心是设计‘循环’而非编写提示词。文章拆解14步实践路径:先判断任务是否适合Loop(需满足重复性、自动验证、预算可控、工具完备四条件);再掌握五块积木(自动化、Worktree、Skill、连接器、子Agent);最后通过状态文件、最小可用Loop、失败模式识别与安全边界控制实现稳定落地。
你写给 AI 的"员工手册",正在让它变蠢
Anthropic 将 Claude Code 系统提示词删减 80%,性能未受影响。65,000 token 的冗长说明书被证明存在指令冲突、上下文挤占与模型判断权剥夺等问题。团队提出六大范式转变:从硬性规则转向自适应匹配、从示例教学转向接口设计、从全量前置加载转向按需调用、从重复强调转向单一信源、从手动记忆管理转向自动记忆、从 Markdown 单一引用转向多模态上下文引用。核心转向是‘上下文工程’取代‘提示工程’。
AI 工程:搞懂Graph Engineering后,再来猜猜接下来会不会是:Protocol Engineering?
文章梳理AI工程演进脉络:从Prompt、Context、Harness到Loop、Graph Engineering,指出Graph本质是解决多Agent协作中的依赖、状态与协调失控问题;进一步推演,当节点由确定性程序变为不确定Agent后,协议层(Protocol Engineering)将成为下一关键——聚焦契约、权限、冲突仲裁与责任归属等分布式协作基础规则。
还在堆规则写长 Prompt?Claude 5 官方:80% 的约束都是负优化
Anthropic 指出,Claude 5 时代过度堆砌规则、重复约束和全量加载上下文等传统提示工程做法,反而抑制模型能力。官方建议转向「上下文工程」:聚焦身份定义、接口设计、渐进式披露与高保真参考资料,将决策权交还模型。
装了企业微信这个CLI之后,我发现以前都在瞎忙
企业微信CLI工具解决AI工具链权限门槛难题,命令行操作打通业务能力,让效率提升告别瞎忙。核心内容:1. AI工具链权限与门槛高,搭建桥接流程复杂2. 企业微信CLI覆盖多模块,支持命令行/Agent触发,简化配置3. 实际应用场景:文档检索、表格数据查询等业务操作效率提升
为什么你的AI总是笨笨的?5个技巧让你的OfficeAce效率翻倍
还在为AI写报告、做PPT低效抓狂?5个OfficeAce实战技巧,让你的智能体秒变得力助手!核心内容:1. 优化指令:补全背景、范围等信息,避免笼统提问2. 补充素材:提供真实数据与文档,提升输出质量3. 高效处理:活用Skill与任务拆分,应对复杂场景
海外SKILL实践:基于开发事件驱动的自动化协同提效!
海外SKILL实践开发事件驱动自动化协同,AI串联研发全流程,减少多系统重复操作,提升研发效率。核心内容:1. 产研协作中多系统操作的痛点与损耗2. 开发事件驱动的实现方式与全周期闭环3. 实践工具与解决场景(研发、测试协同等)
办公有TA,库库能干!
金融人办公痛点终结!百度库库AI一个入口搞定资料、分析、报告全流程,跨设备接续+企业版加持更省心。核心内容: 1. 跨设备无缝接续办公,关机也能手机继续处理任务 2. 一站式处理Office三件套及专业场景(金融资料、研报、财报等) 3. 推出企业版服务,支持团队协作与安全管理 (注:原文未完整显示企业版具体内容,以上基于现有信息提炼核心功能)
首发体验 | DeepSeek Harness 来了,它不想做下一个Codex
DeepSeek首款Agent产品Harness首发体验,区别于Codex,以自定义预设与多模式设计重塑Agent使用习惯。核心内容:1. DeepSeek Harness的产品定位与差异化(非Codex类产品,有独特设计)2. 核心功能模块(会话管理、Agent预设、权限设置等)3. 四种Agent预设模式(极简、标准、代码、创造)的功能差异
基于阿里云 AgentLoop 的 Skill 评估与优化最佳实践
阿里云AgentLoop平台赋能Skill全流程管理,从创建到发布的闭环优化,数据驱动交付高质量AI技能。核心内容: 1. Skill创建与可观测接入(含要素定义与数据采集) 2. 离线实验与质量量化评估 3. Bad Case分析与迭代优化策略



















