相关文章
2205 篇高质量内容Nathan Lambert:GLM-5.2是开源Agent重大突破,连锁反应将渗透进更广泛的经济体
开源AI领域的重大突破:GLM-5.2首次让免费模型媲美顶尖付费AI,代码与复杂任务处理能力直追前沿,这标志着一扇无法回头的技术单向门已开启。 核心内容: 1. GLM-5.2的关键突破与行业影响 2. 模型发布背后的策略与时代背景 3. 开源AI生态的竞争格局与未来展望
百度开源 Unlimited OCR:让长文档解析一次完成
百度开源Unlimited OCR,实现长文档一次解析,显著提升处理速度与效率。 核心内容: 1. Unlimited OCR的核心技术:R-SWA机制实现长程解析 2. 模型性能优势:解析速度大幅提升,尤其在长文档场景 3. 开源与实测效果:代码权重已开源,基准测试表现优异
我把自己的需求到交付 Skills 开源了:Analysis to Delivery
从需求分析到开发交付,这套开源Skills帮你避开AI的“自信”陷阱,让流程清晰可控。 核心内容: 1. 项目背景:解决需求与开发脱节、AI盲目编码等核心痛点 2. 核心价值:提供标准化工作流,引导AI像专业角色一样思考与验证 3. 项目构成:26个可组合Skills、行业示例及完整工具链
腾讯开源WeKnora知识库部署实战(含踩坑排查)
WeKnora知识库部署实战:从踩坑到排查,手把手教你搭建企业级RAG系统。 核心内容: 1. WeKnora知识库部署过程中的典型问题与排查方法 2. RAG技术原理及其与网盘的本质区别 3. WeKnora的核心优势:集成问答、Agent推理与自维护Wiki
DiffusionGemma: 文本生成速度提升 4 倍
DiffusionGemma 突破传统自回归模型限制,实现高达4倍的文本生成速度,为实时交互应用带来全新可能。 核心内容: 1. DiffusionGemma 的技术原理与速度突破 2. 针对开发者与实时应用的优化设计 3. 实验性状态与未来应用场景
刚刚,百度开源拿下全球第一!作者疑似DeepSeek出走大神
百度开源Unlimited OCR以极小参数刷新SOTA,作者身份引发猜测,或将开启OCR新范式。 核心内容: 1. Unlimited OCR的技术突破与性能表现 2. 当前OCR模型“逐页失忆”的根本原因 3. R-SWA注意力机制的核心原理与创新
GLM-5.2本地部署:744B参数模型如何在Mac上跑
将744B参数的GLM-5.2模型压缩至239GB,在Mac上实现本地部署,让顶级AI能力触手可及。 核心内容: 1. GLM-5.2的性能优势与量化技术突破 2. 实现本地部署的硬件要求与关键步骤 3. 模型的核心架构创新与未来应用展望
Hermes Agent v0.17发布:AI助手开始扩展触角
Hermes Agent v0.17 发布,AI助手正从单一工具演化为融入日常沟通与工作流的智能伙伴。 核心内容: 1. 扩展多平台触达能力,无缝接入iMessage、WhatsApp等主流通讯渠道 2. 强化桌面端体验,新增可定制快捷键、系统通知等实用功能 3. 完善团队管理与异步代理机制,降低运行成本并提升协作效率
开源中医 Skill:把倪海厦课程变成可检索知识库
倪海厦中医课程化身可检索知识库,AI助手也能精准查找中医经典。 核心内容: 1. 项目将海量中医课程资料结构化,支持白话检索与方证对比 2. 提供模块化加载机制,避免一次性加载所有资料 3. 支持穴位查询、截图证据检索及多平台安装使用
Gemma 4 QAT 模型现已推出: 支持日常端侧设备与消费级 GPU 本地流畅运行
Gemma 4 QAT模型大幅优化,让大语言模型能流畅运行在你的手机和消费级显卡上,体验本地AI的便捷与高效。 核心内容: 1. QAT技术如何减少模型压缩的精度损失 2. Gemma 4 E2B模型内存占用降至1GB的突破 3. 专为移动端设计的定制量化方案与性能优势
GLM-5.2 技术解读:智谱百万上下文的新一代旗舰模型
智谱AI最新旗舰模型GLM-5.2,在百万级超长上下文上实现了稳定可靠的工程表现,为长程任务提供了强大的开源基础。 核心内容: 1. GLM-5.2的四大核心能力升级与开源优势 2. 在长程任务基准测试中作为开源模型第一名的表现 3. 灵活推理投入度与标准编程基准测试的显著提升
26.1%的AI编程技能有漏洞:NVIDIA开源 SkillSpector 能扫出什么?
AI技能包暗藏风险,NVIDIA开源工具SkillSpector为你的AI编程助手保驾护航。 核心内容: 1. AI技能包安全现状:26.1%含已知漏洞,恶意意图不容忽视 2. SkillSpector工具介绍:三层检测架构,支持多种部署方式 3. AI安全新范式:从代码审计到技能包扫描的生态完善
当 AI Coding Agent 成为基础设施:我们为什么要开源 LoongSuite Pilot
AI Coding Agent正成为开发者的日常生产力工具,但对其运行行为却缺乏可观测性。开源LoongSuite Pilot,正是为了破解这一难题。 核心内容: 1. AI Coding Agent可观测性面临的三大挑战 2. LoongSuite Pilot的ALL IN ONE架构设计思路 3. 开源方案的价值与未来展望
CPU 跑得比 Whisper GPU还快的开源语音识别,本地部署
FunASR开源语音识别工具包,CPU速度竟超越Whisper GPU,一站式搞定VAD、识别、标点、说话人分离和情感分析。 核心内容: 1. FunASR的工业级一站式流水线架构 2. 在CPU与GPU上的惊人速度表现 3. 支持多语言、方言及情感识别等核心功能
别再问我什么是爱马仕!
Hermes Agent不是奢侈品也不是龙虾,而是开源AI Agent框架,两个月内GitHub星星数翻七倍,真正实现“不用教,自己长本事”。 核心内容: 1. Hermes Agent与OpenClaw等主流框架的核心差异 2. 无需调教、自主学习和优化的三件套机制 3. 实际应用场景与数字同事价值
Open Design:开源界的 Claude Design 替代品,61.7K Star,21+ Agent 都能跑,本地第一
Claude Design的闭源付费模式让人望而却步?Open Design让你在本地免费跑通同样的AI设计流程,数据完全自主。 核心内容: 1. Open Design如何作为开源替代品,打破Claude Design的封闭生态 2. 平台的核心架构:技能、设计系统与插件如何驱动21+个编码Agent 3. 本地优先的优势与一站式产品页面带来的高效设计体验
从搜索、点击、表单填写到复杂网页操作,让 AI 像人一样使用浏览器
BrowserAct让AI代理真正“活”在互联网上,解决真实网页操作中的反爬、会话冲突等痛点,将自动化从“偶尔能用”变为“日常可靠”。 核心内容: 1. 传统AI代理操作网页的痛点与BrowserAct的解决方案 2. BrowserAct三层技术架构如何突破网站反爬机制 3. 工具在并发、安全及大模型友好性上的设计细节
比Codex快4倍!终于有开源模型卷本地Agent执行效率了~
本地Agent效率革命!开源模型Step 3.7 Flash让代码执行速度飙升4倍,视觉能力同样惊艳。 核心内容: 1. Step 3.7 Flash模型性能实测:速度远超GPT-5.5 2. 模型核心优势:开源、多模态、高速度与强大视觉理解 3. 实战应用场景:视频提示词倒推与高效本地Agent集成
Anthropic 开源 Agent Skills 参考库,大模型定制化时代开启
开源 Anthropic Skills,让 AI 代理瞬间掌握企业专属工作流,告别臃肿提示词,实现动态精准调用。 核心内容: 1. Anthropic Skills 库的模块化结构与 SKILL.md 协议 2. 动态按需加载机制如何提升 AI 响应效率 3. CLI 原生集成与开发者应用场景
Karpathy LLM-Wiki Skill 已开源公开
将学习材料转化为可维护的LLM知识库,这套开源工具让持续学习和知识管理自动化。 核心内容: 1. 开源Skill与真实示例Wiki的配套设计 2. 从原始材料到结构化知识工件的完整流程 3. 通过ingest、query、lint实现知识的持续维护与校正


















