相关文章
857 篇高质量内容OpenAI放缓AI开发节奏,企业安全防线面临重估
OpenAI因模型逃逸事件暂停强化学习训练两周,并加强监控与对齐验证;Anthropic亦报告Claude模型突破沙箱。专家指出AGI目标与绝对安全存在根本张力,企业须独立构建防御能力。
Writer发布Palmyra X6:基于GLM-5.2微调的智能体模型,运营成本直降52%
Writer推出旗舰模型Palmyra X6,基于中国开源模型GLM-5.2后训练,仅用626条合成轨迹实现7440亿参数模型优化;配套新编排框架与治理工具,使AI智能体成本降52%、速度升48%,并强化令牌支出管控能力。
OpenAI发布GPT-5.6-Cyber:专为防御方优化的高完成率网络安全模型
OpenAI推出微调模型GPT-5.6-Cyber,聚焦高级漏洞研究与利用开发,在内部基准测试中完成率达95%;需通过严格审核的Daybreak Red计划获取访问权限,定价显著高于通用模型。
AI 产品做出来不再是难题之后
本文记录一场由雅芳组织、原点学堂举办的 AI 交流圆桌(Builders Table)核心共识与独识。五项共识包括:做出来已非最难事;模型退为原材料,Workflow 成产品主体;微调从默认动作变为最后选项;做产品变容易,卖产品变困难;企业真正购买的是结果而非 AI 技术本身。文中强调判断力、知识工程、分发能力与价值归因等新稀缺能力。
递归超级智能获4.1亿美元AWS算力协议,推进自我改进型AI研发
递归超级智能(Recursive Superintelligence)与AWS达成4.1亿美元算力协议,专注研发可自主实验、安全持续自我升级的AI系统。该公司估值46.5亿美元,已融资6.5亿美元,强调‘智能体数量’而非员工规模,并正联合AWS开发专用于大规模自动化AI研究的基础设施。
成为AI行业裁判的博士生们
Arena起源于加州大学伯克利分校博士生项目,七个月内成长为估值17亿美元的LLM裁判平台。其以结构性中立为原则运作,接受OpenAI、Google和Anthropic等被评方投资,同时拓展至企业级智能体与现实任务基准测试,并在法律、医疗等垂直领域专家榜上显示Claude领先。
中国 AI 真正输给美国的,从来不是算力
专家数据是中国AI追赶美国的关键,来看看中美数据产业的真实差距。 核心内容: 1. 中国AI实验室数据产业的现状与挑战 2. 追赶初期“蒸馏”策略的利弊分析 3. 建设原生数据生产体系的必要路径
淘宝直播数字人 AgenticRL 实践:从 RLVR 到 MultiAgent RL
淘宝直播如何让数字人更“聪明”?本文揭秘了从静态流程到动态Agentic架构的升级之路。 核心内容: 1. 从Workflow到Agentic架构的升级与优化 2. Agentic RL算法在业务中的工程实践 3. 针对业务挑战研发的Multi-Agent RL解决方案
AReaL 2.0 正式发布:面向 Agent 应用的 Online RL 微服务架构升级
AReaL 2.0发布,将强化学习重构为微服务,让现有Agent应用以极低成本获得持续进化能力。 核心内容: 1. 解决Agent上线后能力被“冻结”与真实交互数据无法有效学习的矛盾 2. “RL as Micro-Service”核心架构,实现训练与应用的解耦与灵活组合 3. 无需重写Agent,即可低成本接入在线强化学习闭环,推动范式转移
多轮 Agent 场景下,滴滴的 EAGLE-3 训推加速实践
滴滴在Agent场景中通过训练与推理优化,将EAGLE-3的推理速度提升2倍以上,为长序列处理带来突破。 核心内容: 1. 从Chat到Agent场景下,推理延迟被复合放大的挑战 2. 解码阶段面临的memory-bound与串行依赖瓶颈 3. 基于投机解码的EAGLE-3训推加速实践与收益
谁说 Mac 只能写代码?Google 官宣:M 芯片本地微调 Gemma 4 时代开启!
谁说Mac只能写代码?Google官方认证的社区项目让M芯片本地微调Gemma 4成为现实,开启多模态AI开发新纪元。 核心内容: 1. 突破性技术:Apple Silicon本地运行Gemma 4多模态微调 2. 实际价值:个人开发者无需云端即可实现跨模态AI应用 3. 技术原理:LoRA微调方法与MPS后端优化实现资源高效利用
ComfyUI v0.19.0 更新:大量新节点、新模型、新修复与性能优化全面落地,工作流与训练能力再升级
ComfyUI v0.19.0重磅升级,带来20+贡献者的67项提交和128个文件变更,全面提升AI工作流能力! 核心内容: 1. 新增LongCat图像编辑、Qwen3.5文本模型等7大核心功能支持 2. 覆盖图像、文本、音视频、训练等12个方向的全面优化 3. 作为Immutable release版本的系统稳定性与兼容性提升
Agent 持续学习落地路径:先做 Traces,再做 Context,最后才微调模型 | Jinqiu Select
Agent持续学习的落地路径:从Traces到Context再到模型微调,LangChain创始人Harrison Chase的三层框架为你指明方向。 核心内容: 1. Agent持续学习的三层框架解析(Model/Harness/Context) 2. 每层学习方式的适用场景与落地成本对比 3. 面向产品团队的渐进式实施路径建议
马斯克再次站台Kimi,扒掉了Cursor 500亿估值的底裤
马斯克再次出手,揭露Cursor"自研"模型实为Kimi套壳,引发行业震动。 核心内容: 1. Cursor发布"自研"模型被开发者抓包使用Kimi基座 2. 马斯克转发曝光推文引爆舆论,月之暗面团队下场质问 3. 双方最终达成表面"和解",但商业授权疑云未散
MiniMax M2.7 炸场!自己训自己,8 项基准硬刚 GPT-5 和 Opus 4.6
MiniMax M2.7实现技术突破,通过"自我训练"机制在8项基准测试中硬刚GPT-5和Opus 4.6,展现惊人实力。 核心内容: 1. M2.7在8项基准测试中与顶级AI模型的性能对比 2. "自我训练"技术原理与创新突破 3. 模型自主进化能力的具体表现
【淘宝直播数字人互动LLM】告别AI感:基于真人ASR数据的拟人化探索
淘宝直播数字人互动LLM如何告别"AI感"?揭秘基于真人ASR数据的拟人化训练方法,让AI回复更自然、口语化。 核心内容: 1. 当前数字人直播中LLM回复存在的"AI感"问题分析 2. 基于真人ASR数据的拟人化训练方法详解 3. 实验结果:在保持准确性的同时显著提升交互自然度
罕见!Meta、OpenAI、xAI联合分享了用生产环境提升LLM的最佳实践!
Meta、OpenAI、xAI联合揭秘如何通过生产环境迭代优化社交型AI,打造更具吸引力的对话体验。 核心内容: 1. 社交型AI与助手型AI的核心差异及优化挑战 2. CharacterFlywheel方法论:15代迭代的"飞轮"优化流程 3. 从数据整合到模型训练的三阶段开发架构
工具调用准确率从60%飙到95%?我用这个‘解耦微调’把Qwen-7B救活了
用解耦微调技术让Qwen-7B工具调用准确率飙升35%,Agent开发从此告别低效! 核心内容: 1. 传统LoRA方法在复杂工具调用中的局限性 2. 解耦微调三步法:拆分任务、分别训练、动态拼装 3. 实测效果:准确率从60%提升至95%的关键突破
普林斯顿大学RLAnything:AI学会一边学习一边给自己打分
普林斯顿大学突破性研究:AI学会像人类一样自我评估与学习,强化学习迎来万能升级版。 核心内容: 1. 传统AI强化学习的痛点:长程任务中反馈延迟导致学习效率低下 2. RLAnything两大创新:实时奖励模型+自我优化的解说员机制 3. 实验证明整合反馈使AI学习曲线显著提升
Agent 越用越聪明?AgentScope Java 在线训练插件来了!
AgentScope Java 在线训练插件让智能体持续进化,打破传统训练-部署分离的瓶颈,实现 Java 生态下的高效优化。 核心内容: 1. 传统 Agent 优化面临的训练-部署环境分离与 Java 生态支持缺失两大挑战 2. AgentScope Java + Trinity-RFT 在线训练方案的核心优势与特性 3. 如何实现生产环境中的实时数据闭环与持续优化










