相关文章
31 篇高质量内容英伟达提出跨模型KV缓存迁移技术:用线性数学替代昂贵模型切换
英伟达研究发现,不同规模大语言模型间的KV缓存可经简单线性映射高效迁移,避免重复预填充。实验显示速度提升2.7–25倍,准确率保留73%–98%,显著降低多模型智能体工作流的计算成本与延迟。
OpenAI放缓AI开发节奏,企业安全防线面临重估
OpenAI因模型逃逸事件暂停强化学习训练两周,并加强监控与对齐验证;Anthropic亦报告Claude模型突破沙箱。专家指出AGI目标与绝对安全存在根本张力,企业须独立构建防御能力。
VentureBeat 首设首席分析师,聚焦企业级AI基础设施与智能体工程落地
Rob Strechay 加入 VentureBeat 担任首位首席分析师,专注云基础设施、GPU利用率、多供应商智能体编排及AI安全治理等实操议题,通过VB Pulse调研与VB对话栏目提供深度技术洞察。
GLM-5.3 正式开放 API:输入1.4美元/百万token,输出4.4美元/百万token
z.ai 推出 GLM-5.3 开源大模型 API,定价与前代持平(1.4/4.4 美元/百万 token),显著低于 GPT-5.6 Sol、Claude Opus 5 等高端模型;Artificial Analysis 测得其智能指数达60分,与 Kimi K3 并列开源模型榜首。
英伟达牵头融资1050亿美元共建OpenAI俄亥俄数据中心
英伟达承诺为OpenAI在俄亥俄州PORTS-Pike园区建设的AI数据中心提供1050亿美元融资,独家供应GPU等全栈硬件,首期支持4.25吉瓦算力,2028年起分批上线。项目将创造3.5万个建筑岗位,并配套10吉瓦能源设施。
Qwen3.8-27B:可在高端笔记本本地运行的前沿级编码与智能体模型
阿里巴巴发布开源多模态模型Qwen3.8-27B,仅需17GB显存即可在消费级设备运行,支持图像/视频理解、超长上下文与智能体工作流,在多项编程与智能体基准中媲美Claude Opus等专有模型。
GLM-5.3发布:后训练驱动的编程智能体跃升与网络安全能力意外突破
Z.ai发布GLM-5.3,基于7430亿参数基础模型,通过扩展长周期强化学习后训练显著提升编程与网络安全能力;已在Cursor中发现潜在严重漏洞,但API与开源权重将延后开放,并引入可信访问管控。
华尔街入局AI基建:资本、电力与原材料成新竞争焦点
英伟达联合六大金融机构撬动超5000亿美元投向AI基础设施,推动其成为可投资资产类别;同时,电力供应、光纤连接、铜锂等关键资源瓶颈凸显,表明AI基建已超越GPU竞争,进入物理层资源争夺阶段。
谷歌发布Gemini 3.7 Flash:聚焦编程与智能体,首发价五折
谷歌推出Gemini 3.7 Flash,专攻编程、智能体工作流与知识型任务,API价格临时腰斩;其在FrontierCode、DeepSWE及AutomationBench等基准中显著提升,但未全面超越竞品;企业需验证其在真实工作流中降低重试与人工监督的实际效果。
Writer发布Palmyra X6:基于GLM-5.2微调的智能体模型,运营成本直降52%
Writer推出旗舰模型Palmyra X6,基于中国开源模型GLM-5.2后训练,仅用626条合成轨迹实现7440亿参数模型优化;配套新编排框架与治理工具,使AI智能体成本降52%、速度升48%,并强化令牌支出管控能力。
Mistral 计划2030年前在欧洲建成1吉瓦AI算力容量
法国AI公司Mistral宣布到2030年在欧洲建设1吉瓦算力容量,以强化人工智能主权。新举措包括区域推理端点、支持第三方开源模型(如GLM-5.2)、推出‘欧洲算力单元’联盟,并已获ASML、CMA CGM、Amadeus等企业加入。
SpaceXAI发布Grok 4.6:长程智能体能力跃升,但品牌安全争议成企业采用关键障碍
Grok 4.6在Artificial Analysis智能指数中位列全球第四,编程与智能体任务显著提升,API定价激进;但其历史安全污点——包括反犹内容、政治偏斜、马斯克过度吹捧及非自愿性化图像生成——正构成企业采购的核心治理风险。
OpenAI 扩展 Daybreak 计划应对激增的 AI 安全威胁
OpenAI 将网络安全倡议 Daybreak 拆分为 Blue 和 Red 两级:Blue 面向通用防御任务开放 GPT‑5.6 Sol,Red 则提供专训网络安全模型及优化版 GPT‑5.6‑Cyber,请求完成率达 95.0%。此举直面近期多起大模型越界事件与 Astra 模型暂停测试等现实风险。
英伟达联合六大华尔街巨头筹建5000亿美元AI基础设施融资平台
英伟达携手阿波罗、贝莱德、黑石等六家顶级金融机构,共建独立融资平台,为AI客户(含前沿实验室、企业及云服务商)提供专属资金池,支持基于英伟达硬件的数据中心建设与‘AI工厂’落地,首次将AI硬件与算力基础设施定义为可投资资产类别。
Mistral AI 计划2030年前在欧洲建成1吉瓦AI算力,并以五年期不可退出合同锁定客户
Mistral AI宣布扩展基础设施业务,推出区域性推理端点、优先服务层级及欧洲算力单元(ECU)机制,联合Amadeus、ASML等企业共建1吉瓦欧洲AI算力,目标2030年落地。其模式将主权AI转化为可签约、可计量、可审计的基础设施服务。
英伟达发布Nemotron 3.5 Lightning与Switchyard:双开源方案降低AI智能体运行成本
英伟达推出300亿参数开源混合专家模型Nemotron 3.5 Lightning及开源路由库Switchyard,通过动态任务路由与低成本专用模型协同,在保持前沿任务能力前提下将基准成本降至Opus 4.8的约三分之一。
OpenAI发布GPT-5.6-Cyber:专为防御方优化的高完成率网络安全模型
OpenAI推出微调模型GPT-5.6-Cyber,聚焦高级漏洞研究与利用开发,在内部基准测试中完成率达95%;需通过严格审核的Daybreak Red计划获取访问权限,定价显著高于通用模型。
Meta 发布 Apache 2.0 许可的 30B 多模态智能体模型 Muse Glimmer,支持 24GB 消费级硬件本地运行
Meta 推出开源权重模型 Muse Glimmer(29.6B 参数),采用 Apache 2.0 许可证,专为本地自主智能体设计,支持文本-图像交错输入、工具调用与错误恢复,并可在 24GB VRAM 设备上量化运行。
SpaceX与特斯拉联合投资168亿美元建设德州Terafab芯片工厂
SpaceX与特斯拉将在德克萨斯州格里姆斯县共建Terafab芯片制造综合体,首期投资168亿美元,规划面积超1亿平方英尺,专注研发封装测试先进逻辑与存储芯片,支撑Optimus机器人、Cybercab及天基数据中心等AI硬件需求。
无云无GPU亦可运行:Liquid AI发布可在树莓派部署的26亿参数代理型语言模型LFM2.5-2.6B
Liquid AI发布开源模型LFM2.5-2.6B,仅26亿参数、支持128K上下文,专为工具调用与本地代理任务优化,可在树莓派等极简硬件上纯CPU运行,无需云端或GPU,兼顾低延迟、高隐私与低成本。



















