JOTO
联系我们
← AI 智库
模型与技术专题

AI 硬件

整理AI 硬件相关的技术判断、实施方法与企业级实践,重点关注可部署性、安全性和业务价值。

相关文章

733 篇高质量内容
AI 硬件
AI 硬件
AI 硬件

《Pi Agent + DeepSeek 深度优化》

作者基于两台懒猫AI算力舱本地部署Pi Agent与DeepSeek模型,完成三项关键优化:将上下文长度从131K提升至328K以充分利用显存;默认启用DeepSeek思考模式(--reasoning-parser)与自动工具调用(--enable-auto-tool-choice);实测吞吐达每秒60 tokens,24小时满负荷运行成本为1.9元。

AI 硬件
AI 硬件
AI 硬件

VentureBeat 首设首席分析师,聚焦企业级AI基础设施与智能体工程落地

Rob Strechay 加入 VentureBeat 担任首位首席分析师,专注云基础设施、GPU利用率、多供应商智能体编排及AI安全治理等实操议题,通过VB Pulse调研与VB对话栏目提供深度技术洞察。

AI 硬件
AI 硬件
AI 硬件

英伟达牵头融资1050亿美元共建OpenAI俄亥俄数据中心

英伟达承诺为OpenAI在俄亥俄州PORTS-Pike园区建设的AI数据中心提供1050亿美元融资,独家供应GPU等全栈硬件,首期支持4.25吉瓦算力,2028年起分批上线。项目将创造3.5万个建筑岗位,并配套10吉瓦能源设施。

AI 硬件
AI 硬件
AI 硬件

AI办公大战,最可能的赢家会是谁?

本文分析腾讯、字节、阿里、百度四家公司在AI办公领域的竞争格局,指出胜负关键不在对话能力或硬件数量,而在于能否打通“组织内数据”与“组织外现实上下文”的完整链路。软件提供身份、权限与执行接口,硬件承担现实信号采集,二者协同构成五层办公AI链路:采集、记忆、业务语义、执行权限、结果回流。

开源模型
开源模型
开源模型

顶级 AI,一张显卡就能跑;不堆参数冲进世界第一。中国开源模型杀疯了!

本文对比分析智谱 GLM-5.3(743B 参数)与阿里 Qwen3.8-27B(27B 参数)两大开源模型:前者通过深度后训练在 Coding、Agent 和网络安全能力上实现跃升,多项测试达开源第一;后者以极小体积实现旗舰级性能,支持单卡消费级 GPU 部署。二者分别代表“向上突破能力上限”与“向下降低应用门槛”的双轨路径,共同重塑开源 AI 发展范式。

AI 硬件
AI 硬件
AI 硬件

华尔街入局AI基建:资本、电力与原材料成新竞争焦点

英伟达联合六大金融机构撬动超5000亿美元投向AI基础设施,推动其成为可投资资产类别;同时,电力供应、光纤连接、铜锂等关键资源瓶颈凸显,表明AI基建已超越GPU竞争,进入物理层资源争夺阶段。

AI 硬件
AI 硬件
AI 硬件

DeepSeek Harness上线:把它用在 AIOps,可能更有意思

DeepSeek开源Agent框架DeepSeek Harness(DSH)提出'Everything is a Plugin'理念,将模型、工具、会话、沙箱、审批等能力全部插件化。文章指出其Tool Execution Pipeline、Subagent+Workflow架构及插件化设计特别适配AIOps场景,可构建标准化运维能力插件体系,并支持策略层介入、多领域专家协同与闭环验证。

开源模型
开源模型
开源模型

微软开源“1.58-bit”语音识别:不用GPU,普通CPU实时转录,比Whisper快2倍

微软研究院于2026年7月23日开源VibeVoice-ASR-BitNet模型,采用1.58-bit三值量化({-1,0,+1}),模型体积压缩至1.58GB,在普通CPU上仅需3个线程即可实现实时转录(RTF<1)。官方实测显示其速度比同尺寸Whisper.cpp快1.55–2.28倍,且在英语多语种及会议场景的准确率反超Whisper large-v3;支持7种语言,MIT协议可商用。

AI 硬件
AI 硬件
AI 硬件

AIOps落地:告警降噪到底怎么做?我落地了一套方案

本文提出告警降噪“四板斧”方案:第一板斧是写对PromQL与阈值,强调平滑、for分级和相对阈值;第二板斧用Alertmanager分组与抑制规则收敛告警;第三板斧通过标签建依赖实现上下游事件聚合;第四板斧才引入AI聚类,仅处理critical级别告警,依赖标签上下文与结构化system prompt输出根因判断与处置建议。

AI 硬件
AI 硬件
AI 硬件

Mistral 计划2030年前在欧洲建成1吉瓦AI算力容量

法国AI公司Mistral宣布到2030年在欧洲建设1吉瓦算力容量,以强化人工智能主权。新举措包括区域推理端点、支持第三方开源模型(如GLM-5.2)、推出‘欧洲算力单元’联盟,并已获ASML、CMA CGM、Amadeus等企业加入。

AI 硬件
AI 硬件
AI 硬件

英伟达联合六大华尔街巨头筹建5000亿美元AI基础设施融资平台

英伟达携手阿波罗、贝莱德、黑石等六家顶级金融机构,共建独立融资平台,为AI客户(含前沿实验室、企业及云服务商)提供专属资金池,支持基于英伟达硬件的数据中心建设与‘AI工厂’落地,首次将AI硬件与算力基础设施定义为可投资资产类别。

AI 硬件
AI 硬件
AI 硬件

Mistral AI 计划2030年前在欧洲建成1吉瓦AI算力,并以五年期不可退出合同锁定客户

Mistral AI宣布扩展基础设施业务,推出区域性推理端点、优先服务层级及欧洲算力单元(ECU)机制,联合Amadeus、ASML等企业共建1吉瓦欧洲AI算力,目标2030年落地。其模式将主权AI转化为可签约、可计量、可审计的基础设施服务。

AI 硬件
AI 硬件
AI 硬件

AIOps智能体落地案例集

这套AIOps智能体落地案例集是我大模型课程里AIOps章节中的10个案例,现在单独把它拆出来售卖! 虽然只有10个小案例,但价值巨大! 注意: 1)已经买过我大模型课程的同学不用下单,因为课程里已经包含了。 2)这是一个图文教程,不是视频

AI 硬件
AI 硬件
AI 硬件

SpaceX与特斯拉联合投资168亿美元建设德州Terafab芯片工厂

SpaceX与特斯拉将在德克萨斯州格里姆斯县共建Terafab芯片制造综合体,首期投资168亿美元,规划面积超1亿平方英尺,专注研发封装测试先进逻辑与存储芯片,支撑Optimus机器人、Cybercab及天基数据中心等AI硬件需求。

开源模型
开源模型
开源模型

无云无GPU亦可运行:Liquid AI发布可在树莓派部署的26亿参数代理型语言模型LFM2.5-2.6B

Liquid AI发布开源模型LFM2.5-2.6B,仅26亿参数、支持128K上下文,专为工具调用与本地代理任务优化,可在树莓派等极简硬件上纯CPU运行,无需云端或GPU,兼顾低延迟、高隐私与低成本。

AI 硬件
AI 硬件
AI 硬件

GitHub 开源 MimiClaw:5.6k Star,$5 的 ESP32 芯片跑完整 AI 助手——没有 Linux,全用 C 写的

MimiClaw 是一个获 5.6k Star 的开源项目,将完整 ReAct 智能体系统(含记忆、工具调用、定时任务)部署在 ESP32-S3 芯片上,双核 FreeRTOS 全用纯 C 实现,无需 Linux 或云服务器。系统通过 Telegram 交互,依赖 Anthropic/OpenAI API,本地持久化使用四份 Markdown 文件存于 Flash,支持运行时串口配置修改。

大语言模型
大语言模型
大语言模型

直降80%!OpenAI被逼调价,国产大模型凭三样硬实力让硅谷低头

2026年7月30日,OpenAI将GPT-5.6 Luna输入/输出单价同步下调80%,系受国产模型全球调用量连续14周超美国闭源模型(占比63.5%)所迫。DeepSeek V4-Flash等国产模型通过底层工程优化(算力压缩至27%)、全面开放权重、缓存阶梯定价三大能力,实现成本优势与生态控制力双重突破。

AI 硬件
AI 硬件
AI 硬件

不用跳出聊天框,长按键盘就能让AI直接干活了

Acti 是一款集成 AI 执行能力的手机输入法,用户长按空格键即可在当前聊天界面中查资料、找 Notion 文件、创建会议链接等。它由前百度国际团队开发,已连接 Gmail、Slack、Notion 等六类应用,调用超 150 个 API。产品经历从 Type BongoX(主题键盘)到 TypeX(游戏化盲盒)再到 Acti(意图驱动执行)的三次迭代,核心是将用户输入文字直接转化为可执行动作。

AI 硬件
AI 硬件
AI 硬件

伏尔塔基建公司宣布在挪威建设100亿美元AI工厂

新成立的AI基础设施初创公司伏尔塔基建宣布与未具名AI实验室及比特鹿合作,在挪威建设133兆瓦、由英伟达Vera Rubin硬件驱动的AI工厂,首期投资100亿美元,并获阿佐拉50亿美元融资支持。

AI 硬件
AI 硬件
AI 硬件

美国商务部拨款3亿美元支持GlobalFoundries硅光子学研发

美国商务部向GlobalFoundries提供3亿美元资金,用于开发下一代硅光子学晶圆技术、新型光学材料及3D混合键合等先进封装技术,以支撑AI数据中心高带宽、低功耗互连需求,并换取其约1%股权。