JOTO
Contact us
← AI 智库
模型与技术专题

AI 硬件

整理AI 硬件相关的技术判断、实施方法与企业级实践,重点关注可部署性、安全性和业务价值。

相关文章

764 篇高质量内容
开源模型
开源模型
开源模型

Mistral 押注企业 AI 的核心是控制权,而非仅靠智能

Mistral AI 获35亿美元D轮融资,估值超240亿美元,聚焦主权AI:通过开源权重、区域推理与本地化算力,强化企业对数据、模型与基础设施的控制权,直面OpenAI等性能领先者的竞争。

模型训练
模型训练
模型训练

藏语ASR | 藏语语音识别 | Qwen3-ASR识别藏语

本文记录基于阿里开源Qwen3-ASR-1.7B模型微调藏语语音识别系统的完整过程,涵盖藏语数据集准备(10+小时自采)、JSONL格式转换脚本、CUDA环境配置(需≥24GB显存GPU)、分布式训练命令及效果验证。训练后模型可输出藏文文本,显著优于原始模型输出中文的失效状态。

AI 硬件
AI 硬件
AI 硬件

谷歌拟投资151亿美元建设芬兰AI基础设施

谷歌宣布未来两年在芬兰哈米纳、卡亚尼等地投资约151亿美元建设数据中心及配套清洁能源项目,涵盖核电采购与电池储能,并预计2027—2028年分阶段落地,将显著拉动GDP与就业。

AI 硬件
AI 硬件
AI 硬件

iPhone Duo来了,腾讯 Kuikly 助 App 从容适配

苹果发布折叠设备后,App 面临折叠、展开、分屏等多形态适配挑战。腾讯开源框架 Kuikly 基于 Kotlin Multiplatform,支持 Android、iOS、HarmonyOS 等六大平台,通过共享 Kotlin 层统一处理尺寸响应、状态管理与多形态布局,实现单次开发覆盖多端可变窗口场景。

AI 硬件
AI 硬件
AI 硬件

高通与亚马逊达成AI芯片重大供应协议,含600亿美元采购承诺与40亿美元认股权证

高通将为亚马逊云服务(AWS)定制AI推理芯片,并共同开发光互连系统;协议绑定亚马逊未来十年采购600亿美元服务器芯片及相关服务,同时授予其40亿美元股票认股权证。

AI 硬件
AI 硬件
AI 硬件

64万一台的英伟达 “桌面电脑” 火了,卖给了谁

英伟达DGX Station以94930美元(约64万元人民币)起售价引发关注。它并非消费级PC,而是单机集成748GB统一内存池、20 PFLOPS FP4算力的AI工作站,面向药企、银行、制造等需本地化处理敏感数据的企业客户。其核心价值在于规避公有云数据外传风险,替代高成本私有云集群。

AI 硬件
AI 硬件
AI 硬件

Agent 接管 iPhone,终于有人跑通了。

GitHub 项目 phone-harness 实现了让 Claude、Codex 等 Agent 直接操作真实 iPhone,无需越狱或 WebDriverAgent。其核心是复用苹果原生的 iPhone Mirroring 功能,通过 macOS 截图、Vision Framework OCR 识别文字坐标,再用 CGEvents 模拟输入完成点击、滑动等操作,并采用「操作→截图→再识别→确认」闭环验证结果。

AI 硬件
AI 硬件
AI 硬件

Anthropic 发布 MHS 模型硬件标准:AI 代理终于要「上手」物理世界了

2026 年 8 月 27 日,Anthropic 发布 Model Hardware Standard(MHS)研究预览,旨在为 AI 代理安全操控显微镜、机械臂、产线等实体设备提供模型无关、可开源的统一接口。MHS 与 2024 年发布的 MCP 协议形成互补:MCP 连接数字世界(数据源与 API),MHS 连接物理世界(仪器与机器),共同构成 Anthropic 的基础设施拼图。

大语言模型
大语言模型
大语言模型

刚刚,OpenAI发布GPT-6:欢迎来到AGI时代!

OpenAI正式发布GPT-6 Astra,该模型使用超10万张GPU训练,具备直接操作浏览器与专业软件的能力,任务完成率与效率显著提升;其定价转向按任务计费逻辑,推理过程监控难度增加,并首次引入上一代模型参与训练监督。Astra标志着大模型从回答问题向交付工作系统演进。

AI 硬件
AI 硬件
AI 硬件

英伟达与联发科深化合作:共建AI硬件生态,拓展中小厂商平台支持

英伟达向联发科投资35亿美元并引入NVLink Fusion平台,联合开发融合GPU与SoC的PC、开发者超算及工作站。此举旨在应对客户自研ASIC趋势,强化其在AI基础设施中间层市场的平台地位。

AI 硬件
AI 硬件
AI 硬件

AI 硬件起步指南

文章指出2026年AI硬件开发范式发生转变:AI既作为产品能力嵌入终端(如按键触发AI整理文字),也作为研发工具参与固件编写、调试与真机验证。强调硬件开发必须通过‘软件检查+真机反馈’双重验证,尤其关注物理部件实际响应;需求确认需聚焦现实限制(操作成本、注意力占用等),而非技术炫酷;统一开发板提供可复现的硬件上下文,支撑团队高效协同与AI辅助排错。

AI 硬件
AI 硬件
AI 硬件

AI基础设施热潮正超越GPU:从云到边缘的全栈扩张

英伟达Q1营收962亿美元,数据中心业务增长117%,合作延伸至CPU、网络与机器人;Z.ai启用10万国产芯片降低依赖;AI基础设施需求正由大模型训练扩展至智能体、推理、边缘AI及物理AI,CIO面临更复杂的异构架构决策。

开源模型
开源模型
开源模型

DeepSeek Harness 很强,但我想给它一个真正的项目工作台

本文介绍 Harness Workbench —— 一个为 DeepSeek Harness 构建的轻量级项目工作台。它不重写 DSH 的运行逻辑,而是通过项目归属、知识芯片、待办与定时 Agent 等机制,将零散会话组织为长期可追溯、可推进的项目工作流。核心设计原则是:DSH 负责执行,Workbench 负责组织。

大语言模型
大语言模型
大语言模型

Apache RocketMQ 面向 AI 演进:LiteTopic 支撑百万级多 Agent 会话协作

Apache RocketMQ 推出 LiteTopic 新模型,专为 AI 场景设计,解决 AI 应用在通道拓扑动态性、任务时长不可预测、GPU 成本敏感等约束下对消息系统的全新要求。其通过 Parent Topic/LiteTopic 两层结构、会话级隔离、RocksDB 索引、Ready Set 投递等机制,在 Qoder Cloud Agents 和百炼网关两个真实业务中实现了百万级会话的有序协作、故障恢复与精准限速。

AI 硬件
AI 硬件
AI 硬件

Windows 11新功能曝光!统一内存手动分配,RTX Spark最高128GB可选

Windows 11 Build 29648.1000预览版新增IntelligentCarveout功能,支持用户手动划分统一内存,专为NVIDIA RTX Spark芯片设计。RTX Spark采用Arm架构,整合20核Grace CPU、Blackwell GPU与最高128GB LPDDR5X统一内存,本地AI算力达1 PFLOPS(FP4),可运行1200亿参数大模型。首批设备预计2026年秋季上市,起售价2500美元。

AI 硬件
AI 硬件
AI 硬件

英伟达与AWS扩大合作:200万块GPU加速智能体AI与具身AI落地

英伟达与AWS宣布将在2027—2028年向其全球云基础设施新增部署200万块GPU,涵盖Blackwell Ultra、Rubin等平台,并拓展至CPU、网络、机器人及美国联邦AI工厂建设,支撑智能体AI、科学发现与具身AI规模化生产部署。

开源模型
开源模型
开源模型

GLM-5.3-Flash开源:人人都可低成本获得前沿智能

智谱发布开源模型GLM-5.3-Flash(320B-A18B),首个原生多模态GLM-5系列模型,在AA综合智能指数中获57分,能力对标Claude Opus 4.8,但定价仅为后者的1/40。其采用稀疏+线性混合注意力、流形约束超连接等架构创新,激活参数量与层数减半,并全程基于国产芯片集群实现高效推理。

多模态模型
多模态模型
多模态模型

GLM 5.3 Flash 这价格太离谱了,新的斩杀线

GLM 5.3 Flash Vision 正式发布,国产芯片支撑日均超100T算力供应;AI指数达57分,与Opus 4.8持平;限时定价为Opus 4.8的1/40,原价亦低于ds flash;采用320B参数、18B激活参数新架构,宣称实现高性能与低成本兼顾;强调原生多模态能力,支持视觉环境感知与Blender自主建模。

开源模型
开源模型
开源模型

GLM-5.3-Flash 将承担约45%的AI工作负载

Z.ai发布的开源模型GLM-5.3-Flash以极低成本(7.5美分/百万token)进入OpenRouter,智能得分57,显著优于同价位竞品。其纯国产芯片与基础设施支撑能力引发美国企业重估AI支出结构,推动三层模型编排策略落地。

AI 硬件
AI 硬件
AI 硬件

Perplexity联合英伟达推出便携式计算机:全本地运行、零Token成本的AI智能体平台

Perplexity发布Portable Computer,首款深度集成模型与代理框架的全本地AI智能体系统,首发支持Nvidia DGX Spark及RTX GPU Linux设备,敏感数据不出设备、推理零计费,兼顾隐私、成本与混合调用能力。