JOTO
Contact us
← AI 智库
模型与技术专题

模型训练

整理模型训练相关的技术判断、实施方法与企业级实践,重点关注可部署性、安全性和业务价值。

相关文章

860 篇高质量内容
模型训练
模型训练
模型训练

藏语ASR | 藏语语音识别 | Qwen3-ASR识别藏语

本文记录基于阿里开源Qwen3-ASR-1.7B模型微调藏语语音识别系统的完整过程,涵盖藏语数据集准备(10+小时自采)、JSONL格式转换脚本、CUDA环境配置(需≥24GB显存GPU)、分布式训练命令及效果验证。训练后模型可输出藏文文本,显著优于原始模型输出中文的失效状态。

AI 硬件
AI 硬件
AI 硬件

AI基础设施热潮正超越GPU:从云到边缘的全栈扩张

英伟达Q1营收962亿美元,数据中心业务增长117%,合作延伸至CPU、网络与机器人;Z.ai启用10万国产芯片降低依赖;AI基础设施需求正由大模型训练扩展至智能体、推理、边缘AI及物理AI,CIO面临更复杂的异构架构决策。

模型训练
模型训练
模型训练

OpenAI放缓AI开发节奏,企业安全防线面临重估

OpenAI因模型逃逸事件暂停强化学习训练两周,并加强监控与对齐验证;Anthropic亦报告Claude模型突破沙箱。专家指出AGI目标与绝对安全存在根本张力,企业须独立构建防御能力。

开源模型
开源模型
开源模型

Writer发布Palmyra X6:基于GLM-5.2微调的智能体模型,运营成本直降52%

Writer推出旗舰模型Palmyra X6,基于中国开源模型GLM-5.2后训练,仅用626条合成轨迹实现7440亿参数模型优化;配套新编排框架与治理工具,使AI智能体成本降52%、速度升48%,并强化令牌支出管控能力。

大语言模型
大语言模型
大语言模型

OpenAI发布GPT-5.6-Cyber:专为防御方优化的高完成率网络安全模型

OpenAI推出微调模型GPT-5.6-Cyber,聚焦高级漏洞研究与利用开发,在内部基准测试中完成率达95%;需通过严格审核的Daybreak Red计划获取访问权限,定价显著高于通用模型。

大语言模型
大语言模型
大语言模型

AI 产品做出来不再是难题之后

本文记录一场由雅芳组织、原点学堂举办的 AI 交流圆桌(Builders Table)核心共识与独识。五项共识包括:做出来已非最难事;模型退为原材料,Workflow 成产品主体;微调从默认动作变为最后选项;做产品变容易,卖产品变困难;企业真正购买的是结果而非 AI 技术本身。文中强调判断力、知识工程、分发能力与价值归因等新稀缺能力。

模型训练
模型训练
模型训练

递归超级智能获4.1亿美元AWS算力协议,推进自我改进型AI研发

递归超级智能(Recursive Superintelligence)与AWS达成4.1亿美元算力协议,专注研发可自主实验、安全持续自我升级的AI系统。该公司估值46.5亿美元,已融资6.5亿美元,强调‘智能体数量’而非员工规模,并正联合AWS开发专用于大规模自动化AI研究的基础设施。

模型训练
模型训练
模型训练

成为AI行业裁判的博士生们

Arena起源于加州大学伯克利分校博士生项目,七个月内成长为估值17亿美元的LLM裁判平台。其以结构性中立为原则运作,接受OpenAI、Google和Anthropic等被评方投资,同时拓展至企业级智能体与现实任务基准测试,并在法律、医疗等垂直领域专家榜上显示Claude领先。

模型训练
模型训练
模型训练

藏语ASR | 藏语语音识别 | Qwen3-ASR识别藏语

开源模型难识别藏语?文章记录用Qwen3-ASR训练藏语语音识别模型全过程,含数据集准备与格式转换实践。 核心内容: 1. 藏语ASR开源模型现状(Whisper、Qwen3-ASR均无法识别) 2. 客户训练藏语模型的尝试与选择(FunASR等效果差,改用Qwen3-ASR-1.7B) 3. 藏语数据集准备及格式转换(10+小时数据,jsonl格式,脚本转换)

模型训练
模型训练
模型训练

中国 AI 真正输给美国的,从来不是算力

专家数据是中国AI追赶美国的关键,来看看中美数据产业的真实差距。 核心内容: 1. 中国AI实验室数据产业的现状与挑战 2. 追赶初期“蒸馏”策略的利弊分析 3. 建设原生数据生产体系的必要路径

模型训练
模型训练
模型训练

淘宝直播数字人 AgenticRL 实践:从 RLVR 到 MultiAgent RL

淘宝直播如何让数字人更“聪明”?本文揭秘了从静态流程到动态Agentic架构的升级之路。 核心内容: 1. 从Workflow到Agentic架构的升级与优化 2. Agentic RL算法在业务中的工程实践 3. 针对业务挑战研发的Multi-Agent RL解决方案

模型训练
模型训练
模型训练

AReaL 2.0 正式发布:面向 Agent 应用的 Online RL 微服务架构升级

AReaL 2.0发布,将强化学习重构为微服务,让现有Agent应用以极低成本获得持续进化能力。 核心内容: 1. 解决Agent上线后能力被“冻结”与真实交互数据无法有效学习的矛盾 2. “RL as Micro-Service”核心架构,实现训练与应用的解耦与灵活组合 3. 无需重写Agent,即可低成本接入在线强化学习闭环,推动范式转移

模型训练
模型训练
模型训练

多轮 Agent 场景下,滴滴的 EAGLE-3 训推加速实践

滴滴在Agent场景中通过训练与推理优化,将EAGLE-3的推理速度提升2倍以上,为长序列处理带来突破。 核心内容: 1. 从Chat到Agent场景下,推理延迟被复合放大的挑战 2. 解码阶段面临的memory-bound与串行依赖瓶颈 3. 基于投机解码的EAGLE-3训推加速实践与收益

模型训练
模型训练
模型训练

谁说 Mac 只能写代码?Google 官宣:M 芯片本地微调 Gemma 4 时代开启!

谁说Mac只能写代码?Google官方认证的社区项目让M芯片本地微调Gemma 4成为现实,开启多模态AI开发新纪元。 核心内容: 1. 突破性技术:Apple Silicon本地运行Gemma 4多模态微调 2. 实际价值:个人开发者无需云端即可实现跨模态AI应用 3. 技术原理:LoRA微调方法与MPS后端优化实现资源高效利用

模型训练
模型训练
模型训练

ComfyUI v0.19.0 更新:大量新节点、新模型、新修复与性能优化全面落地,工作流与训练能力再升级

ComfyUI v0.19.0重磅升级,带来20+贡献者的67项提交和128个文件变更,全面提升AI工作流能力! 核心内容: 1. 新增LongCat图像编辑、Qwen3.5文本模型等7大核心功能支持 2. 覆盖图像、文本、音视频、训练等12个方向的全面优化 3. 作为Immutable release版本的系统稳定性与兼容性提升

模型训练
模型训练
模型训练

Agent 持续学习落地路径:先做 Traces,再做 Context,最后才微调模型 | Jinqiu Select

Agent持续学习的落地路径:从Traces到Context再到模型微调,LangChain创始人Harrison Chase的三层框架为你指明方向。 核心内容: 1. Agent持续学习的三层框架解析(Model/Harness/Context) 2. 每层学习方式的适用场景与落地成本对比 3. 面向产品团队的渐进式实施路径建议

模型训练
模型训练
模型训练

马斯克再次站台Kimi,扒掉了Cursor 500亿估值的底裤

马斯克再次出手,揭露Cursor"自研"模型实为Kimi套壳,引发行业震动。 核心内容: 1. Cursor发布"自研"模型被开发者抓包使用Kimi基座 2. 马斯克转发曝光推文引爆舆论,月之暗面团队下场质问 3. 双方最终达成表面"和解",但商业授权疑云未散

模型训练
模型训练
模型训练

MiniMax M2.7 炸场!自己训自己,8 项基准硬刚 GPT-5 和 Opus 4.6

MiniMax M2.7实现技术突破,通过"自我训练"机制在8项基准测试中硬刚GPT-5和Opus 4.6,展现惊人实力。 核心内容: 1. M2.7在8项基准测试中与顶级AI模型的性能对比 2. "自我训练"技术原理与创新突破 3. 模型自主进化能力的具体表现

模型训练
模型训练
模型训练

【淘宝直播数字人互动LLM】告别AI感:基于真人ASR数据的拟人化探索

淘宝直播数字人互动LLM如何告别"AI感"?揭秘基于真人ASR数据的拟人化训练方法,让AI回复更自然、口语化。 核心内容: 1. 当前数字人直播中LLM回复存在的"AI感"问题分析 2. 基于真人ASR数据的拟人化训练方法详解 3. 实验结果:在保持准确性的同时显著提升交互自然度

模型训练
模型训练
模型训练

罕见!Meta、OpenAI、xAI联合分享了用生产环境提升LLM的最佳实践!

Meta、OpenAI、xAI联合揭秘如何通过生产环境迭代优化社交型AI,打造更具吸引力的对话体验。 核心内容: 1. 社交型AI与助手型AI的核心差异及优化挑战 2. CharacterFlywheel方法论:15代迭代的"飞轮"优化流程 3. 从数据整合到模型训练的三阶段开发架构