JOTO
Contact us
← AI 智库
模型与技术专题

大语言模型

整理大语言模型相关的技术判断、实施方法与企业级实践,重点关注可部署性、安全性和业务价值。

相关文章

6836 篇高质量内容
大语言模型
大语言模型
大语言模型

OpenAI Codex 产品经理:AI 不是让你做更快,是让你做以前不敢做的事

从AI编程工具创始人到OpenAI产品经理,揭秘Codex如何颠覆产品开发流程,让团队实现“先做一切,再决定发布什么”。 核心内容: 1. Codex如何重塑PM的工作方式与核心角色 2. 团队协作模式的根本性转变:从规划优先到“做了再说” 3. 真实案例演示:AI-native团队如何用Codex驱动日常工作

大语言模型
大语言模型
大语言模型

治理与进化,如何成为企业级 Agent 的两条生死线?

Agent治理与进化能力,决定了企业能否真正吃到AI红利。 核心内容: 1. Agent在企业应用中的根本矛盾与治理挑战 2. 主流Agent架构的演进与轻量化趋势 3. 基础设施层如何支撑Agent的治理与进化

大语言模型
大语言模型
大语言模型

腾讯混元 Hy3,正式发布

腾讯混元Hy3正式发布,在软件开发、办公生产等核心场景中表现显著提升,成为企业级AI应用的新标杆。 核心内容: 1. Hy3模型在生产力任务上的全面进步 2. 已接入腾讯核心业务并获海量真实场景验证 3. 智能体(Agent)实用性实现质的飞跃

大语言模型
大语言模型
大语言模型

我拿到了微信Agent的灰测!!感觉又要被取代了

微信Agent小微灰度内测体验,它如何无缝融入你的日常,又悄悄改变工作方式? 核心内容: 1. 小微的核心能力与交互设计:消息发送确认、场景化上下文读取 2. 作为个人助手:管理日程、总结朋友圈、打通公众号与视频号 3. 未来潜力:用自然语言创建小程序,大幅降低应用开发门槛

大语言模型
大语言模型
大语言模型

循环工程:Karpathy方法——以及使其效率提升 5 倍的工作流程

这篇文章揭示了Karpathy如何通过分离评估与执行,将AI工程效率提升5倍,为构建可靠的自动化系统提供了硬核思路。 核心内容: 1. 循环工程与连续追问的本质区别 2. Karpathy Loop的核心:评估器与执行器分离 3. 实现高效自动化的关键约束与适用场景

大语言模型
大语言模型
大语言模型

手机端 Agent 评测:从方法论到工程实践

揭秘手机端 Agent 评测的实战经验,从评测体系搭建到工程化落地,带你深入了解如何量化与提升 Agent 的真实操作能力。 核心内容: 1. 手机端 Agent 评测的五大核心能力与评测集设计原则 2. 保障评测准确性的关键技术:环境隔离与数据标准化 3. 基于结构化语法的真值标注方法与实际效果提升数据

大语言模型
大语言模型
大语言模型

Hermes 的记忆层有 8 种实现,我为什么选了最反常识的那个

Hermes Agent 记忆层有 8 种实现,作者为何独爱最反常识的 Holographic 方案?本文带你一探究竟。 核心内容: 1. Hermes 记忆层八种方案的对比与排序逻辑 2. 三种存储范式背后的哲学差异 3. Holographic 方案的优势与选择理由

大语言模型
大语言模型
大语言模型

Codex 负责人谈 AI 时代唯一值钱的能力

OpenAI Codex负责人揭示AI时代最稀缺的能力:当实现变得免费,决定“该做什么”成为核心价值。 核心内容: 1. Codex的广泛应用与设计流程的失效 2. 为什么AI难以做好设计工作 3. 在AI时代,如何定义“好设计”与关键能力

大语言模型
大语言模型
大语言模型

复旦期末考「造反」了:51名学生联手围攻Claude、DeepSeek,谁能让AI交白卷谁就是学霸

复旦期末考“造反”了!学生化身出题官,联手挑战三大AI模型,谁能让Claude、DeepSeek答错题,谁就是学霸。 核心内容: 1. 颠覆传统的考试规则:学生出题,AI答题 2. 挑战AI的实战过程与评分机制 3. 考试结果揭示AI的鲁棒性与人类智慧的较量

大语言模型
大语言模型
大语言模型

Cursor 如何把 AI 部署进企业内部

深入企业AI落地,Cursor如何通过前线部署工程师将AI能力融入真实业务,构建AI软件工厂。核心内容: 1. 前线部署工程师在企业AI落地中的关键角色 2. 从个人AI助手到重构软件开发流程的转变 3. 构建AI软件工厂的实践经验与挑战

大语言模型
大语言模型
大语言模型

开发者转向 AI 应用工程,真正要迁移的是工程判断力

开发者不必转算法岗,真正需要的是将软件工程经验迁移到AI应用开发中,解决模型不确定性带来的工程挑战。 核心内容: 1. AI应用开发中的常见工程问题 2. 传统软件工程经验如何迁移 3. 开发者转向AI应用工程的核心能力

大语言模型
大语言模型
大语言模型

不改一行代码,看透 AI Agent 的每一次调用

如何在不改动代码的情况下,精准洞察AI Agent的每一次复杂调用?OBI方案在Linux内核层安装“监控摄像头”,自动追踪跨协议、跨服务商的完整链路。 核心内容: 1. AI Agent调用链路的复杂性及传统监控的局限 2. OBI方案无侵入式追踪的核心原理 3. 标准化监控(GenAI语义约定)面临的现实挑战

大语言模型
大语言模型
大语言模型

AI 不缺智商缺纪律:一场 Harness 工程化实践

AI编码的瓶颈已从模型智商转向工程纪律,本文分享一套可复用的Harness框架,帮你用工程化手段解决AI的“不守纪律”问题。 核心内容: 1. Harness框架的设计理念与三层结构解析 2. 针对AI编码三大痛点的具体工程解决方案 3. 实践中的关键踩坑教训与可迁移的工程化模式

大语言模型
大语言模型
大语言模型

天工 3.2 重磅升级:Skywork Tags 上线,给 Agent 一张工牌,邀其加入你的工作群聊

Skywork Tags将AI直接带入你的工作群聊,让它成为团队里常驻的同事,无缝参与日常讨论。 核心内容: 1. Skywork Tags如何将Agent融入现有工作环境,免去迁移上下文的繁琐 2. 共享AI助手带来的团队协作透明化、任务可接力与持续学习优势 3. 团队内部实践验证了这种“AI同事”模式的有效性与价值

大语言模型
大语言模型
大语言模型

Context Infra 会是 AI 领域的下一个热点

AI Infra 正从模型层转向Agent与Context层,这是AI从问答走向任务执行的关键跃迁。 核心内容: 1. 从LLM Infra到Agent Infra的演进逻辑 2. Agent Infra三大构成:LLM、Harness与Context 3. Context Infra作为新热点的核心价值与市场前景

大语言模型
大语言模型
大语言模型

一文了解|SkillScan 智能体技能安全扫描最佳实践

SkillScan为智能体技能生态提供全链路安全防护,从包体合规到代码实现,全面覆盖技能生命周期中的五大风险维度。 核心内容: 1. 技能安全面临的五大类核心风险全景 2. SkillScan全链路安全检测体系与能力详解 3. 业务接入、场景实践与开发者安全规范指南

大语言模型
大语言模型
大语言模型

港科大郭毅可谈Agentic AI时代的核心命题:人机共生,人不可能退场

AI 从回答问题走向真正执行,人机共生的责任分配成为核心议题。香港科大郭毅可院士深入解析 Agentic AI 的演进方向与破局关键。 核心内容: 1. 人机共生:可控自治与责任分配 2. Agentic AI 的四个演进方向 3. 给企业的建议:将 AI 变为制度化能力

大语言模型
大语言模型
大语言模型

Sonnet 5终于来了,然而Opus 4.8现在有点尴尬

Sonnet 5以更优成本实现接近顶级模型Opus 4.8的性能,AI助手竞争进入新阶段。 核心内容: 1. Sonnet 5性能与成本优势解析 2. 模型能力升级与安全特性增强 3. 行业竞争格局与用户策略影响

大语言模型
大语言模型
大语言模型

AI可观测性:Prompt、Tool Call、Trace、Token全链路追踪

AI系统为何时好时坏?从Prompt到Tool Call的全链路追踪,帮你精准定位问题,告别昂贵黑盒。 核心内容: 1. AI系统监控的四大核心维度:Prompt、Tool Call、Trace、Token 2. Prompt追踪的重要性与实现方法,实现问题精确定位 3. 传统监控与AI可观测性的本质区别,构建完整监控体系

大语言模型
大语言模型
大语言模型

AI Infra 全景图:Agent Framework、调度、编排、沙箱、记忆管理、Tracing 分层拆解

2026年,AI Agent遍地开花,但真正能投入生产的却寥寥无几。本文将为你揭示从底层资源到上层应用的9层架构全景与4个横切能力,助你构建坚如磐石的生产级AI Infra。 核心内容: 1. 剖析AI Agent项目难以投入生产的核心症结——Infra缺失 2. 逐层拆解从基础资源到可观测运营的9层纵向架构 3. 解读贯穿所有层的4大横切能力:安全、CI/CD、成本与开发者体验