JOTO
Contact us
← AI 智库
模型与技术专题

大语言模型

整理大语言模型相关的技术判断、实施方法与企业级实践,重点关注可部署性、安全性和业务价值。

相关文章

6844 篇高质量内容
大语言模型
大语言模型
大语言模型

认知重建之后,步入Agentic Engineering的工程革命

从Vibe Coding到Agentic Engineering,作者用实战经验告诉你AI辅助开发的真实进化路径。 核心内容: 1. 从Karpathy的推文到Agentic Engineering概念的诞生 2. 一个AGENTS.md文件如何成长为完整的工程体系 3. 多Agent协同在代码审查和运营活动中的实际应用

大语言模型
大语言模型
大语言模型

Claude Code之父独家分享:15个最喜欢、但经常被忽略的CC功能

Claude Code之父Boris亲自揭秘15个高频使用的隐藏功能,助你提升开发效率! 核心内容: 1. 跨平台无缝切换与远程控制功能 2. 自动化任务与生命周期钩子的高级用法 3. 前端开发与Web服务测试的最佳实践

大语言模型
大语言模型
大语言模型

Anthropic史上最大训练曝光,Ilya错了?CEO哀嚎:创业公司将被毁灭

Anthropic或已完成史上最大规模训练,新模型性能翻倍碾压Scaling Law,创业公司恐遭降维打击! 核心内容: 1. Anthropic新模型Mythos性能超预期2倍,或实现逻辑推理能力代际跨越 2. 模型具备强大的网络攻防能力,可能引发前所未有的安全风险 3. 行业格局面临颠覆,算力和能源成为决定性因素

大语言模型
大语言模型
大语言模型

腾讯汤道生:AI落地不只是算法题,Harness工程能力是关键变量

腾讯汤道生揭秘AI落地关键:工程能力才是决胜点,看腾讯如何用"脚手架"释放大模型潜力。 核心内容: 1. 腾讯"龙虾特攻队"快速响应市场的成功案例解析 2. 混元3.0大模型在Agent能力上的重大突破 3. 腾讯云智能体开发平台ADP的创新工程架构设计

大语言模型
大语言模型
大语言模型

Harness:AI 从 “能做” 到 “稳做” 的系统层革命!

Harness 技术正在重新定义 AI 系统的稳定性,让不可预测的 AI 行为成为过去式。 核心内容: 1. AI 落地面临的核心痛点与执行不稳定问题 2. Harness 实现 AI 行为约束的三大关键转变 3. Mynora.ai 项目的成功实践验证 Harness 价值

大语言模型
大语言模型
大语言模型

Claude Code开启团战模式!你必须要用起来的Agent teams!

Claude Code的Agent Teams功能让多个AI代理协同工作,效率翻倍!体验过的人都说"很爽!很爽!很爽!" 核心内容: 1. Agent Teams的安装与启用方法 2. Agent Teams与Subagents的核心区别与适用场景 3. 四大最佳实践用例详解

大语言模型
大语言模型
大语言模型

最强Claude意外泄露!完胜Opus 4.6,代号「卡皮巴拉」,奥特曼又要睡不着了

Claude Mythos意外曝光,性能碾压Opus 4.6,AI领域或将迎来新一轮洗牌! 核心内容: 1. Mythos模型意外泄露,性能远超现有最强Opus 4.6 2. 在编程、学术推理和网络安全三大领域实现突破性进展 3. Anthropic内部评估称其为"质的飞跃",预示AI新浪潮

大语言模型
大语言模型
大语言模型

Tair 短期记忆架构实践:淘宝闪购 AI Agent 的秒级响应记忆系统

淘宝闪购 AI Agent 如何实现秒级响应?Tair 短期记忆架构揭秘其核心机制。 核心内容: 1. 淘宝闪购 AI Agent 面临的短期记忆挑战与性能要求 2. Tair 作为记忆层的架构设计与关键技术突破 3. 实际业务场景中的性能优化策略与效果验证

大语言模型
大语言模型
大语言模型

林俊旸离职后首次发声!复盘千问的弯路,指出AI的新路

林俊旸深度剖析AI技术演进:从推理模型到智能体思维的跨越式转型,揭示行业未来十年关键方向。 核心内容: 1. 千问团队技术路线反思:混合思维模式的实践困境 2. 推理模型时代的终结与智能体思维的特征解析 3. 未来AI竞争核心:环境设计、工程架构与多智能体协同

大语言模型
大语言模型
大语言模型

GitHub 悄悄改了规则,你的代码可能正在被拿去训练 AI

GitHub 默认收集开发者代码数据训练 AI,你的隐私设置可能已经悄悄被修改。 核心内容: 1. GitHub 新规默认收集 Copilot 交互数据用于 AI 训练 2. 被收集数据的详细范围与隐私风险分析 3. 开发者保护代码隐私的应对方案

大语言模型
大语言模型
大语言模型

Harness is the New Dataset:模型智能提升的下一个关键方向

Harness Engineering正成为AI领域的新焦点,掌握它意味着掌握模型智能的未来。 核心内容: 1. Harness Engineering的定义与重要性:从马术比喻到AI系统搭建 2. AI工程方法的三次演进:从Prompt到Context再到Harness 3. 一线团队实践与数据飞轮构建的关键方法论

大语言模型
大语言模型
大语言模型

Google 亲手证明:GUI 已死,但尸体还在动

Google用Flash-Lite浏览器颠覆传统网页体验,一句话生成完整网站,GUI的未来正在被重写。 核心内容: 1. Google DeepMind发布实时生成网站的Flash-Lite浏览器 2. 演示案例:从植物护理指南到"最烦人网站"的AI即时创作 3. 流式代码输出技术实现超低延迟的交互式页面生成

大语言模型
大语言模型
大语言模型

Claude Code 太烧钱了?我用这 5 招,把 token 成本砍了一半!

Claude Code 烧钱太猛?5个实用技巧帮你轻松省下一半token成本! 核心内容: 1. 分析Claude Code烧钱的5大原因 2. 5个实用省钱技巧详解(模型选择/上下文控制等) 3. 推荐优化工具和订阅方案

大语言模型
大语言模型
大语言模型

治愈 Cursor AI 编程的 “幻觉”?用它就够了!

AI编程的"幻觉"问题有解了!天玑团队从实战中总结出一套Specflow工作流,让AI生成代码更精准可靠。 核心内容: 1. 传统AI编程的痛点分析:碎片化输出、上下文断层问题 2. 三大主流规格驱动方案的优劣势对比 3. Specflow工作流的设计理念与创新点

大语言模型
大语言模型
大语言模型

Anthropic官方复盘Claude Code:智能体系统设计的四个核心

Anthropic团队揭秘Claude Code开发历程:工具设计的艺术决定了智能体的上限。 核心内容: 1. 智能体工具设计的核心挑战与视角转换 2. Claude Code开发中提问功能的演进故事 3. "AskUserQuestion"工具的设计哲学与实现优势

大语言模型
大语言模型
大语言模型

Claude Code auto mode 解析:如何用 AI 分类器替代人工审批

Claude Code的auto mode用AI分类器解决人工审批疲劳,在安全与效率间找到平衡点。 核心内容: 1. 人工审批环节存在的效率问题与安全隐患 2. AI分类器的工作原理与安全机制设计 3. 实际应用场景中的风险控制案例

大语言模型
大语言模型
大语言模型

Google 最新极限压缩算法,砸碎大模型本地部署的内存墙,8 倍提升!

Google突破性技术TurboQuant,3bit量化实现零精度损失,8倍推理速度提升,彻底打破大模型部署内存限制。 核心内容: 1. TurboQuant革命性压缩原理:PolarQuant极坐标变换+QJL残差处理 2. 实测性能:6倍内存缩减+8倍速度提升,长上下文任务零精度损失 3. 行业影响:同等硬件支持6倍并发,彻底改变LLM推理格局

大语言模型
大语言模型
大语言模型

Google 发了个压缩算法,内存砍 6 倍,速度快 8 倍,精度零损失

Google最新TurboQuant算法突破性压缩大模型KV Cache,内存节省6倍、速度提升8倍且精度无损,彻底解决传统量化存储难题。 核心内容: 1. KV Cache内存占用问题与行业痛点 2. TurboQuant极坐标量化与传统方法对比 3. PolarQuant+QJL组合实现零精度损失压缩

大语言模型
大语言模型
大语言模型

Claude团队深夜祭出“自动模式”!网友看呆了:CC里程碑式进化!无人值班确实上头,但一周的token很快燃尽

Claude Code的"自动模式"彻底解放开发者双手,AI编程进入"无人值守"新时代! 核心内容: 1. 自动模式的核心突破:AI可自主决策权限,无需用户逐项批准 2. 内置安全机制详解:风险分级系统如何防止"删库跑路" 3. 使用建议与最佳实践:官方推荐的隔离环境部署方案

大语言模型
大语言模型
大语言模型

如何设计 Harness 工程,实现长时间自动开发应用

Anthropic团队创新设计多AI协作架构,让AI能持续数小时自主开发完整应用,突破单AI的局限性。 核心内容: 1. 单AI开发的局限性:上下文焦虑与性能下降问题 2. 三AI协作架构设计:借鉴GAN的生成-评估机制 3. 结构化交接文档实现上下文重置与任务延续