-
万字详解让大模型写出好代码:上下文窗口的工程化实践
本文深入探讨了在大模型辅助代码生成场景下,如何通过工程化实践优化上下文窗口的利用,以提升生成代码的质量。文章首先介绍了大模型辅助编程的背景、两类用户群体(非技术和技术背景)的需求差异,并详细分析了专业开发者面临的代码库规模、技术栈复杂性、业务逻辑上下文和团队协作等挑战。接着,文章系统阐述了 token 机制,包括子词分词器和字节级模型,并强调了代码 token 化的高信息密度和语法结构重要性。随后… -
复杂场景下的 RAG 架构演进:跨模态知识联邦与统一语义推理实践
文章分析了传统 RAG 技术在处理企业级复杂知识交互场景(如异构、多模态知识)时遇到的挑战,特别是知识离散性和模态多样性问题。作者基于 QCon 大会演讲内容,提出了一种新的 RAG 架构演进方向:构建融合知识库以整合多元异构数据,并通过统一知识图谱构建统一语义层,实现跨模态信息的关联和高效检索。文章详细阐述了融合知识库的构建方法和统一知识图谱的生成与检索逻辑,并结合医院电子病历查询和银行风险指标… -
在分析了 2443 家 AI 公司和 802 位投资人后,我们发现…
该报告深入分析了美国 AI 创业生态,通过对 2443 家 AI 初创公司和 802 位投资人的数据进行挖掘,揭示了美国 AI 早期创业的融资特点、行业分布、地域格局和投资人偏好,为中国 AI 创业者提供了一张清晰的 AI 资本市场导航图,帮助他们了解美国 AI 领域的发展趋势和投资机会, 从而更好地制定创业和融资策略。 报告指出,美国 AI 创业公司普遍采取“小额快速”的融资策略,To B 企业… -
AICoding 实践:从 Prd 到代码生成
文章深入探讨了在 AI 技术驱动下,如何将软件工程范式从“工具辅助型”提升至“需求驱动型”。蚂蚁安全与智能实验室构建了一个名为 CodeFuse 的增强型 AI 编程系统,旨在实现从自然语言需求到代码的端到端自动化生成。文章详细介绍了为应对复杂代码资产和业务需求理解困难两大挑战,所采取的建设方案,包括构建标准化的 AICoding 工作流、通过 RAG 和知识图谱扩充业务知识体系、以及强化模型自身… -
狂揽 23.9k stars!超棒的开源 LLM 资源列表
本文系统整理了当前最全面的开源大型语言模型(LLM)资源列表,该资源库在 GitHub 上获得 23.9k 星标。内容涵盖多个知名开源项目如 DeepSeek、Qwen 等中英文模型,以及训练框架(如 DeepSpeed、Megatron-LM)、推理工具(如 vLLM、llama.cpp)、评估方法、应用开发库(LangChain、LlamaIndex)等。资源按技术领域分类,覆盖 LLM 全生… -
下一代 AI 交互,会长成什么样子?| 42 章经 AI Newsletter
文章从创业公司在 AI 交互方式上的机会切入,聚焦“交互”主题。首先讨论了个性化软件(Personalized Software)的兴起与独立 Vibe Coding 的局限性,提出平台在信任、集成、分发与协作方面的核心价值,并认为深度个性化是 AI 的超能力。接着,文章分析了 AI 语音输入法如何从工具演变为“语音操作系统”,强调其在减负、提供 Context、代用户表达及掌握高价值数据方面的潜… -
李想×罗永浩!四小时马拉松访谈!李想首度公开讲述 25 年创业之路
本期播客是罗永浩与理想汽车创始人李想长达四小时的马拉松访谈。李想首次公开讲述了他从少年时期在乡下成长、受家庭影响培养出乐观与自律,到高中时代通过写稿、组装电脑和创建个人网站实现财务独立,开启创业之路。他详细回顾了从泡泡网、汽车之家到理想汽车的多次创业经历,包括互联网泡沫、资金链断裂、产能地狱以及面对网络黑公关等至暗时刻,展现了其坚韧的意志和解决问题的智慧。访谈深入探讨了理想汽车选择增程式技术、构建… -
我的 Claude Code 实战经验:深度使用每个功能 [译]
本文由 Claude Code 重度用户撰写,作者在个人项目和企业级 AI-IDE 工具构建中积累了丰富的经验。文章系统性地分析了 Claude Code 的几乎所有功能,包括`CLAUDE.md`的维护、上下文管理(避免`/compact`)、自定义斜杠命令、子智能体(推荐“主干-克隆”架构而非“领导-专家”模型)、会话恢复、钩子(推荐“提交时阻塞”)、规划模式、技能(Skills,认为比 MC… -
万字长文:重构软件工程迷思,搞懂需求与产品思维
文章旨在重构软件工程理论体系,聚焦需求分析、建模与架构,特别是需求与产品思维。作者指出软件工程缺乏标准化表达导致共识难以建立,并提出技术人员需具备用户、模型、架构“三个脑袋”。文章深入定义“需求”为认知,是“人+场景”的结合,强调产品是针对用户需求的解决方案而非需求本身。它探讨了用户价值的理性与感性部分、比较性以及“伪需求”的本质。此外,文章详细对比了 ToC 与 ToB 产品方法论在价值、人性与… -
评估深度 Agent:经验总结与分析
这篇来自 LangChain 博客的文章详细介绍了评估“深度 Agent”的五个关键模式,这些 Agent 是复杂的、有状态的 AI 应用。文章强调,传统的 LLM 评估方法通常不足以应对 Agent 的动态特性,并且每个测试用例都需要特定的、与上下文相关的成功标准。为了克服这些限制并确保强大的测试,文章概述了五个关键模式。首先强调为每个数据点定制基于代码的测试逻辑,从而可以针对 Agent 的轨… -
LinkedIn 如何将用户限制系统扩展到每秒 500 万次查询
LinkedIn 的用户限制系统,称为 CASAL(社区滥用与安全应用层),旨在通过检测和预防有害活动来维护安全专业的用户环境。该系统结合了机器学习模型、基于规则的系统和人工审核流程来执行限制。随着时间的推移,LinkedIn 的执行基础设施经历了三代演进以应对不断增长的需求。第一代依赖关系型数据库和服务器端缓存,但在可扩展性和延迟方面面临挑战。第二代引入了 NoSQL 数据库(如 Espress… -
成本不到 150 元!李飞飞等 26 分钟训出个推理模型,媲美 o1 和 R1,秘诀:用蒸馏
李飞飞团队联合斯坦福大学、华盛顿大学等机构,通过蒸馏技术,以极低的成本(约 150 元)训练出一个名为 s1 的推理模型,该模型在数学和编程能力上表现媲美 DeepSeek-R1 和 OpenAI o1。团队使用阿里通义的 Qwen2.5-32B-Instruct 作为基础模型,通过蒸馏谷歌 DeepMind 的 Gemini 2.0 Flash Thinking 实验版得到 s1。为训练 s1,… -
1 次搭建完胜 1 亿次编码,MCP 硅谷疯传!Anthropic 协议解锁智能体「万能手」
本文深入介绍了 Anthropic 提出的模型上下文协议(MCP),旨在解决 AI 智能体与外部工具和服务集成时的复杂性和低效问题。MCP 通过提供一个标准化的通用接口,类似于 USB-C 接口对于设备的连接,极大地简化了 AI 模型与各种外部资源之间的交互,使配置次数从 1 亿次降低到 2 万次。文章详细解释了 MCP 的架构、工作原理及其与传统 API 的区别,强调了 MCP 在灵活性、实时双… -
关于智能体(AI Agent)最常用框架,做了超详细的总结!
本文作为 AI 智能体系列内容的深度总结,详细剖析了 AutoGen、AgentScope、CAMEL 和 LangGraph 四大主流智能体框架。文章首先阐述了智能体框架的必要性,指出其在提升开发效率、实现组件解耦、标准化状态管理和简化可观测性方面的核心价值。随后,对每个框架的设计理念、核心机制(如 AutoGen 的对话驱动、AgentScope 的消息驱动、CAMEL 的角色扮演与引导性提示… -
YC 总裁最新专访 Cursor CEO:超越代码、超级 AI 智能体,以及为何品味依然重要 |1.5 万字全文+视频
文章是 YC 总裁对 Cursor CEO 迈克尔·特鲁尔的专访实录及总结。特鲁尔阐述了 Cursor 超越现有 AI 编程助手的愿景,即最终彻底取代传统编码方式,实现基于意图的软件构建。他强调,随着 AI 接管实现细节,未来软件工程师的核心价值在于高层次的“品味”——对产品逻辑和方向的判断力。文章深入分析了 Cursor 早期决定构建独立编辑器而非 VS Code 扩展的关键战略意义,认为这是为… -
国庆这 8 天,我发现和 AI 辩论才是最高效的学习方式。
本文作者分享了在国庆假期期间,通过与 AI(Gemini)进行深度辩论,发现了一种在 AI 时代最高效的学习方式。作者首先提出了自己关于 AI 时代信息爆炸导致“筛选失效”的观点,并基于此与 AI 展开了一场“毫不留情的以干死自己为目的的辩论”。AI 针对作者的三个推断(信息生产效率失衡、注意力总盘恒定、内容辨别成本过高)进行了犀利反驳,指出 AI 本身亦是强大的信息过滤工具,能提高注意力效率,并… -
Manus 爆火的背后:我们用 20 个问题一起搞懂 AI Agent
本文以 Manus 的爆火为引,深入探讨了 AI Agent 的概念、发展脉络、技术标准、创新之处以及未来创业机会。文章首先对 AI Agent 的定义进行了辨析,然后复盘了 2024 年 Agent 领域的发展和重大突破,介绍了衡量 AI Agent 能力的标准 GAIA 以及统一协议标准 MCP。接着,文章以 Manus 为例,分析了其核心突破与创新,即实现了无需手动干预的复杂任务流程,用户体… -
服务器发送事件 (SSE) vs WebSocket:如何选择实时数据交换协议
本文探讨了实时数据交换在现代 Web 应用中的关键作用,重点关注两种核心协议:WebSocket 和服务器发送事件 (SSE)。首先,文章解释了 WebSocket 的基本概念,强调其全双工(即客户端和服务器可以同时发送和接收数据)、低延迟(数据传输延迟极短)的通信能力,并阐明了它与传统的 HTTP 请求-响应模型的差异。接着,文章分析了 WebSocket 的优缺点,包括其跨平台兼容性以及面临的… -
100 万亿 Token 看懵硅谷!全球一半算力写代码,另一半在「搞颜色」 ?
文章深入分析了 OpenRouter 与 a16z 联合发布的《基于 OpenRouter 的 100 万亿 Token 实证研究》报告,全面总结了 2025 年 AI 领域的关键发展现状和反直觉观点。报告基于海量真实算力消耗数据,揭示了开源模型使用量已稳步增长至总流量的 30%,其中中国开源模型表现尤为突出。推理优化模型流量占比飙升至 50%以上,标志着 AI 从文本生成转向复杂任务执行。在应用… -
Claude 4.5 Opus 的“灵魂文档”
本文详细介绍了 Anthropic 在 Claude 4.5 Opus 的训练中使用的一份开创性的“灵魂文档”的发现和后续确认过程。该文档最初由 Richard Weiss 发现,作为模型提取的系统消息中一致的“soul_overview”部分,其真实性后来得到了 Anthropic 的 Amanda Askell 的验证。该文档在监督学习期间被整合,旨在使 Claude 秉承 Anthropic…
AI 前线
❯
个人中心
购物车
优惠劵
今日签到
有新私信
私信列表
搜索
扫码打开当前页
返回顶部
幸运之星正在降临...
点击领取今天的签到奖励!
恭喜!您今天获得了{{mission.data.mission.credit}}积分
我的优惠劵
-
✈优惠劵使用时效:无法使用使用时效:
之前
使用时效:永久有效优惠劵ID:×
没有优惠劵可用!




![我的 Claude Code 实战经验:深度使用每个功能 [译]](https://media.ginonotes.com/images/20251104_how_i_use_every_claude_code_feature/context.webp)



