-
YC AI 创业营第一天,Andrej Karpathy 的演讲刷屏了
本文汇总了 YC AI 创业营第一天多位重量级嘉宾的演讲精华,重点编译了 Andrej Karpathy 关于“软件 3.0:提示词即软件”的观点,分析了当下 AI(特别是大模型)类似计算机早期、公用事业、晶圆厂和操作系统的多重属性,探讨了大模型在“锯齿状智能”和“顺行性遗忘症”等心理学特性上的局限性及潜在解决方案(如系统提示学习和记忆功能),并强调了 AI 产品设计中“自主性调节滑块”的重要性及… -
AI 驱动前端重构:10 天完成 3000+行复杂组件的跨端复用实践
本文深入探讨了阿里云团队在面对一个代码量庞大(超 3000 行)、平台适配分支众多且逻辑复杂的“规格面板”核心前端组件时,如何通过引入 AI 开发工具 Cursor 并结合 Claude 模型,在短短 10 天内成功完成向 ICE 架构的全面重构,实现了 Web 和 Weex 的跨端复用。文章指出,尽管 AI 工具初次生成代码存在问题,但通过建立和持续迭代详尽的编码规范、Weex 平台适配规则及完… -
全新 MoE 架构!阿里开源 Qwen3-Next,训练成本直降 9 成 | 机器之心
文章详细介绍了阿里通义团队开源的下一代大语言模型架构 Qwen3-Next。该模型总参数 80B,但仅激活 3B 参数,实现了训练成本直降 9 成、推理吞吐提升 10 倍以上的突破。其核心创新包括:结合 Gated DeltaNet 和 Gated Attention 的混合注意力机制,旨在优化长上下文处理;采用 512 个专家、10 个路由专家和 1 个共享专家的极致稀疏 MoE 结构,仅激活 … -
谈谈 AI 编程时代的「道法术」
本文基于“道法术器”的框架,深度剖析了 AI 编程时代软件开发面临的变革与挑战。作者首先指出开发者在使用 AI 工具时常见的误区,如过度依赖或完全排斥,以及对 AI 能力边界的模糊认知。随后,文章详细阐述了 AI 编程的三大核心要素:模型、工具与人,强调人作为指挥官与决策者的核心地位。核心内容围绕“道”(永恒的软件工程原则,如价值、抽象、简约、演化、权衡、协作)和“法”(经过验证的方法论,如敏捷精… -
Kimi K2 发布并开源,擅长代码与 Agentic 任务
文章正式宣布月之暗面发布并开源其 Kimi K2 模型,这是一款基于 MoE 架构的基础模型,总参数达 1T,激活参数 32B,在代码生成、Agentic 任务和数学推理能力上表现出色。文章指出,Kimi K2 在 SWE Bench Verified、Tau2、AceBench 等基准测试中均取得开源模型中的领先成绩。技术亮点包括使用 MuonClip 优化器实现万亿参数模型的稳定高效训练,以及… -
115. 对 OpenAI 姚顺雨 3 小时访谈:6 年 Agent 研究、人与系统、吞噬的边界、既单极又多元的世界
本期播客特邀 OpenAI 研究员姚顺雨,围绕 AI 智能体(Agent)的构建、创新及对未来社会的深远影响展开深度对话。姚顺雨回顾了其从理论计算机科学转向语言智能体研究的历程,强调语言作为实现泛化最本质工具的重要性。访谈深入阐释了 Agent 的定义、其从符号主义到深度强化学习再到大语言模型驱动的三波演进,并指出当前 Agent 研究已进入“下半场”,核心挑战从模型和方法转向如何定义有价值的任务… -
让 AI 评测 AI:构建智能客服的自动化运营 Agent 体系
文章深入探讨了智能客服从传统基于 NLP 的机器人、到基于 RAG 增强、再到基于大模型(LLM)的 AI 原生智能客服的演进历程。它详细分析了传统客服的痛点和 RAG 模式如何通过向量化检索提升知识问答效率。核心内容是构建了一个“评估-诊断-优化”三位一体的运营 Agent 平台,旨在实现客服机器人服务质量的自动化持续进化,有效解决了 BadCase 发现、根因归类和优化建议生成等问题。文章还详… -
AI 操作网页:browser-use 和 AI 大模型互动解析
本文深入剖析了开源项目 browser-use 在实现 AI 驱动的浏览器自动化任务中,与 AI 大模型进行高效互动的设计技巧。文章详细阐述了如何通过精心设计的 SystemMessage 来定义 AI 角色、约束输入输出格式及行为规则;通过 HumanMessage 传递用户任务、历史执行过程和当前页面状态(包括文本和视觉信息);并利用 AIMessage 作为 AI 响应示例,以及 ToolM… -
Nano Banana 超多玩法分享,太喜欢这种神仙打架的感觉了。
文章详细介绍了 Google Gemini 2.5 Flash 模型(作者昵称“Nano Banana”或“NB”)在图像处理领域的强大能力和多样化应用。作者通过大量实战案例,展示了该模型如何实现图像修复、人物姿态迁移、背景环境更换、产品替换、服装造型转换、以及风格合成(如添加游戏 UI、制作手办、生成等轴测三维图和 3D 渲染效果)。文章不仅提供了具体的提示词(prompts),还分享了多图参考… -
Gemma 3 介绍:可在单 GPU 或 TPU 上运行的最具能力的模型
谷歌 DeepMind 推出 Gemma 3,这是基于 Gemini 2.0 构建的最新开放模型,它不仅为超过 140 种语言提供多语言支持,更提升了性能。Gemma 3 具备强大的多模态能力,可以分析图像、文本和短视频;同时,它还配备了扩展的 128k-token 上下文窗口,并支持函数调用以实现任务自动化。Gemma 3 性能卓越,超越 Llama-405B 等模型,且可在单个图形处理器或张量… -
《智能体设计模式》之多智能体协作模式:分工协同突破单一智能体能力边界[译]
文章作为《智能体设计模式》一书的翻译章节,深入探讨了多智能体协作模式。它指出单一智能体在处理复杂跨领域任务时的局限性,并提出通过任务分解、专业化分工及智能体间协同工作来突破这些限制。文章详细介绍了六种协作架构(如网络化、监督者、层级结构)和六种协作形式(如顺序交接、并行处理、辩论与共识),并列举了复杂研究、软件开发、创意内容生成等七大典型应用场景。此外,文章还通过 CrewAI 和 Google … -
当上传不再只是 /upload,我们是怎么设计大文件上传的
本文深入探讨了在政企私有化部署场景下,传统文件上传方式面临的挑战,如大文件、内网环境、安全审计及与 AI 大模型业务的结合需求。作者提出了一套全面的大文件上传解决方案,包括七个核心后端 API(秒传检查、初始化任务、上传分片、合并文件、暂停、取消、任务列表),以及支撑这些功能的数据库三张核心表(upload_task、upload_chunk、file_info)。文章详细阐述了任务状态流转、断点… -
【第 3626 期】2025 CSS 年终盘点:22 个重磅新特性,助你雕刻动态网页!
文章深入介绍了 Chrome DevRel 团队发布的 22 个 CSS 和 UI 新特性,涵盖了可定制组件、下一代交互和优化的人体工程学三大模块。在可定制组件方面,Invoker Commands、Dialog Light Dismiss、popover="hint"、可定制的下拉菜单、::scroll-marker/button()、scroll-target-group、… -
拥抱概率真相——AI 时代谣言套路拆解与防御指南
文章深入探讨了 AI 时代“概率真相”的信息环境,指出 AI 技术赋能下的虚假信息具有高度逼真性、批量生产和精准传播的特点,其迷惑性和破坏力远超传统谣言。报告详细分析了 AI 虚假信息在内容(从文本到多模态造假,85%为完全虚构)、传播(热点驱动、情绪调动,71%为经济利益驱动)和危害(社会稳定、文化认同、经济信心、个人健康)层面的结构性特征与新机制。通过拆解 2025 年度十大 AI 虚假信息案… -
构建 RAG 流程的有效实践
本文深入分析了构建 RAG (Retrieval Augmented Generation) 流程的有效实践,从一个实际的软件架构支持项目中总结经验教训。首先回顾了 RAG 的基础知识,强调通过提供精心策划的上下文来降低 LLM 产生错误信息的可能性。文章的核心深入探讨了文档导入、搜索和检索方面的实际挑战和解决方案。主要见解包括混合搜索方法(向量和基于关键词的)的必要性,基于内容和媒体类型(例如,… -
Shopify 如何利用单体架构每分钟处理 30TB 数据?
本文深入剖析了全球电商巨头 Shopify 如何凭借其精心设计的模块化单体架构,而非数百个微服务,应对每分钟处理高达 30TB 数据和数千万次请求的巨大挑战。文章首先通过黑色星期五的数据峰值展示了 Shopify 系统的强大稳定性。接着,详细介绍了其核心架构:一个基于 Ruby on Rails 的模块化单体,通过内部工具 Packwerk 严格强制执行逻辑边界,实现各业务领域(如结账、支付)的独… -
凡人程序员进入修仙时代?意图即代码的范式革命即将到来
本文深入探讨并构想了“意图即代码”这一革命性的 AI 原生开发范式,旨在通过提升抽象层次,让开发者仅用自然语言定义业务意图,而由 AI 负责具体的实现、探索与验证。文章详细阐述了支撑这一范式的三大核心支柱:意图编排,通过可视化画布和结构化意图树管理业务逻辑及隐式数据流;资源发现,构建 AI 可理解的外部世界地图,实现动态交互式工具利用;以及意图约束,通过契约和行为测试确保 AI 生成代码的可靠性与… -
从失败中重生:一个 AI Agent 前端落地的真实复盘
文章通过一个真实案例,深入剖析了一个 AI Agent 前端项目从技术角度看取得成功,但用户接纳度低导致产品失败的全过程。作者首先定义了 AI Agent,然后详细介绍了团队如何基于企业痛点(内部设计系统与私有前端框架的代码生成)进行技术选型(Claude Agent SDK)、解决关键技术难题(代码浏览器预览、私有组件学习、代码质量保证),并最终成功上线。然而,项目上线后却因用户习惯阻力、Age… -
开源 Agent 模型榜第一名,现在是阿里通义 DeepResearch
文章详细介绍了阿里巴巴开源的首个深度研究 Agent 模型通义 DeepResearch。该模型采用 30B-A3B 轻量级架构,在 HLE、BrowseComp-zh、GAIA 等多个权威评测集上取得了 SOTA 成绩,超越了 OpenAI Deep Research 和 DeepSeek-V3.1 等竞品。文章深入阐述了模型能力提升的关键因素,包括一套不依赖人工标注、大规模生成高质量训练数据的… -
Claude 4:AI 模型的全新突破
Anthropic 推出了其下一代 AI 模型 Claude Opus 4 和 Claude Sonnet 4,重点提升了在编码、复杂推理和构建强大 AI 智能体方面的性能。Opus 4 被认为是领先的编码模型,在具有挑战性的长时间任务中表现出持续的性能,并在 SWE-bench (72.5%) 和 Terminal-bench (43.2%) 等基准测试中名列前茅。Sonnet 4 显著升级了 …
AI 前线
❯
个人中心
购物车
优惠劵
今日签到
有新私信
私信列表
搜索
扫码打开当前页
返回顶部
幸运之星正在降临...
点击领取今天的签到奖励!
恭喜!您今天获得了{{mission.data.mission.credit}}积分
我的优惠劵
-
✈优惠劵使用时效:无法使用使用时效:
之前
使用时效:永久有效优惠劵ID:×
没有优惠劵可用!







![《智能体设计模式》之多智能体协作模式:分工协同突破单一智能体能力边界[译]](https://media.ginonotes.com/images/20251028_agentic_design_patterns_multi_agent_collaboration/chapter07_fig1.png)
/filters:no_upscale()/articles/architecting-rag-pipeline/en/resources/140figure-1-1755593891004.jpg)



