-
智能体如何使用上下文工程
该视频全面解释了 AI 智能体的上下文工程,这是一个关键的挑战,因为任务的复杂性和长度不断增加,导致“上下文腐烂”、成本增加和性能下降。来自 LangChain 的 Lance 介绍了三个通用原则:卸载、减少和隔离上下文。卸载涉及将上下文移动到外部存储(如文件系统),这实现了跨任务和智能体调用的持久性。例如,Claude Code 的“Skills”和 Manis 使用 `bash` 工具,允许将… -
Runway Gen-4.5 刷屏发布,把重量尘土和光影都做对了,网友:颠覆
文章详细介绍了 Runway 最新发布的文本转视频模型 Gen-4.5,该模型在 Artificial Analysis 基准测试中以 1247 Elo 评分超越所有现有模型,达到 SOTA 水平。Gen-4.5 在运镜、视角切换、复杂场景(如人照镜子)、物理效果(如尘土、重量感、颜料干湿变化)及光影处理方面展现出前所未有的真实感和细节。它能理解并执行复杂的序列式指令,同时保持了 Gen-4 在速… -
Sebastian Raschka:关于 DeepSeek R1 和推理模型,我有几点看法
本文由著名 AI 研究者 Sebastian Raschka 撰写,全面解析了构建和改进推理模型的四种主要方法,包括推理时间扩展、纯强化学习 (RL)、监督微调加强化学习 (SFT + RL) 以及纯监督微调 (SFT) 和蒸馏。文章以 DeepSeek R1 为例,详细分析了其训练流程、开源特性和效率优势,并对比了不同方法的优劣。此外,文章还讨论了在有限预算下开发推理模型的可能性,介绍了 Sky… -
达摩院开源 VideoLLaMA3:仅 7B 大小,视频理解拿下 SOTA | 在线可玩
本文介绍了达摩院开源的 VideoLLaMA3,这是一个以图像为中心构建的新一代多模态视频 - 语言模型。该模型仅有 7B 大小,在通用视频理解、时间推理和长视频理解三个核心维度评估中表现优异。同时,适用于端侧的 2B 版本在图像理解上也表现出色,在 InfoVQA 和 MathVista 等基准测试中取得领先。文章详细阐述了 VideoLLaMA3 以图像为中心的训练范式,包括视觉编码器适配、视… -
指挥者到编排者:AI 智能体赋能的未来编码
本文探讨了在 AI 驱动的未来中软件工程师不断演变的角色,从直接的代码执行者转变为 AI 智能体的管理者。它介绍了两种范式:“指挥者”和“编排者”。指挥者同步且交互式地指导单个 AI 智能体完成特定任务,很像 AI 结对程序员,例如 Claude Code 命令行界面和 Cursor。以 GitHub Copilot 编码智能体、Google Jules 和 OpenAI Codex 等工具为例,… -
领英如何赋能产品经理,转型为 AI 驱动的“全栈构建者” | Tomer Cohen (领英首席产品官)
领英首席产品官 Tomer Cohen 详细阐述了产品开发的根本性变革,旨在适应 AI 驱动的工作技能快速演变。他介绍了“全栈构建者”(FSB) 模型,以“助理产品构建者”计划取代传统的助理产品经理 (APM) 项目,培养复合型人才。新模型基于三大支柱:改造底层平台,使其更好地支持人工智能推理;构建专门的内部 AI 智能代理(如“信任代理”和“增长代理”);以及鼓励小团队自主创新。Cohen 强调… -
红杉专访 OpenAI Codex 团队:AI Coding 的未来,应该是异步自主 Agent
文章是红杉资本对 OpenAI Codex 团队的专访记录,深入探讨了新推出的 Codex Agent。该 Agent 区别于代码补全工具,旨在成为能够接受任务委托、异步独立完成编程流程的 AI 助手。专访揭示了 Codex 的技术理念,特别是通过强化学习使模型更好地对齐专业软件工程师的“品味和偏好”,从而生成可直接合并的代码。文中强调,高效使用 Codex Agent 需要开发者采用“富足心态”… -
组织能力才是 AI 公司真正的壁垒 | 对谈 Palona AI 联创任川
本期播客深入探讨了在 AI 时代,组织形式如何成为创业公司的核心竞争壁垒。嘉宾 Palona AI 联创任川分享了其团队构建 AI Native 组织的实践经验。核心观点包括:默认由 AI 承担所有研发工作,如 90%代码由 AI 编写、AI 代码审查将时间从数天缩短至 10 分钟;AI 工具如 CodeRabbit、Linear+Devin、incident.io 在提效中的应用;以及减少人际交… -
0.5B 以小搏大拿下端侧模型新 SOTA:4090 可跑,长文本处理 5 倍常规加速丨清华&面壁开源
清华大学与面壁智能联合开源了 MiniCPM 4 系列模型(8B 和 0.5B),以仅约同级别开源模型 22% 的训练开销,在多项基准测试中取得同级别最优性能,部分甚至超越参数量更大的模型。文章详细阐述了其背后的四大技术创新:高效稀疏注意力 InfLLM v2,用于解决传统自注意力机制在长文本处理中计算和存储开销过高的问题;端侧推理优化框架 CPM.cu 与跨平台部署系统 ArkInfer,旨在解… -
使 Cloudflare 成为构建 AI 智能体的最佳平台
Cloudflare 致力于成为构建 AI 智能体的首选平台,并为此推出了一系列新工具和服务。`agents-sdk` 是一个新的 JavaScript 框架,用于构建 AI 智能体并直接部署到 Cloudflare Workers,它支持实时通信、状态持久化,并能执行长期运行的任务。Workers AI 增加了结构化输出(JSON 模式)、工具调用和更大的上下文窗口,增强了 AI 智能体的功能。… -
Arc 浏览器创始人复盘:为何放弃百万用户及产品,押注 AI 浏览器?
文章详细复盘了 Arc 浏览器公司放弃拥有百万用户的 Arc,转而开发全新 AI 原生浏览器 Dia 的决策过程。创始人 Josh Miller 坦承 Arc 因过于复杂未能成为面向大众的产品,且多数创新功能的用户使用率远低于预期。他认为,受 AI 浪潮影响,传统浏览器正在走向消亡,未来的桌面端 AI 界面将融合网页与 AI 聊天。Dia 正是基于此判断,从零开始构建,旨在通过简洁、快速、安全的设… -
AI 编程如何在团队中真正落地?
文章详细介绍了阿里云高德信息业务中心大供给团队如何在实际项目中落地 AI 编程工具 Cursor。首先分析了团队推广中遇到的三大问题:使用流程不统一、语言表达不清晰和前置步骤复杂。针对这些问题,团队提出了研发流程规范、结构化语言表达和通用解决方案三大策略。研发流程规范详细描述了从需求阶段到测试阶段的每个环节如何合理使用 Cursor,包括创新的'概要设计-详细设计'流程;结构化… -
RL 环境与智能体能力金字塔
文章深入探讨了 AI 智能体从聊天框迈向现实世界所面临的挑战,并提出 2025 年是“RL 环境之年”,强调其在训练和评估智能体中的核心作用。通过在模拟真实工作场景的 Corecraft 公司 RL 环境中测试 9 个 AI 模型执行 150 项任务,发现即使是 GPT-5 和 Claude Sonnet 4.5 也面临超过 40%的失败率。文章由此构建了“智能体能力金字塔”框架,将智能体能力划分… -
OpenAI 正在悄然采纳 'Skills' 机制,并已集成至 ChatGPT 和 Codex CLI
本文报道了 OpenAI 悄然在 ChatGPT 的代码解释器和 Codex CLI 中引入“技能”机制,与 Anthropic 早期的实现方式类似。“技能”允许大型语言模型 (LLM) 与外部工具和资源交互,从本质上为它们提供了新的功能。在 ChatGPT 中,用户可以访问一个包含用于处理电子表格、DOCX 和 PDF 文件的技能的 `/home/oai/skills` 文件夹。值得注意的是,P… -
从“氛围编码”到“氛围工程”——Kitze 与 Sizzy
Kitze 呈现了一场充满活力而又幽默的演讲,深入探讨了 AI 时代软件开发的演变。他将“氛围编码”(指不加批判地接受 AI 生成的代码)与“氛围工程”(一种开发者运用技术专长策略性指导 AI 智能体的方法)清晰地区分开来。演讲内容涵盖了前端开发的现状、Composer One 等工具带来的变革性影响,以及开发者成功所需的新能力。Kitze 还回应了对 AI 将取代开发者工作的担忧,指出虽然初级职… -
Qwen 家族再上新!
文章介绍了通义千问团队最新发布的 Qwen3 Embedding 和 Qwen3 Reranker 模型系列。Qwen3 Embedding 负责将文本转化为向量进行语义检索的“初筛”,捕捉语义关系;Qwen3 Reranker 则对 Embedding 模型初步筛选的结果进行精细化排序,判断文本相关性高低,实现“精排”。两者结合构建了一套完整的语义检索流程,旨在显著提升搜索和推荐系统的准确性。文… -
最强中文 TTS!设计任何音色+情感注入,效果绝了~【附实操】
文章详细介绍了 MiniMax 语音平台最新推出的“音色设计”(Voice Design)功能,该功能允许用户通过自然语言描述来创造独一无二的 AI 音色,有效解决了传统 TTS 音色库不足和语音克隆版权门槛高的问题。作者通过“毒舌御姐”、“远古巨龙”、“好莱坞播音员”等多个生动案例,演示了音色设计功能的强大与灵活性。更进一步,文章分享了如何基于 MiniMax MCP(多模态对话平台)搭建一个 … -
从 MCP 到 Agent:构建可扩展的 AI 开发生态的工程实践
文章详细介绍了字节跳动 Trae IDE 在重塑软件开发范式、构建可扩展 AI 开发生态方面的工程实践。作者首先回顾了 AI 与 IDE 结合的演进历程,从代码补全到智能编程助手的转变,强调了 AI 对开发效率的显著提升。接着,文章深入解析了 Trae 中 Agent 的设计理念,包括其思考规划、执行、观察反馈循环,以及工具调用和上下文获取能力。核心亮点在于 Trae 如何通过引入 MCP(Mul… -
ElevenLabs 首席执行官:为什么语音是下一代人工智能界面
ElevenLabs 首席执行官兼联合创始人 Mati Staniszewski 讨论了公司快速交付研究级人工智能产品,包括文本转语音、人工智能音乐和实时语音智能体。他强调语音是下一个人机界面,并详细阐述了他们由小型自主团队组成的组织模型、全球远程优先招聘策略和“无头衔”政策。采访涵盖了平衡人工智能研究与产品发布,通过诸如他们的语音市场(已向创作者支付超过 1000 万美元)之类的举措来驾驭创意产… -
深度思考:聊聊 AI 发展趋势
该文章由一位资深前端开发者撰写,回顾了 AI 从 AlphaGo 到 ChatGPT 的爆发历程。作者结合自身成功将 ChatGPT 套壳为桌面应用(获得 54k+ Stars)的实践经验,深刻洞察并分享了对 AI 发展趋势的思考。文章首先批判了当前“AI 泛滥”现象中存在的利用信息差和贩卖焦虑的行为。随后,作者将 AI 形态分为模型和使用两部分,重点分析了 AI 应用从网页到桌面应用、CLI 工…
AI 前线
❯
个人中心
购物车
优惠劵
今日签到
有新私信
私信列表
搜索
扫码打开当前页
返回顶部
幸运之星正在降临...
点击领取今天的签到奖励!
恭喜!您今天获得了{{mission.data.mission.credit}}积分
我的优惠劵
-
✈优惠劵使用时效:无法使用使用时效:
之前
使用时效:永久有效优惠劵ID:×
没有优惠劵可用!












