-
【全文版】赫拉利 x 宇多田光:AI 和创造力-当人工智能遇上艺术创作 | 1.7 万字全文+视频
本文是历史学家尤瓦尔·赫拉利与音乐家宇多田光关于 AI 与创造力的深度对话。双方深入探讨了 AI 对音乐、写作等创意领域构成的挑战与机遇,核心在于人类艺术创作源于自我探索的内在需求和情感挣扎,而 AI 的创作则基于目标导向和数据分析,缺乏真正的“渴望”。赫拉利强调智能与意识是不同的概念,AI 虽具智能但缺乏感受能力。对话还触及了在 AI 技术超越的背景下,人类艺术的价值可能更多地转向创作者的个人故… -
信息量很大:2025.7.17 王坚对话黄仁勋实录
文章记录了之江实验室主任王坚与英伟达创始人兼首席执行官黄仁勋在第三届中国国际供应链促进博览会上的对话实录。对话围绕人工智能的过去、现在与未来展开,黄仁勋将 AI 发展划分为感知 AI、生成式 AI、推理 AI 和物理 AI 四大浪潮,强调 AI 是一种基于第一性原理的全新软件开发范式。双方深入探讨了开源模型作为颠覆性驱动力,如何通过开放研究和开放工程加速创新、提升技术质量和安全性。此外,对话还触及… -
阿里千问 3 推理模型重磅更新,比肩 Gemini-2.5 pro、o4-mini
文章详细介绍了阿里巴巴近期在开源大模型领域的重大进展。最新推出的千问 3 推理模型,其通用能力和深度思考能力实现巨大飞跃,支持 256K 上下文长度,并在知识、逻辑推理、编程、数学、人类偏好对齐等多项核心能力上,达到甚至超越 Gemini-2.5 pro、o4-mini 等顶尖闭源模型,被誉为全球最强开源推理模型。此外,阿里还开源了 Qwen3-235B-A22B-Instruct-2507 基础… -
当 AI 智能体学会“欺骗”,我们如何自保?来自火山的 MCP 安全答卷
文章深入探讨了 AI 智能体与外部工具交互中关键的模型上下文协议(MCP)的安全问题。首先介绍了 MCP 的核心概念、技术原理和快速发展的生态系统。随后,通过具体的时序交互案例,详细解析了 MCP 的工作流程。文章的核心部分在于对 MCP 面临的七种主要安全风险进行了深入分析,包括传统 Web 服务风险以及工具描述投毒、间接提示词注入等新型威胁,并辅以真实案例进行说明。最后,文章提出了火山引擎针对… -
Kimi 大模型训推混部的稳定性与资源优化实战
文章深入剖析了月之暗面在 Kimi 大模型训推混部集群中的工程实践。面对大规模资源下的高故障率、低资源利用率和潮汐效应等挑战,月之暗面构建了全链路监控系统(如 Varys 情报总管),实现了连续异步 Checkpoint 机制以提升稳定性。为提高资源效率,文章介绍了动态云开发资源申请、任意级目录用量统计、异步模型评估和跨机房模型分发等方案,并详细阐述了训推多级潮汐系统。此外,文章还针对强化学习中训… -
a16z 创始人 Ben Horowitz:创始人为何失败以及为何你需要直面恐惧
文章总结了 a16z 联合创始人 Ben Horowitz 在 Lenny's Podcast 上的访谈核心内容。Ben Horowitz 从飞行员故事引出成功源于一系列艰难微小决策的理念,并强调领导者需“跑向恐惧”、直面糟糕选择,因为犹豫是最差行为。他指出创始人 CEO 失败常因信心丧失,a16z 通过构建人脉网络和 CEO 圈子帮助创始人重拾信心。在创业资格方面,他认为“非理性的渴望… -
在 Sora 诞生之前,胡修涵做了两年多的「二次元版 Sora」
本文是一篇对 AI 创业公司“捏 Ta”创始人胡修涵的深度访谈,围绕 Sora 的发布,探讨了 AI 原生时代用户对“意义感”的创造性需求。胡修涵指出,不应以传统内容平台的思维框架来理解 Sora,而应关注其激发用户主动创作和 Remix 的潜力。他分享了“捏 Ta”作为“二次元版 Sora”的实践经验,包括如何通过 AI 生成原创角色,并以角色为核心构建内容社区。文章强调了 Agentic Wo… -
【第 3546 期】如何让 CKEditor 缩小 40% 的:一次深入的包体积优化探索
文章详细介绍了 CKEditor 5 团队如何通过一系列深入的包体积优化措施,成功将编辑器捆绑包大小减少了 40%。作者首先阐述了 CKEditor 5 在高度模块化和多样化分发场景下遇到的包体积挑战,特别是新引入的元包(meta-package)在简化安装的同时,最初反而增加了体积。随后,文章深入剖析了精细化 tree-shaking 的关键策略,包括识别并重构带有副作用的代码、利用 `/* #… -
攻守易形:当开源变成中国主场|赛博月刊 2508
本文作为一份月度技术观察报告,全面回顾了 2025 年 7 月全球人工智能领域的最新进展。在“趋势观察”部分,文章重点指出国产大模型如 K2、GLM-4.5 等在编程、Agent 及多模态能力上已完全不输海外第一梯队,且大量以开源形式发布,凭借开源生态和性价比优势,显著巩固了中国在 AI 竞争中的“主场”地位,宣告中美在语言模型领域进入同等水平竞争。同时,文章也观察到图像、视频、音频领域正向“理解… -
人物一致性新王 Nano Banana 登基,AI 图片编辑史诗级升级。
文章深入评测了尚未正式发布的神秘 AI 绘图模型 Nano Banana,该模型目前仅在 LMArena 盲测中随机出现,但被作者和社区普遍认为是 Google 旗下产品。核心亮点在于其惊人的人物一致性,能够完美保留参考图的面部特征和表情,远超 GPT-4o、Flux 和 Seedream 等现有主流模型。文章通过多个实际案例,包括单主体动作迁移、多主体人物替换、背景替换、主体与背景结合、人物情绪… -
开发者指南:ADK 多智能体模式
文章强调,如同单一、整体式软件应用一样,单一、整体式 AI 智能体也会导致瓶颈和错误增加。它倡导将多智能体系统 (MAS) 作为 AI 领域的微服务架构范式,通过去中心化和专门化来增强模块化、可测试性和可靠性。本指南详细阐述了使用 Google 智能体开发工具包 (ADK) 的八种多智能体设计模式,包括顺序管道、协调器/调度器、并行扇出/聚合、分层分解、生成器和评论器、迭代优化以及人在环中。每种模… -
央视专访黄仁勋:扎根中国 30 年,BAT 都是朋友,DeepSeek 极具创新,华为值得尊重
文章是央视对英伟达创始人黄仁勋的深度专访实录。黄仁勋强调中国市场“独一无二”,英伟达深耕 30 年与联想、阿里巴巴、腾讯、百度、小米等企业深度合作,并高度赞赏中国在 AI 领域的惊人创新能力,尤其提到了 DeepSeek R1 模型在 H20 架构上的突破性优化,印证了“中国创新不可阻挡”。他认为智能化是“有史以来最伟大的技术革命”,其重要性比肩电力和互联网,是“最伟大的平等工具”,能同步提升所有… -
基于智能体的自适应资损防控体系 - 淘工厂实践(二)
该文章深入剖析了淘工厂在电商平台资损防控领域的创新实践,通过引入基于 Agentic AI 的多智能体协作系统,解决了传统人工防控体系面临的效率低下、知识孤岛和经验断层等核心痛点。文章详细介绍了新范式的系统架构,包括知识抽取、资损分析、核对布防、产出监控和指标监控等五大核心智能体模块,并结合“小程序-下单得积分玩法”的具体案例,阐述了智能化知识提取机制、需求文档前置风险发现、全自动核对与监控生成部… -
凌晨战神 Qwen 又搞事情!新模型让图像编辑“哪里不对改哪里”
文章详细介绍了 Qwen 团队最新推出的 Qwen-Image-Edit 图像编辑模型。该模型基于 Qwen-Image20B,不仅能进行精准的文字修改,还支持元素的新增、消除、重绘、修改,以及 IP 编辑、视角切换、风格迁移等生成式玩法。文章通过大量案例和实测效果展示了其在原创 IP 编辑、视角转换、虚拟形象生成、元素增删改、虚拟场景与穿搭模拟、文字设计与海报编辑、链式编辑等方面的卓越能力,并指… -
拾象 AGI 观察:LLM 路线分化,AI 产品的非技术壁垒,Agent“保鲜窗口期”
本文作为拾象 AGI 观察季报,通过对硅谷大模型公司(如 OpenAI、Google Gemini、Anthropic、xAI 等)的访谈与分析,揭示了 LLM 路线从通用型向垂直领域分化的趋势,呈现出“横向全家桶”与“纵向垂直整合”两大方向。文章强调,在智能上限探索的同时,产品和非技术性壁垒的重要性日益凸显,尤其以 ChatGPT 的品牌和用户心智为例。同时,AI 产品面临“保鲜窗口期”缩短的挑… -
使用 Google Antigravity 构建:全新 Agentic 开发平台
Google 推出了 Antigravity,一种新颖的 Agentic 开发平台,旨在提升开发者工作流程,使其更贴合任务需求。它将熟悉的 AI 驱动的编码环境(编辑器视图)与专用的“管理器界面”集成在一起,用于编排自主 Agent。这些 Agent 可以跨编辑器、终端和浏览器计划、执行和验证复杂的软件任务,从而减少频繁的上下文切换。实际应用包括委托多工具任务(如功能开发和测试),请求 UI 变更… -
OpenAI 研究员 Noam Brown:Mid-training 是新的 pre-training
文章介绍了 OpenAI 研究员 Noam Brown 关于 AI 模型训练和推理能力的前沿观点。Noam Brown 认为,推理能力是模型涌现出来的能力,只有当 pre-training 达到一定水平后,模型才能真正受益于额外的推理思考。他提出了 mid-training 的概念,认为这是新的 pre-training 阶段,而 post-training 则完成最终的细化与优化。文章详细探讨了… -
GLM-4.5 技术博客:原生融合推理、编码和智能体能力
文章详细介绍了智谱最新发布的旗舰大语言模型 GLM-4.5 和 GLM-4.5-Air,旨在将复杂的推理、强大的编程和高级智能体能力统一于一个模型。GLM-4.5 拥有 3550 亿总参数,GLM-4.5-Air 拥有 1060 亿总参数,两者均采用混合推理模式。文章展示了 GLM-4.5 在智能体任务(如网页浏览)、复杂推理(数学、科学、逻辑)和编程(代码构建、Agentic 编程)等 12 个… -
大模型背后的“新搜索”生意,水有多深
文章详细阐述了生成式 AI(如 ChatGPT、Perplexity)对传统搜索引擎流量和用户行为的颠覆性影响,指出企业营销策略正从传统 SEO(Search Engine Optimization)转向 GEO(Generative Engine Optimization)。文章深入分析了 SEO 与 GEO 在工作原理、优化路径上的本质差异,强调 GEO 更侧重“引用为王”和“语义实体优化”,… -
腾讯的这款 AI 数据智能体工具 Lumos,颠覆了传统的数据分析
文章详细介绍了腾讯数据智能体工具 Lumos 的技术实践。该产品 Tomoro 定位为 AI 表格式大数据分析工具,旨在解决非技术用户在传统 BI 数据理解困难和分析工具使用门槛等痛点,通过结合大数据引擎、熟悉的表格 UI 和 AI 能力,实现零门槛自助分析。Lumos 采用多智能体架构来应对复杂数据分析任务,并通过共享工作记忆机制解决 Agent 间的一致性问题。为提升用户体验,文章深入阐述了分…
AI 前线
❯
个人中心
购物车
优惠劵
今日签到
有新私信
私信列表
搜索
扫码打开当前页
返回顶部
幸运之星正在降临...
点击领取今天的签到奖励!
恭喜!您今天获得了{{mission.data.mission.credit}}积分
我的优惠劵
-
✈优惠劵使用时效:无法使用使用时效:
之前
使用时效:永久有效优惠劵ID:×
没有优惠劵可用!







