-
你们催更的模型,云栖大会一口气全发了!
文章详细介绍了阿里巴巴云栖大会上发布及升级的七款通义系列大模型,全面覆盖了从文本、视觉、语音、视频到代码和图像的全场景应用。其中,Qwen MAX 作为万亿参数旗舰模型,在代码生成和工具调用能力上表现卓越,并在 SWE-Bench Verified 和 AIME25 评测中取得高分;Qwen3-Omni 是新一代全模态大模型,采用 Thinker-Talker MoE 架构,实现了音视频、图像等多… -
谷歌 AI 转型的内幕:AI 模式与 AI 驱动的搜索
本期播客采访了谷歌搜索产品副总裁 Robby Stein,他深入介绍了谷歌近期在人工智能领域的成功,包括 Gemini 的快速崛起、AI 概览和全新的 AI 模式。他阐述了人工智能如何通过使用户能够以更自然的语言提问,并与 Google Lens 等多模态输入进行互动,从而扩展搜索能力,而非取代传统搜索。Stein 分享了他“不懈改进”的理念,并概述了三大核心产品原则:深入理解用户需求 (JTBD… -
今夜,语音模型第一次超越人类!OpenAI 再现 Her 时刻,95 后华人研究员坐镇
OpenAI 最新发布了 Realtime API 和 gpt-realtime 语音到语音模型,旨在彻底改变 AI 语音交互。Realtime API 简化了语音智能体的构建,支持图像输入、远程 MCP 服务器集成及 SIP 电话功能,实现了语音的直接处理,大幅降低延迟。gpt-realtime 模型在音质上达到近乎真人的水平,具备细腻情感表达和多语种切换能力。同时,其智能与理解力显著提升,能精… -
ChatGPT Atlas:全新 AI 赋能的网络浏览器
OpenAI 近日发布了 ChatGPT Atlas,这是一款以 ChatGPT 为核心构建的全新人工智能驱动的网络浏览器,旨在重新定义网络交互方式。Sam Altman 强调,这是一个重新思考浏览器的绝佳机会,让聊天体验成为核心。其主要功能包括“网页随处聊”,允许 ChatGPT 理解网页上下文并提供即时帮助;以及“浏览器记忆功能”,随着时间的推移,AI 能够学习用户偏好,从而实现个性化的浏览体… -
OpenAI 重新开源!深夜连发两个推理模型,o4-mini 水平,笔记本、手机可跑 | 机器之心
文章详细报道了 OpenAI 自 GPT-2 以来首次重新开源其语言模型,发布了两款高性能推理模型:gpt-oss-120b 和 gpt-oss-20b。这两款模型性能卓越,其中 gpt-oss-120b 与 o4-mini 水平相当,可在高端笔记本上运行;gpt-oss-20b 则可在 16GB 内存的手机上运行。模型采用宽松的 Apache 2.0 许可证,支持可调整的推理力度、完整的思维链(… -
#204. Perplexity CEO 揭秘智能体浏览器 Comet 如何重塑未来
本期播客深度访谈了 AI 搜索引擎公司 Perplexity 的联合创始人兼 CEO Aravind Srinivas,他首次系统性地阐述了下一代产品——智能体浏览器 Comet 的宏大构想。Comet 旨在超越传统浏览器,成为一个真正意义上的“AI 操作系统”,能够无缝连接所有网页应用,自动完成改签机票、处理报销等复杂任务。Aravind 强调了“上下文”在 AI 竞争中的核心地位,认为浏览器是… -
113. 和杨植麟时隔 1 年的对话:K2、Agentic LLM、缸中之脑和“站在无限的开端”
本期播客是月之暗面创始人兼 CEO 杨植麟时隔一年半的深度访谈。对话围绕 Kimi K2 模型的发布及其背后的技术认知和判断展开。杨植麟首先阐述了 AI 发展如同攀登“无限的雪山”,问题不可避免但可解决,强调了 AI 研发中持续迭代和创新的重要性。他详细介绍了 K2 模型在 MoE 架构下的突破,特别是如何通过 Muon 优化器提升 token 效率和泛化能力,实现“吃一份数据等于别人吃两份”的效… -
信息蜂房,更好信息生态的可能|3 万字圆桌实录
文章是腾讯研究院《仲夏六日谈》的一场圆桌讨论实录,深入探讨了从“信息茧房”到“信息蜂房”的信息生态转变。讨论追溯了“我的日报”概念与信息茧房的关联,并剖析了信息茧房的客观存在性、类型及其成因,指出用户认知偏误、惰性与算法共同作用。嘉宾们(胡泳、杨健、黄晨霞)强调了“信息茧房”在学术界应被视为假说,而非既定理论,并提及了大模型可能带来的“幻觉茧房”新陷阱。文章批判性审视了仅靠技术无法解决信息茧房的局… -
Spring AI 1.0 助力简化 AI 系统和服务
本文介绍了 Spring AI 1.0,它是在 Java 和 Spring 生态系统中进行 AI 工程的综合解决方案。它着重强调了各种 AI 模型(聊天、嵌入、图像、转录)的可移植服务抽象,从而可以轻松集成到 Spring Boot 应用程序中。该框架原生支持 RAG(检索增强生成)等关键 AI 工程模式,用于上下文感知响应;同时支持用于代理应用程序的工具调用,从而减少样板代码。此版本还强调与更广… -
Notion CEO Ivan Zhao:好的 AI 产品,做到 7.5 分就够了
文章是 Notion CEO Ivan Zhao 关于 AI 时代产品开发与策略的深度访谈精华。他指出,Notion 致力于将 SaaS 工具整合为统一的“AI 工作空间”,其核心是数据库这一“乐高积木”。面对 AI 产品开发,Ivan Zhao 提出“酿啤酒而非造桥”的比喻,强调 AI 模型具有不确定性,开发需大量实验和引导,而非传统软件的完全可控。他认为理想的产品并非 10 分满分,7.5 分… -
开源 Qwen 凌晨暴击闭源 Claude!刷新 AI 编程 SOTA,支持 1M 上下文
文章报道了阿里通义团队开源 Qwen3-Coder 编程大模型的重要进展。该模型在 AI 编程领域取得 SOTA(State-of-the-Art)表现,不仅超越了开源模型如 DeepSeek V3 和 Kimi K2,甚至在某些指标上超越了闭源的业界标杆 Claude Sonnet 4。Qwen3-Coder 是一款 450B 的 MoE 模型,激活参数 35B,原生支持 256K 上下文,并可… -
Claude Code:增强自主性,赋能开发者
Anthropic 对 Claude Code 进行了重大改进,旨在提高其在复杂开发任务中的自主性和效率。主要更新包括:新的原生 VS Code 扩展,提供更丰富、图形化的界面,可以直接在 IDE 中进行实时差异对比,并补充了刷新的终端界面,改进了状态可见性和可搜索的提示历史记录。文章还介绍了 Claude Agent SDK(以前称为 Claude Code SDK),为开发者提供了构建自定义 … -
GLM-4.5 发布:面向推理、代码与智能体的开源 SOTA 模型
文章详细介绍了智谱最新发布的开源旗舰模型 GLM-4.5 系列,该系列模型(包括 GLM-4.5 和 GLM-4.5-Air)专为智能体应用设计,采用混合专家(MoE)架构。文章强调 GLM-4.5 在推理、代码和智能体综合能力上达到了开源模型中的 SOTA 水平,并在多项基准测试中表现出色,尤其在真实代码智能体的人工对比评测中显示出国内最佳性能。此外,模型在参数效率、API 调用成本和生成速度方… -
Slack 首席产品官 | 规划之道:拥抱速度比以往任何时候都重要
Slack 首席产品官 Rob Seaman 认为,在当前 AI 寒武纪爆发和经济不确定性并存的动荡环境中,传统产品路线图已不再适用。他指出,路线图更易导致功能驱动,而非结果导向,从而降低效率和灵活性。因此,Seaman 建议围绕客户和业务结果进行规划,并通过精简团队的快速原型设计进行验证。其方法的核心在于建立清晰的产品原则,使设计、工程乃至客户支持团队都能参与分布式决策,从而将产品决策权扩展到产… -
Block 如何成为全球领先的人工智能驱动型企业 | Dhanji R. Prasanna
本期播客邀请了 Block 首席技术官 Dhanji R. Prasanna,详细介绍了 Block 向人工智能原生企业的转型过程。他提交给 Jack Dorsey 的“人工智能宣言”是转型的催化剂,推动公司从以总经理为中心的组织结构转变为职能型组织结构,并强调“技术优先”的理念。其中一项核心创新是“Goose”,这是一个基于 Anthropic 的模型上下文协议 (MCP) 构建的开源通用人工智… -
LangExtract 介绍:一款由 Gemini 驱动的信息抽取库
本文介绍 LangExtract,这是谷歌新推出的开源 Python 库,它利用 Gemini 等大型语言模型 (LLM),以编程方式从非结构化文本中提取结构化信息。LangExtract 提供灵活且可追溯的解决方案,解决了手动筛选数据、定制代码开发以及 LLM 产生的虚假信息(也称幻觉)等问题。其主要功能包括精确的来源追溯,确保每个提取的实体都能映射回其来源;以及通过少量样本示例和可控生成技术实… -
首发丨黄仁勋、王坚链博会炉边对话:计算支撑 AI,硅是一切的起源
文章详细记录了英伟达 CEO 黄仁勋与阿里云创始人王坚在链博会上的炉边对话。两位行业领袖回顾了过去十余年人工智能的飞速发展,黄仁勋将 AI 发展划分为感知智能、生成式 AI、推理型 AI,并展望了通用人工智能和物理型 AI 的未来。王坚强调计算是 AI 一切的基础,黄仁勋则补充了 AI 模型训练方式的飞速演变,包括从预训练到人类强化学习,再到后训练时代(AI 自主思考、可验证反馈强化学习、合成数据… -
AI 时代下阿里云基础设施的稳定性架构揭秘
文章详细阐述了阿里云基础设施(包括弹性计算 ECS 和对象存储 OSS)如何实现极致稳定性。首先,文章指出稳定性目标已超越传统的 SLA 可用性,更聚焦于减少故障发生次数、缩小故障影响范围和降低故障恢复时间。其次,文章系统性介绍了阿里云实现稳定性的四大核心原则:深度自主可控(通过自研飞天操作系统、神龙计算平台、盘古分布式存储等)、面向全局的设计(多可用区、多层次冗余与隔离、资源预留)、可控的变更管… -
开源版 Genie 3 世界模型来了:实时+长时间交互,单卡可跑,国内公司出品 | 机器之心
文章详细介绍了昆仑万维推出的开源交互世界模型 Matrix-Game 2.0,该模型以其 1.8B 的轻量级参数和单卡运行能力,实现了实时、长时间的虚拟世界交互生成,被誉为“开源版 Genie 3”。文章首先对比了 Google DeepMind 的 Genie 3,突出了 Matrix-Game 2.0 在实时互动和生成一致性方面的优势。通过多样的实测案例,如《荒野大镖客》、《CS:GO》、《我… -
淘宝直播数字人:LLM 文案生成技术
文章详细介绍了淘宝直播团队如何运用大语言模型(LLM)技术优化数字人直播的文案生成。核心挑战在于生成适合直播口播、信息准确且具备真人风格的文案。文章重点阐述了两方面技术实践:一是基于语义的口播文案改写,利用 DPO 算法优化模型,解决数字、符号、英文等的错误读法问题,准确率达 97%;二是通过分析真人直播 ASR 数据,学习口语化表达,并引入带有“思考过程”的蒸馏模型,有效减少文案的机械感。此外,…
AI 前线
❯
个人中心
购物车
优惠劵
今日签到
有新私信
私信列表
搜索
扫码打开当前页
返回顶部
幸运之星正在降临...
点击领取今天的签到奖励!
恭喜!您今天获得了{{mission.data.mission.credit}}积分
我的优惠劵
-
✈优惠劵使用时效:无法使用使用时效:
之前
使用时效:永久有效优惠劵ID:×
没有优惠劵可用!













