-
上海交大/上海 AI Lab 翟广涛:当评测不再重要,AGI 就实现了 | 机器之心
文章引述上海交通大学教授、上海人工智能实验室双聘研究员翟广涛的观点,深入剖析了当前 AI 模型评测体系所面临的深层困境。翟教授指出,现有评测体系存在“数据污染”导致分数虚高,以及将复杂智能“原子化”拆解的局限性,使模型成为“应试专家”而非具备综合能力的实体。这种“进步的幻觉”掩盖了评测尺子本身的问题,导致行业陷入对智能的集体误判。为此,翟教授提出“以人为中心”的评测理念,以用户主观体验(QoE)为… -
AI 时代的未来公司:揭秘不写代码的产品团队,15 人如何撑起 4 款产品与咨询业务
文章深入访谈了 Every 公司联合创始人兼 CEO Dan Shipper,详细阐述了其 15 人团队在 AI 时代下的创新运营模式。Every 公司通过设立“AI 运营负责人”实现全员自动化,产品团队不再手写代码,而是利用强大的 AI Agent 辅助甚至主导产品设计、原型开发与迭代,践行“复利式工程”理念,即让每一次工作都为下一次加速。Dan Shipper 提出 AI 不会大规模取代工作,… -
图灵奖得主 Hinton 国内首次现身演讲:AI 超越人类后,我们该怎么做
文章整理了图灵奖得主杰弗里·辛顿在世界人工智能大会上的演讲实录。辛顿首先回顾了 AI 发展历史上的两种范式,并详细阐述了大语言模型(LLM)如何通过特征整合来理解语言,认为其本质上与人类思维模式相似,甚至可能产生“幻觉”。接着,他对比了数字智能与生物智能在知识迁移效率上的巨大差异,指出数字智能能以指数级速度复制和共享知识。最后,辛顿警示了超智能 AI 在超越人类后可能自发产生“生存”和“增强控制力… -
小红书大模型探索实践:从 0 到 1 构建自研 RLHF 框架
本文详细介绍了小红书大模型团队从零到一构建 RLHF(基于人类反馈的强化学习)训练框架的探索与实践。文章首先阐述了 RLHF 及 PPO 算法的背景和原理,指出了 PPO 训练中多模型协同、多阶段数据流带来的工程痛点。为解决这些挑战,团队设计并实现了创新的异构与同构组网架构,通过模型分时复用和集群资源复用,大幅降低了 GPU 集群规模和通信开销。在此基础上,文章进一步介绍了数据加载、并行策略、显存… -
智谱发布新一代旗舰模型 GLM-4.5,面向推理、代码与智能体的开源 SOTA 模型!
智谱发布了其新一代旗舰模型 GLM-4.5 和 GLM-4.5-Air,专为智能体设计,统一了推理、编码和智能体能力。GLM-4.5 系列是混合推理模型,支持思考和非思考两种模式,并在多项行业基准测试中表现卓越,以 MIT 许可证开源。文章详细介绍了模型的下载方式、基于 vLLM 和 SGLang 的推理推荐配置及代码示例,以及使用 ms-swift 框架进行 LoRA 微调的完整步骤,包括环境准… -
WebShaper:探索 DeepResearch 的数据理论基础
WebShaper 是通义实验室为 AI 智能体(Agent)领域推出的全新训练数据合成系统,其核心目标是解决训练数据质量对模型上限的制约问题,并深入探索了 AI 在复杂信息检索任务中的数据理论基础。文章详细阐述了 WebShaper 的三大核心技术模块:首先,它首次提出了基于集合论的 IS(Information Seeking)任务形式化建模方法,通过“知识投影”(Knowledge Proj… -
他救了 OpenAI、年赚过亿、三家明星 CTO,却自曝跟不上 AI 发展了!硅谷大佬告诫:不是马斯克,就别碰大模型
文章深入访谈了 OpenAI 董事会主席、硅谷知名连续创业者 Bret Taylor。Taylor 首先回顾了他在 OpenAI 危机中扮演的关键调解角色,并分享了早期在谷歌开发 Google Maps 的经历,强调了产品差异化和用户价值的重要性。他指出,AI 市场将最终分化为前沿基础模型、AI 工具层和应用型 AI 市场,并极力看好应用型 AI(特别是 Agent)的爆发潜力,认为“智能体就是新… -
打造高效开发者门户:赋能与创新
本次演示文稿深入探讨了内部开发者门户 (IDP) 在提升开发者体验 (DX) 和促进组织内部创新方面的关键作用,尤其是在快速增长的组织中。SPS Commerce 的 Travis Gosselin 强调了开发者面临的日益严峻的挑战,例如工具泛滥导致的认知负担和过多的非编码任务。他将 IDP 定义为一个用于拥有、运营和改进软件的中心枢纽,基于四大核心支柱:全面的软件目录、自助服务能力、清晰的标准评… -
Alex Soto 于 Spring I/O 2025 探讨人工智能应用测试:驯服方法
Alex Soto 在 Spring I/O 2025 大会上的演讲提供了一个关于测试人工智能应用的综合指南,特别是大语言模型(LLM),由于其非确定性、不可预测性和容易产生幻觉的特性,这些模型带来了独特的挑战。它介绍了一种三层测试方法:面向开发者的持续集成(CI)测试、用于行为验证的评估(类似于 BDD)以及生产环境中的 A/B 测试。CI 的关键技术包括降低大语言模型温度和实施结构化输出。对于… -
性价比搏击:Grok 4 Fast 推理成本直降 98%
文章详细介绍了 xAI 最新发布的 Grok 4 Fast 模型,该模型在几乎没有预热的情况下,将大模型推理调用成本大幅降低 98%,最低可降至原来的 2%,对大模型竞争规则产生深远影响。Grok 4 Fast 采用端到端工具使用强化学习进行训练,具备原生的工具调用能力和自主探索能力,尤其在 AI 搜索任务上表现优异,并在 LMArena 搜索竞技场中位列第一。它拥有 200 万 token 的上… -
万物流转:Joris Kuipers 在 Spring I/O 2025 大会上关于 Spring Boot 运行时配置更新的演讲
Joris Kuipers 的本次演讲旨在解决 Spring Boot 中静态配置所带来的挑战,即配置变更通常需要重启应用,导致停机、内存状态丢失以及 JVM JIT 编译优化失效。他介绍了 Spring Cloud Context、`@RefreshScope` 注解和 `/refresh` Actuator 端点等核心机制,以实现动态配置的重新加载。演示展示了这些功能如何支持对 `@Confi… -
Elad Gil,“创始人的教父”,硅谷最成功的独立投资人
文章深入剖析了硅谷传奇独立投资人 Elad Gil 的投资哲学与实践。作为科学家转型的企业家兼投资人,Gil 凭借跨文化背景和深厚行业经验,发展出'投资于人'的核心策略,成功押注 Airbnb、Stripe、Notion 等明星公司。他打破传统 VC 模式,构建了更敏捷的新型资本机制,在 AI 时代全面布局从基础模型(Mistral)到垂直应用(Harvey)的关键项目。同时,… -
万字演讲:Dify 插件如何助力 AI Agent 应用开发?
文章详细介绍了 Dify 插件生态如何通过技术平权助力 AI Agent 应用开发。Dify 作为开源生成式 AI 应用开发平台,通过插件系统解决了开发者面临的工具调用、模型管理和应用构建等问题。文章分享了 Dify 插件生态的设计思路、技术架构实现细节(包括 Serverless 架构和反向调用等关键技术)以及 120 多个实际插件案例,展示了插件在 AI Agent 开发中的优势,包括降低开发… -
短视频平台“Top100 新闻达人”洞察报告|附 2 万字报告下载
腾讯研究院与新榜联合发布的这份报告,全面深入地探讨了短视频平台“新闻达人”的现象。文章首先指出短视频已成为中国用户获取新闻的主要渠道,并分析了“新闻达人”作为兼具新闻专业性与短视频表达灵活性的“轻骑兵”,如何重塑新闻传播格局。报告详细描绘了“新闻达人”的群体画像,包括粉丝规模、地域分布、内容策略(如时政社会类内容高度集中)和用户特征(显著的“中龄化”,精准匹配了他们对深度和价值信息的刚性需求)。文… -
Gamma 创始人最新分享:30 人即可服务 5000 万用户,AI 时代如何重构新的团队范式?
文章详细解读了 Gamma 联合创始人兼 CEO Grant Lee 关于 AI 时代团队重构的分享。核心观点包括:一、从招聘单一技能的专才转向招聘具备跨领域学习和教学能力的通才,以适应技术快速迭代和多角色需求。二、引入“球员教练”模式,鼓励领导者保持一线实战能力,从而做出更精准的技术决策并有效指导团队。三、强调通过投资企业品牌和文化来替代传统的大规模扩张,构建紧密、高效的“小部落”式团队,提升凝… -
三个月、零基础手搓一块 TPU,能推理能训练,还是开源的 | 机器之心
文章详细介绍了加拿大西安大略大学工程师团队在三个月内,从零基础开始,通过“重新发明”而非逆向工程的方式,成功构建出开源的机器学习推理与训练芯片 TinyTPU。文中深入浅出地解释了 TPU 的核心架构,如脉动阵列(Systolic Array)如何高效执行矩阵乘法,以及流水线(Pipelining)、双重缓冲(Double Buffering)等硬件优化技术。特别地,文章还阐述了如何在硬件层面实现… -
社区供稿丨 MiniCPM-V 4.5 技术报告正式出炉
面壁智能的 MiniCPM-V 4.5 是一款 8B 参数的多模态大模型,其技术报告深入探讨了解决多模态大模型训练和推理效率瓶颈的三大核心技术。首先,文章介绍了统一的 3D-Resampler 架构,通过时空联合压缩实现高达 96 倍的视频视觉 Token 压缩率,显著提升视频理解效率和性能。其次,提出面向文档的统一 OCR 和知识学习范式,通过控制文字可见度扰动,将 OCR 和知识学习融合,摆脱… -
使用 Sentence Transformers v5 训练与微调稀疏嵌入模型
本指南详细讲解如何使用 Sentence Transformers v5 训练与微调稀疏嵌入模型(Sparse Embedding Models),涵盖三种主要架构:SPLADE、免推理 SPLADE(Inference-free SPLADE)和 CSR。文章阐释了密集(dense)与稀疏(sparse)嵌入模型的关键差异,重点突出稀疏模型在可解释性(通过与词汇表对齐的维度)和混合式检索(hyb… -
「我怕活不到毕业」!AI 引爆美国退学潮,18 岁 PPT 式创业震惊 YC 之父
文章深入剖析了美国顶尖大学因 AGI 发展而出现的“辍学潮”现象。一方面,部分学生因担忧 AGI 可能带来的生存威胁,如 Alice Blair 和 Adam Kaufman,选择辍学投身 AI 安全领域;另一方面,另一些学生则因担心错过 AI 发展风口而选择创业。文章引用多位专家观点,如 Stuart Russell、Hinton 对 AI 风险的警告,以及美国国务院报告,揭示了学生们普遍存在的… -
AI 应用:浮现中的 AI 经济 | 机器之心
文章从人类经济活动的数字化进程出发,阐述了计算机和互联网时代如何提升了匹配效率。随后,重点分析了 AI,特别是大语言模型出现后,如何使计算能力具备泛化交付工作能力,并在 2025 年达到超越人类的临界点。作者提出了 AI 经济的六大特征:全天候自动运行、无劳动力供给限制、迈向非稀缺经济、交易成本显著降低、非理性决策减少,以及人类能够“向历史求解”以寻求“时空最优解”。文章展望了 AI 如何促进人的…
AI 前线
❯
个人中心
购物车
优惠劵
今日签到
有新私信
私信列表
搜索
扫码打开当前页
返回顶部
幸运之星正在降临...
点击领取今天的签到奖励!
恭喜!您今天获得了{{mission.data.mission.credit}}积分
我的优惠劵
-
✈优惠劵使用时效:无法使用使用时效:
之前
使用时效:永久有效优惠劵ID:×
没有优惠劵可用!











