-
DeepSeek 把 R1 论文又更新了 60 多页,V4 呼之欲出了吧
DeepSeek 在 R1 论文发布一周年且临近农历春节之际,悄然将其在 arXiv 上的 R1 预印本更新至 v2 版本,页数从 22 页大幅增加到 86 页。此次更新揭示了 R1 模型的完整训练管线,包括 Dev1(指令遵循)、Dev2(推理能力恢复)和 Dev3(最终打磨)三个阶段的详细拆解,首次公开了训练黑箱。同时,论文的评估基准也从最初的 5 个扩展到 20 多个,并引入了人类基线进行对… -
Agent 2.0 时代来了,首批「工业级智能体」正在核心位置上岗
本文探讨了智能体(Agent)技术从「手工作坊」向「工业化流水线」时代转变的趋势,特别介绍了阿里云百炼平台在 Agent 2.0 时代的关键升级。文章指出,智能体已从简单的对话工具发展为具备规划、执行、反思能力的「目标导向的自主执行」实体。阿里云百炼通过「1+2+N」蓝图,在开发组件(多模态 RAG、异步调用 API、Connector 数据连接器)、智能体开发框架(高低代码并行支持 AgentS… -
大模型如何泛化出多智能体推理能力?清华提出策略游戏自博弈方案 MARSHAL
清华大学研究团队提出了 MARSHAL 框架,利用强化学习让大模型通过策略游戏自博弈(Self-Play)来提升多智能体推理能力。该框架通过解决多轮交互的信用分配和多智能体的优势估计两大挑战,实现了模型在游戏中博弈决策水平的显著提升,并在通用推理任务(如数学竞赛和专家级问答)中展现出强大的泛化能力。实验结果证明,自博弈不仅提升了模型在策略游戏中的胜率,更使其习得了角色意识和意图识别等关键涌现能力,… -
Z Product|Suno 在用的客户调研 Agent,Dialogue AI 重构千亿美元的市场研究产业,VC 正在押注“理解的速度”
文章深入分析了名为 Dialogue AI 的初创公司,该公司旨在利用 AI 重构千亿美元的市场研究产业。传统市场调研流程漫长且成本高昂,而 Dialogue AI 通过打造一个端到端的 AI 原生平台,实现了从研究设计、参与者招募、AI 主持访谈到即时洞察的全流程自动化,将项目周期从数周缩短至一两天。文章详细阐述了 Dialogue AI 在探索性研究、概念测试、可用性测试和客户之声等应用场景中… -
刚刚,AI 企业 IPO 最速纪录刷新!MiniMax 的技术野心,价值超 800 亿港元
上海希宇科技(MiniMax)以四年最速纪录港股 IPO 上市,市值冲破 800 亿港元,成为“大模型六小龙”中引人注目的企业。其招股书揭示 ToC 收入反超 ToB,累计个人用户达 2 亿,AI 原生产品 MAU 约 2760 万,服务超过 10 万家企业与开发者。资本市场对 MiniMax 估值主要源于其深厚的技术野心和实力。该公司长期投入研发,是国内唯二高频更新技术论文的 AI 公司。其核心… -
AI 办公硬件新标杆:未来智能携 viaim 亮相 CES 2026,斩获微软人工智能创新奖
文章报道了中国 AI 硬件企业未来智能及其全球品牌 viaim 在 CES 2026 上的表现。未来智能展示了讯飞 AI 会议耳机 Pro3 与 Air2,这些产品以“AI work mate”为定位,提供录音转写、实时翻译、AI 摘要、AI 嘴替等高级功能,精准解决了全球办公场景中的痛点,并在消费级设备红海中开辟了 AI 办公硬件这一独特赛道。此外,未来智能凭借其创新产品和“一脑多端”的 AI … -
市场偏爱 MiniMax:1837 倍超额认购,开盘即涨 42%,市值超 700 亿
MiniMax 于 1 月 9 日正式在港交所主板上市,开盘价高开约 42.67%,市值突破 700 亿港元。此次 IPO 认购热度空前,公开发售超额认购达 1837 倍,国际配售超额认购 79 倍,吸引了全球顶级长线基金。文章深入分析了 MiniMax 获得市场青睐的原因:其一,实现了文本、语音、音乐、视频全模态技术的成功布局,且研发成本仅为 OpenAI 的 1%;其二,具备“生而全球化”的基… -
2026 年 AI 不再“讲故事”!斯坦福教授:布道结束,开始查账
文章基于斯坦福大学以人为本人工智能研究院 (HAI) 的预测和 SVTR AI 创投库数据,指出 2026 年 AI 领域将从宏大叙事转向务实评估。核心观点包括:AI 主权将从“自建大模型”变为“GPU 集群+数据本地部署”的务实方案,利好英伟达和 OpenAI;企业 AI 应用将告别“全能神话”,转向小而美的垂直定制化解决方案,重视投资回报率;医疗 AI 可能通过直接面向 C 端患者颠覆传统医疗… -
二线电池厂,活在巨头阴影下
本文深度剖析了中国二线动力电池厂在市场巨头阴影下的生存困境。通过欣旺达被吉利索赔 23 亿元的案例,文章揭示了二线厂商普遍面临的“增收不增利”、财务结构不健康、客户议价权缺失等问题。作者指出,二线厂商在原材料成本、中游产能利用率、下游议价权三方面均处于劣势,导致利润空间被严重挤压。在与车企合作中,二线厂商常被视为“压价筹码”和“备胎”,订单不稳定且需低价竞争,使得其在质量风险面前极其脆弱。此外,文… -
MiniMax 今早上市,股价疯涨 80%!一群 95 后跑通了中国 AI 的价值
新智元报道 MiniMax 成功在港交所上市,开盘股价疯涨近 80%。文章指出,MiniMax 以仅为 OpenAI 约 1% 的花费(5 亿美元)跻身全球全模态 AI 第一梯队,这得益于其在创业初期对技术路径的精准预判,即坚持文本、语音、视频全模态并行研发。公司通过极致的工程效率、正确的技术押注和创新的组织形式(平均年龄 29 岁的团队、AI Native 工作流),打破了“AI 是巨头游戏”的… -
DeepMind 发布 SIMA 2!打通「感知-推理-行动-反思」闭环
DeepMind 发布了其具身通用智能原型 SIMA 2,这是一个能在虚拟环境(商业游戏)中,通过多模态推理实现“感知-推理-行动-反思”闭环的智能体。SIMA 2 整合了 Gemini 的多模态推理能力,使其不仅能遵循自然语言指令,还能理解用户目标、进行复杂推理、与用户对话并自我提升。它展示了强大的泛化能力,能将在一个游戏中学习到的技能迁移到另一个游戏中,并在广泛任务上的表现接近人类水平。文章强… -
Dify × 阿里云计算巢:实现分钟级部署,企业级高可用更省心
本文介绍了 Dify 与阿里云计算巢结合,为企业级 AI 应用提供分钟级部署和高可用运维的解决方案。文章首先指出传统私有化部署面临资源分散、配置复杂、环境不一致和运维割裂等四大痛点。接着详细阐述了计算巢如何通过一键拉起完整 Dify 环境、统一视角集中运维、极速部署与弹性扩展,以及持续演进升级等能力,解决这些痛点。文章还探讨了向量数据库选型的隐性成本,并推荐阿里云表格存储(Tablestore)作… -
告别数据库“膨胀”:Dify x SLS 构建高可用生产级 AI 架构
本文深入探讨了 Dify 作为流行的低代码 LLM 应用开发平台,在大规模生产环境中面临的数据库性能瓶颈问题,尤其指出其执行引擎对 PostgreSQL 的高度依赖导致的高负载、连接占用、扩展性不足和分析能力缺失等核心痛点。文章分析了 Dify 工作流日志数据的日志特征与关系型数据库 PG 的错配根因,并提出了采用阿里云日志服务(SLS)作为解决方案。详细阐述了 SLS 在极致弹性、高写入吞吐、低… -
763 亿港元,大模型公司最大规模 IPO!MiniMax 登陆港交所,开盘前大涨 50%
本文详细报道了国内通用大模型公司 MiniMax 在香港交易所主板的首次公开募股(IPO)情况。文章指出 MiniMax 此次以每股 165 港元定价上限发行,募集资金约 55.4 亿港元,公开发售超额认购 1837 倍,上市首日开盘前涨幅一度超 50%,市值突破 763 亿港元,并吸引了包括阿里巴巴在内的多家基石投资者。文章深入分析了 MiniMax 成功的两大核心战略:技术侧坚持多模态并行研发… -
刚刚!MiniMax 敲钟上市,市值高达 827 亿港元!闫俊杰爆料:内部代码 80%都由 AI 完成,公司平均年龄 29 岁,账上超 10 亿美金
MiniMax 紧随智谱之后,正式登陆港交所,市值高达 827 亿港元,成为中国大模型上市公司的第二家。该公司由前商汤科技高管创立,专注于研发文本、语音、视觉多模态通用人工智能技术,成立仅四年即完成 IPO,刷新全球 AI 领域最短上市记录。文章详细介绍了 MiniMax 的用户和营收情况,拥有超过 2 亿全球用户,海外收入占比超 70%,2024 年营收同比暴涨 782.2%。其核心策略是“模型… -
2026-01-10 Hacker News Top Stories #
本文汇总了 Hacker News 2026 年 1 月 10 日的十大热门话题。内容涵盖 Google AI Studio 赞助 Tailwind CSS 引发的开源可持续性讨论,Anthropic 限制 Claude Code 订阅引发的定价策略和服务合规争议,一篇用约 200 行 Python 代码实现 LLM 工具调用的编程助手教程,欧洲委员会就开放源代码发起的证据征集旨在提升技术主权,以… -
MongoBleed 漏洞允许攻击者从 MongoDB 堆内存中读取数据
MongoDB 最近修补了 CVE-2025-14847,该漏洞被命名为 "MongoBleed",是一个 CVSS 评分为 8.7 的关键漏洞,允许未经身份验证的远程攻击者读取未初始化的堆内存。该缺陷源于基于 zlib 的网络消息解压缩中的长度处理错误,发生在身份验证之前。这可能导致凭据或令牌等敏感数据被窃取。Wiz 的安全研究人员确认了野外活跃利用,根据 Censys 的数… -
OpenAI 还怎么玩?谷歌凌晨炸场!Pro 级智商跌成“白菜价”,网友惊呼:六边形战士
文章详细介绍了谷歌最新发布的 Gemini 3 Flash 大模型,强调其在推理能力上匹敌旗舰模型 Gemini 3 Pro,同时拥有更快的响应速度和显著降低的成本。通过在 GPQA 博士级推理、多模态理解和编码智能体等多项基准测试中取得“屠榜”表现,Flash 版模型展现了“小而强”的进化。文章还深入探讨了其核心技术原理,如“思考层级”参数和上下文缓存,以实现性能与成本的平衡。它在复杂视频分析、… -
Vol.76 我们不知不觉的走到了这里---170 页 PPT 讲透 2025AI 行业
本期播客基于一场 170 页的深度 PPT 演讲,全面剖析了 2025 年 AI 行业的现状与未来趋势。内容涵盖技术、产品、资本和泡沫四大核心板块。在技术层面,主播深入探讨了自然语言模型、多模态和 Agent 的演进趋势及挑战,如推理模型的主导地位、强化学习的广泛应用、数据获取与记忆拓展的难题、以及传统 Benchmark 评估标准的失效。同时,详细对比了中美 AI 模型公司的竞争格局和估值差异。… -
从 o1-mini 到 DeepSeek-R1,万字长文带你读懂推理模型的历史与技术
文章详细梳理了推理模型从 OpenAI 的 o1-mini 到 DeepSeek-R1 的发展历程,并深入探讨了其背后的技术原理。首先介绍了推理模型与标准 LLM 的区别,强调了长思维链在推理过程中的重要作用。接着,文章深入分析了如何通过强化学习训练推理模型,特别是利用可验证奖励进行训练的方法。此外,还探讨了推理时间策略,如思维链和解码技术,以及并行解码和自我优化等方法。文章重点介绍了 DeepS…
AI 前线
❯
个人中心
购物车
优惠劵
今日签到
有新私信
私信列表
搜索
扫码打开当前页
返回顶部
幸运之星正在降临...
点击领取今天的签到奖励!
恭喜!您今天获得了{{mission.data.mission.credit}}积分
我的优惠劵
-
✈优惠劵使用时效:无法使用使用时效:
之前
使用时效:永久有效优惠劵ID:×
没有优惠劵可用!






