-
AAAI 2026 Oral | SplatSSC:解耦深度引导的高斯泼溅,开启单目语义场景补全高效新范式
本文介绍了入选 AAAI 2026 Oral 的研究成果 SplatSSC。该研究针对单目 3D 语义场景补全(SSC)中传统随机初始化高斯基元效率低下以及离群点导致“漂浮物”伪影的痛点,提出了两大核心创新:一是组内多尺度融合模块(GMF),利用预训练深度模型提供几何先验,将基元数量缩减至前作的 7% 却实现了更精准的覆盖;二是解耦高斯聚合器(DGA),通过独立预测几何占据与语义分布,利用门控机制… -
比人类专家快 2 倍,斯坦福联合英伟达发布 TTT-Discover:用「测试时强化学习」攻克科学难题
本文介绍了斯坦福大学和英伟达等机构联合研发的 TTT-Discover 方法。该方法突破了传统“测试时搜索”仅靠提示词工程的局限,提出在解决特定测试问题时,让大语言模型(LLM)通过强化学习(RL)进行持续的参数更新和自我进化。针对科学发现中“追求极致解而非平均分”的特点,TTT-Discover 引入了自适应熵目标函数和受 PUCT 启发的状态复用策略,使模型能聚焦于高奖励的突破性方案。实验证明… -
万物皆可参考是种什么体验?Vidu Q2 参考生 Pro:特效、演技、细节全都要
本文详细介绍了生数科技最新发布的视频大模型功能——Vidu Q2 参考生 Pro。该版本核心突破在于实现了“万物可参考”,将参考模态从静态图像扩展至动态视频,支持人物、场景、特效、表情及材质纹理的深度迁移。文章通过多个实测场景展示了其在复刻经典电影演技、一键生成百万级特效、物理级材质换皮以及精准视频元素增删(如抹除手机、添加物体)方面的卓越表现。Vidu Q2 显著提升了 AI 视频的可控性,支持… -
万物皆可参考是种什么体验?Vidu Q2 参考生 Pro:特效、演技、细节全都要
本文详细介绍了生数科技最新发布的视频大模型功能——Vidu Q2 参考生 Pro。该版本核心突破在于实现了“万物可参考”,将参考模态从静态图像扩展至动态视频,支持人物、场景、特效、表情及材质纹理的深度迁移。文章通过多个实测场景展示了其在复刻经典电影演技、一键生成百万级特效、物理级材质换皮以及精准视频元素增删(如抹除手机、添加物体)方面的卓越表现。Vidu Q2 显著提升了 AI 视频的可控性,支持… -
[AINews] Moonshot Kimi K2.5 发布 - 成本减半性能超越 Sonnet 3.5,SOTA 开源模型,首个原生图像+视频支持,100 并行智能体集群管理
本文详细介绍了月之暗面发布的 Kimi K2.5,这是一个拥有 1 万亿参数(32B 激活)的大规模混合专家(MoE)模型。关键技术进步包括支持视频理解的原生多模态能力,使模型能够通过屏幕录像重建网站。该模型引入了“智能体集群(Agent Swarm)”测试功能,支持多达 100 个子智能体在 1,500 个步骤中执行并行工作流,声称速度提升了 4.5 倍。据报道,K2.5 在 HLE 和 Bro… -
DeepSeek 开源全新 OCR 模型!弃用 CLIP 改用 Qwen 轻量小模型,性能媲美 Gemini-3 Pro
DeepSeek 正式开源 DeepSeek-OCR 2,这是一款专注于将 PDF 精准转换为 Markdown 的多模态模型。该模型的核心创新在于弃用了传统的 CLIP 组件,转而采用轻量化语言模型(Qwen2-0.5B)构建 DeepEncoder V2。这一改变打破了传统 OCR 固定的“光栅扫描”逻辑,通过引入双流注意力机制和因果推理能力,使模型能够模拟人类阅读习惯,在进入解码器前对视觉标… -
K2.5,是 Kimi 的一个分水岭
文章对月之暗面最新发布的 Kimi K2.5 模型进行了深度解析与感性评价。作者认为 K2.5 是 Kimi 的重要分水岭,标志着国产头部模型在原生多模态领域取得重大突破,能够直接从视频输入生成高质量代码。文章从行业地位和产品质感两个维度展开:在技术层面,K2.5 采用 15T 混合数据训练,实现了视觉与文本能力的同步提升,对标国际顶尖模型;在产品层面,Kimi 回归了极简、专业的技术派美学,其官… -
AI Agent 是长期运行的“风险系统”,如果你还只在防 Prompt Injection,说明已经落后一代了
文章深入探讨了 AI Agent 在长期运行工作流中面临的安全挑战,指出传统的提示词注入防御已不足以应对复杂的外部数据威胁。CyberArk 首席架构师 Niv Rabin 提出了一套分层防御流水线:首先利用“蜜罐动作”诱捕恶意探测行为;其次通过基于 LLM 的“指令检测器”识别外部 API 或数据库返回结果中的隐蔽指令;最后引入“历史感知校验”机制,将多轮交互历史合并审查,以防御将恶意指令拆分隐… -
从局部最优到全局跃迁:关于企业“智慧运营中枢”模式的构建与实践思考
文章深入探讨了企业从信息化、数字化向数智化转型的必然趋势与挑战。作者指出,当前转型面临战略脱节、业技融合流于形式及盲目追逐新技术等核心痛点。为破解困境,文章提出以“企业架构”为理论基础,构建“智慧运营中枢”模式。该模式通过“运营、生产、保障”三大平面的宏观协同,以及“V 字模型”的微观标准化实施体系,实现了业务拆解与数智赋能的闭环。针对 AI 浪潮,作者强调应利用大模型重塑业务价值链,而非简单的工… -
内存一年疯涨 170%,云账单里的“隐性成本”该算清了
文章分析了 2025 年 DRAM 合同价同比上涨 171.8% 对企业 IT 成本带来的巨大冲击。在硬件采购压力激增的背景下,传统云服务器固定的 CPU 与内存配比(如 2 核 4GB)导致了严重的资源闲置与成本浪费。为此,华为云推出了 Flexus 云服务器 X 实例,核心引入“柔性算力”概念,支持非标准比例的资源组合(如 3:7),并结合擎天架构与瑶光云脑实现资源解耦与智能调度。此外,通过 … -
算法选中的“绿色黄金”:深聊抹茶全球爆火背后的商业逆袭史
文章详尽探讨了抹茶在 2025 年席卷全球的商业现象。抹茶的成功源于两轮浪潮:早期由哈根达斯和星巴克推动的主流化,以及近期由 TikTok 等社交媒体算法驱动的生活方式化。抹茶凭借“视觉瘾、健康瘾、仪式瘾”满足了现代消费者的情绪需求。然而,爆火背后隐藏着分级标准混乱、日本产区受气候和老龄化影响导致的减产危机,以及中国抹茶凭借规模化优势在供应链端的“暗度陈仓”。尽管面临非刚需和高溢价挑战,抹茶已从单… -
Kimi 玩了把大的,Agent 团战的时代要来了。
文章详细评测了 Kimi 最新发布的 K2.5 模型。该模型在多模态能力上表现突出,支持通过截图、手绘稿甚至操作视频直接复刻出具有高审美水准的可交互网页。此外,K2.5 引入了 Agent Swarm(集群)模式,能够自主拆解复杂任务并调度多个专家级 Agent 并行协作,在批量绘图、多渠道信息检索及深度学术调研等场景下大幅提升效率。针对开发者,Kimi Code 接入了 K2.5 内核,提供高性… -
10 亿红包后,我们打算开源这个 800 亿的模型
本文介绍了腾讯混元图像 3.0 图生图模型(HunyuanImage 3.0-Instruct)的正式开源。该模型基于 80B 总参数(激活参数约 13B)的混合专家架构(MoE),是目前全球最强的开源图像编辑模型之一。其核心创新在于将文本理解、视觉理解与图像生成深度融合,并引入了思维链(CoT)数据,使模型具备“先思考,后编辑”的能力。通过自研的 MixGRPO 算法,模型在指令响应和非编辑区域… -
HTML Invoker Commands 在所有主流浏览器中实现基准支持
本文报道了 HTML Invoker Commands API 在所有主流浏览器(Chrome、Firefox 和 Safari)中达到基准支持的消息。该 API 为 button 元素引入了 `commandfor` 和 `command` 属性,允许开发者直接在 HTML 中触发 popover 和 dialog 等交互元素的动作。这一转变减少了对手动编写 JavaScript 事件监听器的需… -
BAI、高瓴领投,ThetaWave 李文轩:我们想成为下一代年轻人默认的知识获取入口
本文是对 ThetaWave AI 创始人李文轩的深度访谈。ThetaWave 是一款专注于 AI-Native 知识获取的产品,通过「拖入-整理-生成」的交互流,将冗长的学习资料转化为知识图谱、笔记、题库等结构化内容。公司已实现百万美元 ARR,用户留存表现优异。李文轩详细阐述了其创业方法论:在「想做、能做、可做」的交集中寻找机会,并利用 TikTok/Instagram 的 UGC 矩阵实现低… -
腾讯混元图像 3.0 图生图开源,LMArena 跻身全球第一梯队,开源最强
腾讯混元团队正式开源混元图像 3.0 图生图版本(HunyuanImage 3.0-Instruct)。该模型在权威大模型竞技场 LMArena 的图像编辑榜单中位列全球第七,是前七名中唯一的开源模型。技术上,它基于 80B 总参数的混合专家(MoE)原生多模态架构,核心创新在于引入“思维链”数据,实现“先思考,后编辑”的工作流,能精准理解图像内容并按指令进行增删改、风格变换及多图融合。模型训练采… -
黄仁勋预言落地,物理 AI 开年第一枪竟是中国公司打响
本文详细介绍了文远知行推出的通用仿真模型 WeRide GENESIS。该模型被定义为连接物理 AI 与生成式 AI 的桥梁,其核心优势在于“通用性”,能同时支撑 L2+ 量产方案与 L4 级无人驾驶产品的研发。WeRide GENESIS 包含 AI 场景、AI 主体、AI 指标和 AI 诊断四大模块,不仅能一句话生成高拟真的长尾场景,更重要的是通过自动化的量化评估与根因分析,解决了行业内常见的… -
喊话特朗普重视 AI 风险,Anthropic CEO 万字长文写应对方案,这方案也是 Claude 辅助完成的
文章深度解读了 Anthropic 联合创始人 Dario Amodei 的最新长文及访谈内容。Dario 将当前 AI 阶段比作“技术的青春期”,认为 AI 能力的暴涨远超人类社会制度的成熟度。他详细列举了 AI 不可控、被滥用(如生物武器)、成为权力工具、冲击经济(50% 初级白领岗位受威胁)及引发社会连锁反应这五大系统性风险。针对这些风险,他提出了包括宪法式 AI、机械可解释性研究、芯片出口… -
2026-01-28 Hacker News Top Stories #
文章精选了 Hacker News 上的多项热点。技术层面:Kimi K2.5 以万亿参数和 MoE 架构发布,支持高效的代理集群模式;ChatGPT 容器功能重大升级,支持运行 Bash 及安装第三方包,显著增强了 AI 的自主执行力;开发者分享了用 Rust 实现类 Git 系统(tvc)的经验;JuiceSSH 遭遇“退出诈骗”后,社区提供了反编译恢复 Pro 功能的技术方案。社会与科学层面… -
早报|OpenAI 推出科研写作工具 Prism/Kimi 推出最强开源 Agent 模型/AI 承诺内容有误赔 10 万,首例 AI 幻觉案宣判
文章全面梳理了近期科技领域的重大动态。在人工智能方面,月之暗面发布了具备原生多模态能力的 Kimi K2.5,引入 Agent Swarm 机制显著提升复杂任务效率;OpenAI 针对科研群体推出了集成 GPT-5.2 的 LaTeX 协作空间 Prism。法律与社会层面,杭州互联网法院对国内首例「AI 幻觉」侵权案作出判决,明确 AI 承诺不具法律效力。硬件与供应链方面,苹果接受存储芯片大幅涨价…
AI 前线
❯
个人中心
购物车
优惠劵
今日签到
有新私信
私信列表
搜索
扫码打开当前页
返回顶部
幸运之星正在降临...
点击领取今天的签到奖励!
恭喜!您今天获得了{{mission.data.mission.credit}}积分
我的优惠劵
-
✈优惠劵使用时效:无法使用使用时效:
之前
使用时效:永久有效优惠劵ID:×
没有优惠劵可用!



![[AINews] Moonshot Kimi K2.5 发布 - 成本减半性能超越 Sonnet 3.5,SOTA 开源模型,首个原生图像+视频支持,100 并行智能体集群管理](https://image.jido.dev/20260128053305_827f47a5-bf64-47b9-ba34-d67db26c0d16_1072x978.png)





