-
RTP-LLM 在相关性大模型中的推理优化最佳实践
在淘宝搜索场景下,引入 3.5B MoE 大模型进行相关性判别面临超大规模计算、超长 Context 及严苛时延(500ms)的挑战。本文详细阐述了基于 RTP-LLM 的优化方案:首先,在调度层通过 Go 语言重构 Proxy,实现基于计算量的均匀拆批与动态负载均衡,并选择 4*1TP 部署模式以规避通信开销;其次,创新性地提出“批次内 KV-Cache 复用”技术,通过投机式 Block 分配… -
CodeBuddy Code 2.0:国产 Claude Code,有点东西
文章详细介绍了腾讯 CodeBuddy Code 2.0(CLI 版本)及其 IDE 的功能特性。作为 Claude Code 的国产平替,它最大的亮点在于无需科学上网即可调用国际顶级编码模型(如 Claude 3.5 等),并内置了 WebSearch 和全量 LSP 支持。2.0 版本新增了 Agent SDK,允许开发者通过极简代码调用具备思考和行动能力的完整 Agent,文中通过“开盒简历… -
【早阅】@Addy Osmani:在 Google 工作 14 年得到的 21 条经验
本文由 Google 知名工程师 Addy Osmani 撰写,系统性地回顾了他在顶级科技公司工作 14 年沉淀的职业智慧。文章核心观点认为,资深工程师的价值不仅体现在编程能力上,更在于处理复杂的人际关系、对齐团队方向以及解决模糊问题的能力。作者提出了 21 条具体建议,涵盖了用户思维(痴迷于解决用户问题而非技术本身)、协作艺术(追求共识而非个人正确)、技术哲学(保持代码清晰、谨慎对待技术创新代币… -
印奇十答:技术路径、公司发展及 AI 产业判断
本文是阶跃星辰董事长印奇的深度访谈总结。印奇阐述了其同时执掌千里科技(AI+车)与阶跃星辰(基础大模型)的双重身份逻辑,提出“大脑+肢体”的协同战略。他认为 AGI 的实现必须经历与物理世界的交互,因此阶跃星辰将战略重心放在“AI+终端”上,重点覆盖出行(车)、个人(手机/穿戴)及家庭(具身智能)三大场景。在技术路径上,阶跃星辰将攻坚语言基模、全模态融合及 VLA(视觉-语言-动作)模型,旨在通过… -
AI Skills:前端新的效率神器!
文章深入探讨了 AI 领域的新热点——Skills。作者首先界定了 Skills 与 Agent(面向目标)、MCP(AI 的 API)的关系,指出 Skills 是将重复性工作、经验和最佳实践封装成的标准化工具包。针对前端开发,Skills 能够解决 AI 生成代码不符合特定规范的问题,实现增删改查、UI 审计及一键部署等任务的标准化输出。文章重点介绍了 Vercel 推出的 skills.sh… -
对话拓竹陶冶:我们一群工程师,一起造个朴素的硬核公司
文章通过对拓竹科技(Bambu Lab)创始人陶冶的深度访谈,回顾了这家硬核硬件公司的创业历程。拓竹由一群追求纯粹工程文化的工程师创立,他们精准选中了 3D 打印赛道,通过引入 AI、激光雷达和自研运动控制算法,解决了消费级 3D 打印机“难用”的底层痛点,实现了产品从极客玩具到大众生产力工具的跨越。陶冶详细分享了公司的管理哲学:坚持工程师主导产品定义、建立极高的人才密度、珍惜不可再生的“互信”资… -
3D 领域的 NanoBanana 也来了,万物皆可用嘴操控。
文章重点介绍了 3D 领域的新突破——Hyper3D 及其产品 Rodin Gen-2。该工具的核心亮点在于实现了“用嘴改模型”,即通过自然语言提示词对 3D 模型进行局部编辑。用户不仅可以实现图生 3D,还能上传任意三方模型(如 obj、fbx 格式)进行添加、移除或修改等操作。作者强调,与简单的重新生成不同,这种局部、可控的增量修改对于维持 3D 资产的一致性(如骨骼绑定、拓扑结构、UV 等)… -
代码 Review 的艺术:如何委婉地告诉同事你写的代码是一坨屎?
文章针对开发者在 Code Review (CR) 中面临的沟通难题,提出了一套实用的软技能指南。作者指出,CR 的核心目标是改进项目而非攻击同事,建议采用“我们”视角替代“你”视角以降低对方的防御心理。文章详细列举了针对变量命名、嵌套逻辑、性能隐患及逻辑不明等常见问题的委婉话术,并主张将格式检查交给自动化工具,将深度争议转为私下沟通。其核心思想在于:代码审查不仅是技术把关,更是团队文化的建设,旨… -
使用 Hugging Face 轻松构建并共享 ROCm 内核
文章聚焦于解决深度学习自定义内核在不同 GPU 架构(尤其是 ROCm)上编译复杂、环境难统一及分发困难的问题。通过引入 Hugging Face 开发的 kernel-builder 和 kernels 库,展示了以 RadeonFlow GEMM 内核为例的标准化构建路径。核心内容包括:利用 Nix 实现可复现的构建环境配置;通过 build.toml 统筹多后端编译参数;将 C++/HIP … -
AI 周刊 #068 - Clawdbot:个人 7 X 24 AI 助手,智谱开源 GLM-4.7-Flash
本期《AI 周刊》聚焦于 AI 助理的私有化部署与工程化落地。核心内容包括:开源项目 Clawdbot 实现了多渠道集成的个人 AI 助手自建方案;智谱 AI 发布了轻量级 MoE 模型 GLM-4.7-Flash,优化了长任务处理能力。在技术探索方面,介绍了 PageIndex 这种基于“目录树”而非向量库的新型 RAG 路径,以及关于 Skills 与 SubAgent 差异的深度辨析。此外,… -
混元图像 3.0 图生图模型上线元宝:一句话就能 p 图
腾讯混元正式发布混元图像 3.0 图生图(HunyuanImage 3.0-Instruct)模型。该模型拥有 80B 总参数量,采用混合专家(MoE)架构,核心突破在于引入了图生图多任务数据与思维链(CoT)技术,使模型能够先理解图像内容并推理编辑步骤,再执行精准操作。模型支持增删改、风格变换、老照片修复及多图融合等 80 多种任务,显著提升了指令遵循度与图像一致性。目前该能力已在腾讯元宝全端及… -
何愚:三年后再吃 5 元一碗的牛肉面,深入县域才能保持体感丨 2025 尾声
本文是黑蚁资本创始合伙人何愚及其团队对中国县域市场的深度观察报告。文章对比了 2022 年与 2025 年的调研数据,指出县域居民虽因宏观氛围产生“体感收缩”,但实际收入基本稳定。县域市场具有高自有房率、低贷款、熟人社会等韧性特征,构成了消费的坚实缓冲层。研究发现,县域消费正从“身份标签”转向“悦己体验”,且连锁业态在效率升级(如零食集合店、奶茶)方面仍有巨大渗透空间。同时,文章探讨了县域女性自我… -
网易云音乐前 CTO 曹偲:代码越来越不重要,好的架构才是软件工程核心
本文是对网易云音乐前 CTO、Toco AI 创始人曹偲的深度访谈。曹偲认为,虽然 AI 极大提升了代码生成效率,但单纯的代码堆砌无法解决软件工程的可维护性难题。他指出,架构决定了软件开发的上下限,AI 时代的研发范式应从关注代码实现转向更高维度的架构抽象。Toco AI 的核心理念是“架构驱动”,通过引入建模方法论(如 DDD、UML 的 AI 化重塑),为软件开发提供确定性和工程化约束。文章讨… -
关于多模态大模型 Token 压缩技术进展,看这一篇就够了
文章针对多模态大模型在处理高分辨率图像和长视频时面临的计算成本高、显存占用大等痛点,深入探讨了 Token 压缩技术。研究团队将现有方法按压缩位置分为视觉编码器(Vision Encoder)、投影器(Projector)和语言模型(LLM)三大模块,并分析了多模块协同压缩的趋势。此外,文章为实际部署提供了选型指南,对比了时空增强压缩、文本引导与纯视觉压缩、Token 合并与丢弃、以及即插即用与重… -
DeepSeek-R1 推理智能从哪儿来?谷歌新研究:模型内心多个角色吵翻了
本文深入探讨了谷歌、芝加哥大学等机构关于大模型推理能力本质的研究。研究发现,DeepSeek-R1 和 QwQ-32B 等高性能推理模型在处理复杂任务时,并非单纯增加计算步数,而是在推理轨迹中展现出显著的“思维社会”特征。这些模型通过模拟不同角色间的提问、视角切换、观点冲突与调和,形成了一种类多智能体的内部交互结构。实验表明,这种对话式行为能有效支持结果核验、路径回溯等认知策略。此外,通过稀疏自编… -
5000 万用户、5000 万美金 ARR,全球第一 AI 创作消费平台要做 AI 时代 Roblox
本文深度分析了全球领先的 AI 内容创作社区 SeaArt 的崛起之路。在行业陷入“性能偏执”导致智能过剩的背景下,SeaArt 洞察到用户对风格、情绪和表达欲的底层需求,通过“超级调度者”模式兼容全球主流模型,避开烧钱的模型竞赛。文章重点介绍了其 2.0 版本 SeaVerse,展示了通过多 Agent 协同实现游戏、App 及多媒体内容全自动生成的实测效果。SeaArt 的核心竞争力在于其积累… -
张颖对话徒手攀岩 Alex:每一次出发,是为了兑现无数次演练后的笃定 |【经纬低调分享】
文章由两部分对话组成:第一部分是 Alex Honnold 在 2026 年成功徒手登顶 508 米台北 101 大楼后的最新访谈,分享了他在城市建筑攀爬中的节奏把控、心理转变以及对摩天大楼攀爬的独特体验;第二部分是 2019 年经纬张颖与 Alex 的深度对谈,聚焦于《徒手攀岩》纪录片背后的酋长岩挑战。Alex 强调,徒手攀岩的核心并非克服恐惧,而是通过无数次的演练和习惯使困难脱敏。张颖则将这种… -
这家赛道内种子轮融资最多的公司,发布了一个真正的口语学习 Agent
本文详细介绍了 AI 语言学习应用 Talkit 的核心理念与产品架构。Talkit 针对真人老师稀缺且昂贵的行业痛点,将 AI Agent 置于系统运行的中枢,负责理解用户目标、规划练习路径并调节反馈节奏。产品通过用户主动输入、实时行为监测以及社交媒体痕迹三条路径实现深度个性化,打破了传统产品依赖预设路径的局限。此外,Talkit 引入了具备人格设定的 3D Avatar 和专属陪伴者 Taki… -
AI 会带来经济爆发,但引线很长|Hao 好聊论文
文章围绕 AI 对宏观经济影响的增速之争,对比了渐进主义(Acemoglu)、爆发论(Epoch AI)及 J 型曲线三种叙事。核心引入了斯坦福经济学家 Charles Jones 的“薄弱环节”理论:在高度互补的经济系统中,总产出不取决于最强的 AI 环节,而是受限于最弱的人类或物理环节。文章分析了技术重构生产函数、AI 渗透率提升及解决物理底座瓶颈三种加速可能,并指出在这一长周期变革中,人类的… -
科学界爆发 AI 认知污染!1 年狂投 50 篇论文,ICLR 投稿 20%AI 生成
文章详细报道了生成式 AI 给学术界带来的严峻挑战。从心理学教授发现完全虚构的“幽灵引用”开始,揭示了 AI 如何凭空编造论文标题与合作网络。文中指出,“论文工厂”已实现工业化作弊,利用 AI 模板批量生产癌症研究等领域的虚假数据与图片。更荒诞的是,由于投稿量激增,审稿人也开始依赖 AI 生成评审意见,甚至出现了作者利用“白色密令”操控 AI 审稿人的谍战情节。这种 AI 产出与 AI 评审的闭环…
AI 前线
❯
个人中心
购物车
优惠劵
今日签到
有新私信
私信列表
搜索
扫码打开当前页
返回顶部
幸运之星正在降临...
点击领取今天的签到奖励!
恭喜!您今天获得了{{mission.data.mission.credit}}积分
我的优惠劵
-
✈优惠劵使用时效:无法使用使用时效:
之前
使用时效:永久有效优惠劵ID:×
没有优惠劵可用!




