-
社区投稿 | Clawdbot:技术架构与国产软件生态适配分析
文章首先介绍了 2026 年初爆火的开源项目 Clawdbot,这是一个主打“本地优先”和“隐私受控”的个人 AI 网关。其核心架构由控制平面(Gateway)、执行平面(Pi Agent)、接入层(多渠道集成)和知识扩展层(Skills)组成,支持将 AI 能力无缝嵌入 WhatsApp、Telegram 等通信工具。随后,文章重点分析了该架构在国产生态下的适配潜力:认为飞书、企业微信和钉钉由于… -
告别 AI 土味审美!Kimi K2.5 实测:扔个视频复刻 iOS 级丝滑动效
文章详细评测了 Kimi 新发布的 K2.5 模型。作者作为设计师,重点测试了该模型在前端审美、视频多模态识别及交互动效还原方面的表现。通过复刻 iOS 级 Tab 切换动效、天气卡片弹性过渡以及复杂后台界面等案例,验证了 K2.5 能够精准捕捉视频中的微交互细节,并生成高质量、具备审美一致性的代码。文章指出,K2.5 的 Agent 模式能自主访问网页并进行拆解复刻,极大提升了开发效率。尽管在极… -
硅基 AI 日报:月之暗面正式发布并开源 Kimi k2.5;阿里发布万亿参数模型 Qwen3-Max-Thinking
文章详细报道了近期国内 AI 行业的爆发式进展。核心内容包括:月之暗面发布并开源原生多模态模型 Kimi k2.5,其基于 1.5T Token 预训练并引入视觉智能体系统;阿里推出万亿参数推理模型 Qwen3-Max-Thinking,性能直指 GPT-5.2;腾讯升级混元图像 3.0,引入思维链机制实现图生图。此外,文章还涵盖了豆包手机助手的隐私回应、英国 AI 岗位流失调研,以及阶跃星辰获得… -
从爆火的 Clawdbot 身上,我看到了端侧 AI 的另一种可能性
文章详细介绍了近期在技术圈走红的 Clawdbot,这是一款由个人开发者构建的端侧 AI 助手。与传统的云端对话机器人不同,Clawdbot 运行在用户本地,通过 Gateway 中枢连接通讯软件与操作系统,实现了文件管理、邮件自动化等实操能力。其核心亮点在于“持久记忆系统”,利用本地 Markdown 文件记录每日流水和长期档案,通过语义检索和记忆冲刷机制解决了大模型“健忘”且上下文昂贵的问题。… -
何止是“看图写代码”,Kimi K2.5 甚至可以“看视频写代码”!
文章对月之暗面新发布的 Kimi K2.5 模型及其配套工具 Kimi Code 进行了实战评测。作者指出,Kimi K2.5 的核心突破在于多模态能力的深度集成,尤其是支持直接理解视频内容并生成对应代码,这一特性目前领先于 Claude Code 等海外主流工具。此外,Kimi Agent 能够通过云端虚拟机模拟人类操作浏览器、生成素材并完成网页克隆。尽管在处理超大规模复杂项目的逻辑推理上与 C… -
AI 会带来经济爆发,但引线很长
文章深入探讨了 AI 对宏观经济影响的三种主流叙事:以 Acemoglu 为代表的渐进主义(认为 AI 贡献微薄)、以 Epoch AI 为代表的爆发论(认为 AI 将带来指数级增长),以及 Brynjolfsson 的 J 型曲线(强调收益滞后)。核心观点引述了斯坦福经济学家 Charles Jones 的“薄弱环节”理论,即经济系统是由高度互补的环节组成的,总产出受限于最慢的非自动化环节(如物… -
豆包、ChatGPT、Gemini 同台 PK,谁才是博物馆最强逛展搭子?
文章通过多个维度(历史背景、穿搭分析、艺术误区、钓鱼执法、真伪鉴别)对豆包、ChatGPT 和 Gemini 三款 AI 模型进行了博物馆导览能力的横向评测。实测显示,豆包在处理中国本土文物(如唐代银壶、北魏陶俑)时表现出极强的历史背景检索能力,并在面对陷阱提问(如古代啤酒套装)和画作深度推理(如《夜巡》光影分析)时展现了超越对手的视觉识别与逻辑判断力。文章进一步揭示了豆包优异表现的核心支撑——S… -
让机器人“看清”三维世界,蚂蚁灵波开源 LingBot-Depth 模型
文章介绍了蚂蚁集团旗下灵波科技发布的开源模型 LingBot-Depth。该模型专注于解决具身智能中的三维空间感知难题,特别是在处理透明物体、高反光镜面等传统深度相机难以识别的挑战性场景。技术上,LingBot-Depth 采用了“掩码深度建模”(MDM)技术,通过融合 RGB 图像的纹理与上下文信息来补全缺失的深度数据。在 NYUv2 和 ETH3D 等权威评测中,其精度表现优于主流模型。此外,… -
陈海贤最新演讲:人要获得自由,需要离开笼子两次
本文整理自心理学家陈海贤在“做自己节”的演讲。文章核心观点认为,真正的自由需要经历两次“离开”:第一次是离开物理上的束缚(如辞职、脱离不合理的环境),第二次是离开心理上的笼子(即摆脱他人的评价标准与内心的恐惧)。陈海贤指出,许多人在职业转型或人生选择中感到痛苦,本质上是因为虽然身处新路,却仍沿用旧有的、以他人为中心的评价体系。他强调,自由的本质在于定义自我、重塑叙事,将关注点从“外在成功”转向“内… -
阿里发布了他们最强思考模型,有点东西。。(附实测)
文章详细评测了阿里旗舰级思考模型 Qwen3-Max-Thinking。技术上,该模型引入了“测试时扩展”策略,通过经验累积式迭代实现自我反思修正;同时具备自适应工具调用的原生 Agent 能力,并原生兼容 Anthropic API 协议。实测显示,Qwen3 在处理长逻辑推理(如网文细节查询)、复杂逻辑陷阱识别、实时影评搜索汇总以及公务员图形推理题方面表现优异,甚至在部分任务中超越了 Gemi… -
红杉对话 LangChain 创始人:2026 年 AI 告别对话框,步入 Long-Horizon Agents 元年
本文编译自红杉资本对 LangChain 创始人 Harrison Chase 的访谈。文章指出 2026 年将成为长程智能体(Long-Horizon Agents)的元年,AI 将从对话框交互转向自主目标导向的执行。Harrison 详细阐述了 Agent 发展的三个阶段,强调当前已进入以“Harness(软件外壳)”为核心的第三个拐点,其中上下文工程(Context Engineering)… -
ACM Multimedia | 京东零售广告创意:统一的布局生成和评估模型
本文介绍了京东零售入选 ACM Multimedia 的研究成果 Uni-Layout。针对现有布局生成任务分散、评估标准与人类感知不一致的问题,该框架实现了三项核心创新:首先,通过分类体系将布局任务统一,利用多模态大语言模型(MLLM)构建通用生成器;其次,发布了包含 10 万个人工标注样本的数据集 Layout-HF100k,并开发了结合视觉、几何信息与思维链(CoT)推理的类人评估器;最后,… -
AGENTS.md 在我们的智能体评估中表现优于 Skills - Vercel
Vercel 深入研究了 AI 编码智能体如何学习特定框架的知识,特别是针对模型训练数据中不存在的 Next.js 16 API。他们对比了“Skills”(一种按需调用工具/文档的开放标准)与“AGENTS.md”(一种提供持久上下文的项目根目录 Markdown 文件)。结果令人惊讶:虽然 Skills 经常无法触发或需要脆弱的提示词,但嵌入在 AGENTS.md 中的 8KB 压缩文档索引却… -
元宝派、文心、UC…为什么 BAT 都急着给 AI 拉群?|甲子光年
文章探讨了近期 BAT(腾讯、百度、阿里)密集上线或内测“AI 群聊”功能的现象。分析认为,AI 群聊已从最初强调情绪价值的“AI 社交”演变为以任务为导向的“多人+多 Agent”协作模式。这种转变旨在解决单一 Chatbot 难以沉淀社会关系与协作历史的痛点,通过模拟“永远在线”的社交体验,试图构建 AI 时代的超级入口。腾讯元宝派、百度文心及 UC 浏览器的不同尝试,反映了巨头们从社交、办公… -
模型之外,AI 正在打开的新机会丨 a16z
文章深度解析了顶级风投机构 a16z 对 AI 应用周期的前瞻性判断。a16z 团队认为,当前正处于软件史上最大且最快的产品转变期,AI 正在从概念验证转向大规模生产部署。核心观点包括:AI 应用的竞争重点已从模型新颖性转向工作流所有权和数据护城河。文章提出了三个关键投资方向:一是现有软件类别的 AI 原生化重构;二是软件直接作为劳动力替代人类执行任务(如 Eve 案例);三是基于专有数据和闭环工… -
彻底被 Kimi 的新模型惊到了。
文章详细介绍了 Kimi 最新发布的 K2.5 开源模型。该模型实现了原生视觉与文本的统一,告别了传统“外挂式”图像理解,大幅减少了信息损耗。作者通过实测发现,K2.5 在前端代码生成和复杂动画交互方面表现卓越,甚至在某些高难度任务上优于 Gemini 3.0 Pro。文章进一步分析了 Kimi 的技术路径:在算力受限的情况下,通过 Muon 优化器和 Kimi Linear 线性注意力机制等工程… -
AI 会带来经济爆发,但引线很长
文章深入探讨了 AI 对宏观经济影响的三种主流叙事:以 Acemoglu 为代表的渐进主义(认为 AI 贡献微薄)、以 Epoch AI 为代表的爆发论(认为 AI 将带来指数级增长),以及 Brynjolfsson 的 J 型曲线(强调收益滞后)。核心观点引述了斯坦福经济学家 Charles Jones 的“薄弱环节”理论,即经济系统是由高度互补的环节组成的,总产出受限于最慢的非自动化环节(如物… -
豆包、ChatGPT、Gemini 同台 PK,谁才是博物馆最强逛展搭子?
文章通过多个维度(历史背景、穿搭分析、艺术误区、钓鱼执法、真伪鉴别)对豆包、ChatGPT 和 Gemini 三款 AI 模型进行了博物馆导览能力的横向评测。实测显示,豆包在处理中国本土文物(如唐代银壶、北魏陶俑)时表现出极强的历史背景检索能力,并在面对陷阱提问(如古代啤酒套装)和画作深度推理(如《夜巡》光影分析)时展现了超越对手的视觉识别与逻辑判断力。文章进一步揭示了豆包优异表现的核心支撑——S… -
让机器人“看清”三维世界,蚂蚁灵波开源 LingBot-Depth 模型
文章介绍了蚂蚁集团旗下灵波科技发布的开源模型 LingBot-Depth。该模型专注于解决具身智能中的三维空间感知难题,特别是在处理透明物体、高反光镜面等传统深度相机难以识别的挑战性场景。技术上,LingBot-Depth 采用了“掩码深度建模”(MDM)技术,通过融合 RGB 图像的纹理与上下文信息来补全缺失的深度数据。在 NYUv2 和 ETH3D 等权威评测中,其精度表现优于主流模型。此外,… -
陈海贤最新演讲:人要获得自由,需要离开笼子两次
本文整理自心理学家陈海贤在“做自己节”的演讲。文章核心观点认为,真正的自由需要经历两次“离开”:第一次是离开物理上的束缚(如辞职、脱离不合理的环境),第二次是离开心理上的笼子(即摆脱他人的评价标准与内心的恐惧)。陈海贤指出,许多人在职业转型或人生选择中感到痛苦,本质上是因为虽然身处新路,却仍沿用旧有的、以他人为中心的评价体系。他强调,自由的本质在于定义自我、重塑叙事,将关注点从“外在成功”转向“内…
AI 前线
❯
个人中心
购物车
优惠劵
今日签到
有新私信
私信列表
搜索
扫码打开当前页
返回顶部
幸运之星正在降临...
点击领取今天的签到奖励!
恭喜!您今天获得了{{mission.data.mission.credit}}积分
我的优惠劵
-
✈优惠劵使用时效:无法使用使用时效:
之前
使用时效:永久有效优惠劵ID:×
没有优惠劵可用!





