-
十万亿豪赌:字节跳动为何拒用模型蒸馏捷径?张一鸣的长期主义战略深度解码
字节跳动放弃模型蒸馏捷径,投入十万亿级资源自研Seed基础大模型,彰显张一鸣以技术自主和代际领先为核心的长期主义战略,目标锁定全球第一梯队AI能力。- 0
- 0
-
-
-
Agent 开始“自我进化”:会出题、会反思,还会自己长出新技能
本文深度解析了自进化 Agent 的技术演进路径,将其划分为经验存储型、RL 训练型与 0 数据自学型三大路线,并详细拆解了各路线下的前沿研究工作。- 0
- 0
-
实测 DeepSeek V4 正式版:3 块钱干完 5 件事,AI「智价比」之战开打了
文章通过对 DeepSeek V4-Flash 与 OpenAI 降价模型的实测对比,表明顶尖大模型的竞争正从单纯比拼能力转向争夺『智价比』,低成本高效模型正推动 Agent 时代的到来。- 0
- 0
-
Kivine横空出世:月之暗面新模型或为Kimi K3雏形,支持百万级上下文引全球关注
代号Kivine的新模型疑似Kimi K3雏形,具备百万级上下文处理能力,展现月之暗面在长文本理解与生成上的重大突破,引发全球AI领域高度关注。- 0
- 0
-
Monday.com lays off hundreds to focus on AI
The company said it is reducing its headcount by 20%, or about 630 staff, to "support a leaner, more focused operating model" as it focuses on its AI Work Platform. 来源:AI News & Artifici…- 0
- 0
-
Yope raises $12.3M to build a private social network without algorithms or ads
Yope, a fast-growing social app focused on private groups of friends and family, has raised $12.3 million in seed funding. Instead of chasing creators and algorithmic feeds, the startup is betting tha…- 0
- 0
-
Travis Kalanick’s robotics company raises $1.7B, led by a16z
Uber is also investing in Travis Kalanick's company Atoms, which has made gauzy claims about using industrial AI to modernize the world. 来源:AI News & Artificial Intelligence | TechCrunch- 0
- 0
-
How OpenAI’s human mistake led to the AI-powered hack on Hugging Face
OpenAI made a mistake setting up what it called a “highly isolated” testing environment and sandbox. According to cybersecurity experts, that human mistake is what made the AI-powered attack on Huggin…- 0
- 0
-
Treasury threatens sanctions after White House claims Moonshot distilled Anthropic’s Fable
The episode has also intensified a broader debate in Washington over the influx of Chinese open models. 来源:AI News & Artificial Intelligence | TechCrunch- 0
- 0
-
Google justifies its massive AI spending with a booming cloud business
Google's cloud business is thriving, as companies adopting its AI and AI infrastructure services help the tech giant to report record profits. 来源:AI News & Artificial Intelligence | TechCrunc…- 0
- 0
-
After shocking quarter, IBM insists that AI isn’t killing the mainframe
After IBM's stock crashed last week on warnings of poor mainframe sales, the CEO explained that AI wrecked corporate hardware budget, temporarily. 来源:AI News & Artificial Intelligence | TechC…- 0
- 0
-
ServiceNow bets $40 million on Indian banking software specialist to expand its financial services push
ServiceNow's investment gives BusinessNext a strategic partner to expand its AI-powered banking software globally. 来源:AI News & Artificial Intelligence | TechCrunch- 0
- 0
-
马斯克 20 万块 GPU 炼出 Grok-3,暴击 DeepSeek R1 数学屠榜!疯狂复仇 OpenAI
文章报道了 xAI 公司发布的 Grok-3 系列大语言模型,包括 Grok-3 Beta、Grok-3 mini、Grok-3 Reasoning (Beta) 、Grok-3 mini Reasoning 以及 AI 智能体 DeepSearch。Grok-3 使用 20 万块 GPU 训练,在数学 (AIME 2024) 、科学问答 (GPQA) 、编码 (LCB) 等多个基准测试中刷新 S…- 0
- 0
-
推荐系统三十年:从协同过滤到大模型时代的技术编年史
文章系统地梳理了推荐系统从 1992 年诞生至今的三十余年发展历程。它以时间为轴,详细阐述了四个关键阶段:起源篇(协同过滤的黎明)、发展篇(Netflix Prize 与特征工程时代)、成熟篇(深度学习的全面统治)和未来篇(大模型时代的范式转移)。文中不仅介绍了 Tapestry、GroupLens 等早期系统,矩阵分解、GBDT+LR 等中期技术,以及 Wide & Deep、DIN 等…- 9
- 0
-
DeepSeek V3.2 正式版:强化 Agent 能力,融入思考推理
DeepSeek 正式发布了两款具有里程碑意义的大语言模型:DeepSeek-V3.2 和 DeepSeek-V3.2-Speciale。DeepSeek-V3.2 旨在平衡卓越推理能力与高效输出长度,特别适用于日常问答和通用 Agent 任务,在公开推理 Benchmark 中已达到 GPT-5 水平,且相比同类模型显著降低了计算开销和用户等待时间。DeepSeek-V3.2-Speciale …- 0
- 0
-
OpenAI 还怎么玩?谷歌凌晨炸场!Pro 级智商跌成“白菜价”,网友惊呼:六边形战士
文章详细介绍了谷歌最新发布的 Gemini 3 Flash 大模型,强调其在推理能力上匹敌旗舰模型 Gemini 3 Pro,同时拥有更快的响应速度和显著降低的成本。通过在 GPQA 博士级推理、多模态理解和编码智能体等多项基准测试中取得“屠榜”表现,Flash 版模型展现了“小而强”的进化。文章还深入探讨了其核心技术原理,如“思考层级”参数和上下文缓存,以实现性能与成本的平衡。它在复杂视频分析、…- 0
- 0
-
万字长文|大语言模型结构化输出(Structured Output)的技术原理和实现
文章全面而深入地探讨了大语言模型(LLM)结构化输出的技术演进、核心方法与未来趋势。首先阐明了结构化输出对于解决 LLM 自由文本的非确定性、幻觉及机器解析难题的根本价值,并将其定位为模型工程与传统软件工程的关键交互接口。随后,文章沿着技术从“软”到“硬”的演进路线,详细介绍了模式引导生成(Prompt 工程)、验证与修复框架(如 Guardrails)、约束解码(包括黑盒 LLM 的 Sketc…- 0
- 0
-
比女皇报告还炸裂!67 页 AI 深度调研刷屏,全球 LLM 大决战真正开始
硅谷财富管理巨头 Iconiq Capital(管理着包括扎克伯格在内的顶级客户 800 亿美元资产)发布了一份长达 67 页的《2025 年 AI 现状报告》。报告基于对 300 家 AI 公司高管的访谈和数据分析,聚焦 AI 落地的七大真问题:企业 AI 选型(OpenAI 领先)、AI 支出(数据存储处理成最大支出项)、开发工具地图、产品阶段支出、智能体(90%高增长公司部署)、定价模式(重…- 0
- 0
-
和杨植麟时隔一年的独家对话:“站在无限的开端”
文章是张小珺对月之暗面创始人杨植麟的独家访谈。杨植麟分享了在 Kimi K2 模型发布后,对大模型领域“无限攀登”的哲学思考,引用《无穷的开始》强调问题解决与知识拓展的循环。他指出过去一年大模型最重要的范式级变化是长思考推理模型和基于多轮交互的 Agent 模型。K2 模型的关键技术创新在于通过 Muon 优化器提升 token efficiency,并在 Agentic 能力上寻求突破,以解决泛…- 69
- 0
-
GLM-4.7 上线并开源:更强的编码
文章详细介绍了智谱 AI 新发布的 GLM-4.7 大模型,该模型在编程能力、长程任务规划与工具协同方面取得了显著提升。特别是,GLM-4.7 在多语言编码、前端代码生成质量以及工具调用能力上表现出色,并在 SWE-bench-Verified、LiveCodeBench V6 等主流基准测试中达到开源 SOTA,甚至超越了 GPT-5.2 和 Claude Sonnet 4.5。文章还介绍了 G…- 0
- 0
-
2024 年人工智能年终总结报告|Artificial Analysis
文章回顾了 2024 年人工智能领域的重大进展,重点介绍了大模型、图像生成和语音识别等方面的技术突破。OpenAI、Google、Anthropic 等公司在模型能力、响应速度和价格上展开了激烈竞争,推动了 AI 技术的快速迭代和普及。开源模型与专有模型的性能差距显著缩小,推理定价大幅下降,小模型也能达到大模型的智能水平。图像生成质量和多模态能力得到了显著提升,语音识别技术也达到了新的里程碑。文章…- 0
- 0
-
GitHub 12w Star 神器!一文详解大模型集成框架 LangChain
文章详细解读了 LangChain 这一领先的大模型集成框架,旨在帮助开发者更高效地构建智能应用。首先,概述了 LangChain 的起源、核心价值及其在 LLM 应用开发中的重要地位,并从宏观层面介绍了 LangChain 的生态系统,包括 LangGraph、LangSmith 和 LangServe。接着,文章逐一深入讲解了 LangChain 的六大核心组件:Model I/O、Chain…- 0
- 0
大模型
❯
个人中心
购物车
优惠劵
今日签到
有新私信
私信列表
搜索
扫码打开当前页
返回顶部
幸运之星正在降临...
点击领取今天的签到奖励!
恭喜!您今天获得了{{mission.data.mission.credit}}积分
我的优惠劵
-
✈优惠劵使用时效:无法使用使用时效:
之前
使用时效:永久有效优惠劵ID:×
没有优惠劵可用!














