-
DeepSeek-V4-Pro正式发布:国产大模型再突破,性能直逼Fable-5
DeepSeek于2026年8月正式发布V4-Pro稳定版,性能对标Fable-5;同期GLM-5.2、Kimi-K3等国产模型密集突破,推动开源与闭源技术边界重构,黄仁勋亦罕见为开源站台,凸显中国大模型自主创新加速落地。- 0
- 0
-
英伟达双擎开源:Nemotron 3.5 Lightning提速4倍+NeMo Switchyard降本74%,重塑AI Agent工作流
英伟达发布Nemotron 3.5 Lightning与NeMo Switchyard两大开源工具:前者以混合专家架构实现推理提速4倍、成本降至1/3;后者通过智能路由策略,在多轮Agent任务中降低74%综合开销。二者协同优化长程任务分工,推动开源AI Agent工业化落地。- 0
- 0
-
AI安全实战新标杆:中国团队DoGNAVY登顶CyberGym全球第三,开源路径突破闭源垄断
中国团队DoGNAVY凭开源GLM-5.2模型登顶CyberGym全球第三,首创结构化安全Agent工作流,实现动静协同漏洞分析与可解释风险诊断;其自研AgentDoG架构以千分之一参数量达成顶级识别精度,标志开源路径成功突破闭源模型垄断,推动AI安全能力普惠化。- 0
- 0
-
开源大模型的‘奥本海默时刻’:一场由算力效率引爆的全球性范式革命
DeepSeek V4 Flash与Qwen-3.8-Max引爆开源大模型性价比革命,以稀疏架构等底层创新实现百倍成本优势,触发创业公司与大厂的战略地位逆转。价格战本质是算力效率战争,正瓦解云计算中立性、重构流量逻辑,并推动AI从‘注意力经济’迈向‘意图经济’。- 0
- 0
-
H3视频旗舰模型开源:性能媲美Seedance 2.0,成本直降70%,多模态生成格局重塑
MiniMax开源视频旗舰模型H3,性能媲美Seedance 2.0,成本降低70%,支持文本/图像/音频多模态输入,是首个开源的端到端高清视频生成大模型,有望重塑AIGC视频生态。- 0
- 0
-
DeepSeek-V4-Flash正式发布:284B MoE架构模型以13B激活量重塑Agent效能标杆
DeepSeek发布V4-Flash正式版:284B MoE模型仅激活13B参数,支持百万上下文与双推理模式,在Agent能力、长文本效率与生态兼容性上全面超越此前V4-Pro预览版,以低成本实现高质智能体交付,重新定义国产大模型效能新基准。- 0
- 0
-
Qwen3 小升级即 SOTA,开源大模型王座快变中国内部赛了
文章详细报道了阿里云 Qwen3 大模型最新版本的发布,该版本采用 MoE 架构,总参数量 235B,激活参数 22B,并在基准测试中超越了 Kimi K2 和 DeepSeek-V3。新版 Qwen3 不再采用混合思维模式,而是分别训练 Instruct 和 Thinking 模型,显著提升了通用能力、多语言长尾知识覆盖、用户偏好符合度以及 256K 长上下文理解能力。文章还指出,随着 Llam…- 0
- 0
-
GLM-4.7 开源!交出“生产级代码”
文章介绍了智谱公司最新开源的大模型 GLM-4.7,该模型重点对编程场景进行了优化。它在编码、推理和智能体三个维度实现了突破,包括多语言编码能力、前端生成质量、工具调用能力以及数学和推理能力的显著提升。GLM-4.7 在多个主流基准测试(如 Claude Code、SWE-bench 等)中表现优异,达到或超越了业界领先水平,特别是在 Code Arena 中位列开源第一、国产第一,并超越了 GP…- 0
- 0
-
小米突然发布新模型:媲美 DeepSeek-V3.2,把手机的性价比卷到 AI
文章详细介绍了小米最新发布并开源的 MiMo-V2-Flash 大模型。该模型总参数 3090 亿,活跃参数 150 亿,采用 MoE 架构,性能可媲美头部开源模型 DeepSeek-V3.2 和 Kimi-K2。其核心创新包括混合滑动窗口注意力机制,将推理成本降至百万 token 输入 0.1 美元、输出 0.3 美元,推理速度达 150 tokens/秒,并在 256k 长文本处理上表现出色。…- 0
- 0
开源大模型
❯
个人中心
购物车
优惠劵
今日签到
有新私信
私信列表
搜索
扫码打开当前页
返回顶部
幸运之星正在降临...
点击领取今天的签到奖励!
恭喜!您今天获得了{{mission.data.mission.credit}}积分
我的优惠劵
-
✈优惠劵使用时效:无法使用使用时效:
之前
使用时效:永久有效优惠劵ID:×
没有优惠劵可用!











