DeepSee
-
DeepSeek 补全 R1 论文,新增 64 页技术细节
近日,DeepSeek 悄悄更新了 R1 的技术论文,新增了整整 64页! 通过对比 DeepSeek-R1 论文的两个版本,可以发现新版论文不仅补充了若干附录,还对正文进行了大幅修订与扩充,信息量显
-
DeepSeek 发布开年论文:提出mHC新架构,攻克深度学习难题
2025 年最后一天,DeepSeek 发布了最新论文,《mHC: Manifold-Constrained Hyper-Connections》。 近年来,以超连接(Hyper-Connection
-
深度丨梁文锋署名论文发布,DeepSeek用mHC新架构“秀肌肉”
前言: 2026年新年第一天,arXiv上一篇题为《mHC:Manifold-ConstrainedHyper-Connections(流形约束超连接)》的论文。 与以往技术发布不同,这篇论文不仅提出
-
DeepSeek杀出一条血路:国产大模型突围不靠运气!
【从注意力到Agent,能力跃迁的底层解法。】 作者:高恒出品:高见观潮? 全文约3500字,阅读时间大约5分钟 进入2025年末,全球大模型赛道的技术焦点几乎被Google重新夺回。Gemini 3
-
DeepSeek 一口气上新两款模型:性能直逼 Gemini
刚刚,DeepSeek 一口气推出两个新模型:DeepSeek-V3.2 和 DeepSeek-V3.2-Speciale。 前者专注平衡推理能力与模型长度,可达到GPT-5 级别的性能,适用于日常问
-
DeepSeek 开源全新数学模型 DeepSeekMath
刚刚,DeepSeek 开源了全新的数学模型 DeepSeekMath-V2,专注可自验证的数学推理框架。 DeepSeek-Math-V2 在 IMO-ProofBench 和 IMO 2025(6
-
DeepSeek 最新实验模型 V3.2
DeepSeek 开源了最新的实验模型——V3.2-Exp。 V3.2-Exp 在 V3.1-Terminus 的基础上引入了?DeepSeek 稀疏注意力机制——可以优化长上下文场景下训练和推理的效
-
DeepSeek成了硅谷最大的“不能说的秘密”?
作者:Debbie 排版:燕子 昨天看到了一篇很有意思的专访,虎嗅写的,标题就取得很好——《DeepSeek成了硅谷最大的“不能说的秘密”》。 文章采访了全球顶尖科技峰会Web Summit的创始人帕
-
7亿人ChatGPT使用报告首曝光!你关于AI的认识都是错的?
在生活中,人们更多把 AI 当作一个「百科+顾问」;而在工作里,它更像一个「生产力外包」。 就在最近,一份由 OpenAI 与哈佛大学、杜克大学联合完成的研究报告横空出世,名字平淡无奇:《How Pe
-
Manus跑路,大厂掉线,只能靠DeepSeek了
文源:源Byte 作者:柯基的柯 一个“超级大招”的传闻,突然被爆出。 9月4日,据彭博社援引知情人士的爆料,DeepSeek正秘密开发一款具备自我进化能力的AI智能体,它无需复杂指令,能自主学习并执
-
DeepSeek,新版本发布!
8 月 21 日,深度求索 (DeepSeek) 正式发布其最新大语言模型 DeepSeek-V3.1。 本次升级变化包括:上下文窗口从原来的 64k 扩展到 128k;“深度思考 (R1)” 字样,
-
DeepSeek-R2要来了?速领450元代金券,模型测评快人一步!
导语:关于 DeepSeek-R2 的6大预测伴随OpenAI正式推出GPT-5,中国代表选手DeepSeek-R2 也更备受关注与期待。近日,关于DeepSeek-R2计划于8月15日至30日之间发
-
DeepSeek R2加持,中国AI与芯片产业迎来新一轮协同进化
【摘要】2025年6月,摩根士丹利日本团队的一篇研报,提前泄露了DeepSeek R2版本的内容,也直接带动了当日半导体和AI板块的上涨。 在先进制程领域,DeepSeek的需求倒逼产能扩张,尽管中国
-
改款DeepSeek,乱了华为心态
文源:源Byte 作者:柯基的柯 当技术参数的相关性飙到0.927,行业直接炸了。 近期,有研究团队在GitHub上公开比对数据,指出华为盘古ProMoE与阿里Qwen-2.5 14B参数结构高度雷同
-
Kimi和Minimax,争夺“下一个DeepSeek”心智
六小龙们渴望一场DeepSeek式的胜利。 原创科技新知 AI新科技组 作者丨樱木 编辑丨江蓠 近日,在36氪WAVES 举办的大会上,一个有趣的环节引发了人们的热议:主办方让Kimi与Minimax两家的投资人进行了对谈









