my_insightsDeepSeek Harness 真正冲击的不是 Coding Agent,而是“模型能力”这笔账DeepSeek Harness 的真正价值,不是再造一个 Coding Agent,而是把模型、工具、上下文、沙箱、Agent Loop 与运行轨迹变成可声明、可比较的工程变量,迫使行业重新思考 Agent 能力究竟应该如何归因。📅 2026-08-20 ⏱️ 35 分钟 📝 13896 字#AI #AI Agent #DeepSeek
large_modelmHC: Redefining Deep Learning Scalability - DeekSeek2026年伊始,DeepSeek团队带来了mHC(流形约束超连接),这项技术完美解决了传统残差连接提升性能的超连接技术因破坏稳定性而难以实用的阿喀琉斯之踵.large_modelmHC: Redefining Deep Learning Scalability - DeekSeek2026年伊始,DeepSeek团队带来了mHC(流形约束超连接),这项技术完美解决了传统残差连接提升性能的超连接技术因破坏稳定性而难以实用的阿喀琉斯之踵.📅 2026-01-01 ⏱️ 8 分钟 📝 2907 字#AI #DeepSeek #mHC
papersDeepSeekMath-V2 技术白皮书:迈向自验证数学推理本文介绍了DeepSeekMath-V2,旨在克服传统上依赖最终答案的数学推理奖励机制的局限性。其核心创新在于通过训练一个专门的证明验证器来评估推导的逻辑严谨性,从而实现自我可验证的数学推理能力。该系统引入了元验证过程,以确保验证器识别的错 …papersDeepSeekMath-V2 技术白皮书:迈向自验证数学推理本文介绍了DeepSeekMath-V2,旨在克服传统上依赖最终答案的数学推理奖励机制的局限性。其核心创新在于通过训练一个专门的证明验证器来评估推导的逻辑严谨性,从而实现自我可验证的数学推理能力。该系统引入了元验证过程,以确保验证器识别的错误是准确的,并利用此验证器作为奖励模型来训练生成器进行自我评估和迭代优化。这种生成与验证的协同作用创建了一个循环,通过扩展计算规模来自动标注难以验证的新证明,从而提高了系统的能力。📅 2025-11-29 ⏱️ 17 分钟 📝 6424 字#AI #DeepSeek #Math
papersDeepSeek-OCR:重塑AI长文本处理本文介绍了DeepSeek-OCR,一种革命性的AI模型,能够将长文本处理效率提升数十倍,从而实现对超长文档的快速处理。📅 2025-10-21 ⏱️ 11 分钟 📝 4014 字#AI #DeepSeek #OCR
validation编程能力对比分析一撇关于编程能力对比分析一撇validation编程能力对比分析一撇关于编程能力对比分析一撇📅 2025-04-20 ⏱️ 2 分钟 📝 575 字#coding #validation #gemini
large_modelsDeepSeek FlashMLA 代码解读本文介绍了深度求索(DeepSeek)公司FlashMLA代码详细解读。large_modelsDeepSeek FlashMLA 代码解读本文介绍了深度求索(DeepSeek)公司FlashMLA代码详细解读。📅 2025-02-24 ⏱️ 10 分钟 📝 3881 字#AI #deepseek #FlashMLA
technologiesDeepSeek 开源 LLM 对闭源 LLM 的影响本文介绍了DeepSeek开源LLM对闭源LLM的影响,包括性能基准测试和竞争、成本效益、开源可用性和定制、市场动态和战略转变、创新与社区发展、环境影响以及AI研究和应用的转变。technologiesDeepSeek 开源 LLM 对闭源 LLM 的影响本文介绍了DeepSeek开源LLM对闭源LLM的影响,包括性能基准测试和竞争、成本效益、开源可用性和定制、市场动态和战略转变、创新与社区发展、环境影响以及AI研究和应用的转变。📅 2025-02-18 ⏱️ 6 分钟 📝 2118 字#AI #DeepSeek #开源
papersDeepSeek 微调本文介绍了如何使用合成推理数据集微调DeepSeek-R1模型.papersDeepSeek 微调本文介绍了如何使用合成推理数据集微调DeepSeek-R1模型.📅 2025-02-14 ⏱️ 1 分钟 📝 345 字#AI #DeepSeek #论文