共 1397 篇相关文章

从零掌握DeepSeek-OCR部署与微调全流程:涵盖vLLM推理引擎部署、Unsloth高效微调、数据集预处理、LoRA训练、效果验证及RAG向量数据库集成,为开发者提供可落地的大模型定制化实战路径。

阿里Qwen下一代、DeepSeek V4 GA、智谱GLM新版几乎同步逼近发布节点。本文梳理三大国产大模型最新进展、实测表现及蒸馏争议,带你抢先了解国产AI新旗舰的核心信息。

DeepSeek联合北京大学开源推理加速技术DSpark,在高并发场景下单用户生成速度提升57%~85%。本文详解DSpark三大核心设计:半自回归草稿、置信度评分与自适应调度器,以及配套开源框架DSpec的完整内容。

DeepSeek V4正式版预计7月中旬发布,引入峰谷定价机制;美团开源万亿参数MoE模型LongCat 2.0,支持百万token上下文;Cursor推出iOS应用,AI编程工具进入移动化时代。一文速览AI行业最新动态。

DeepSeek创始人梁文锋在四小时深度对话中,揭示了从思维链到具身智能的AGI五步路线图。在仅两万张GPU算力约束下,如何用TileLang编译器破解国产替代难题,API现金流如何为AGI探索托底?本文梳理这套克制而自洽的战略逻辑。

Rocky是一款极简透明的开源编程智能体,核心Loop仅几百行Python代码,原生集成DeepSeek搜索与Research模式,内置SWE基准测试环境,适合学习Coding Agent原理、文献调研与可复现的Agent实验。

DeepSeek创始人梁文锋4小时闭门会完整解读:无KPI管理、只赚合理利润、最强模型持续开源、持续学习攻克AGI——一份罕见的AI战略自白,揭示克制如何成为核心竞争力。

DeepSeek梁文锋4小时投资者交流会解读:10个月回本的克制定价、开源不影响收入的逻辑、Agent-持续学习-自我迭代的AGI路线图,以及国产芯片、人才与你的护城河。

DeepSeek开源推测解码工具库DeepSpec,生产环境实测推理速度提升60-85%,吞吐量最高提升661%。集成三大算法、九个预训练Checkpoint与九个评测基准,三步即可上手,MIT协议免费商用。

DeepSeek创始人梁文锋在投资者交流会上系统阐述:无KPI的组织文化、10个月回本的定价逻辑、开源长期策略、持续学习突破AGI瓶颈,以及国产芯片一年内生态成熟的预判。

DeepSeek创始人梁文锋在4小时内部投资者对话中,深度分享开源初心、定价逻辑、算力布局与AGI五阶段路线图。解读"只赚10个月回本利润"背后的长期主义经营哲学。

Redis作者antirez开发纯C推理引擎DS4「矮星」,通过不对称量化将DeepSeek V4 Flash从500GB压缩至80.8GB,实现128GB统一内存本地部署,每秒生成26.7个Token。本文深度解析MoE架构优势、三档部署现实与本地大模型的真正门槛。

无ChatGPT账号也能用Codex!本文详解如何通过Codex++管理工具,将DeepSeek、豆包等国产大模型接入Codex,包含Base URL配置、API Key获取、Token充值全流程步骤。
每日AI新鲜事·07月25日早间版:DeepSeek开源与AI操控手机
2026年07月25日早间版 AI新闻速递+热点深度讨论

全面解析DeepSeek Math V2:IMO金牌级数学推理能力、97.3%的Math500正确率、Apache 2.0完全开源可商用。从技术架构、版本演进、核心能力到本地部署,带你彻底读懂这款开源数学大模型的过人之处。

DeepSeek正布局自研AI芯片,试图从算法走向底层硬件,实现软硬件协同优化。本文深度解析其战略动机、核心挑战与对中国AI产业链自主化的深远影响。

DeepSeek传闻以约500亿美元估值融资,估值仅为OpenAI与Anthropic的二十分之一,却凭借5倍价格优势持续蚕食AI双雄中段市场。本文解析开源模型如何从价格、成本结构与市场分层三个维度,对美国AI巨头形成实质性利润挤压。

中国商务部密集磋商是否限制顶尖开源AI模型海外访问,涉及阿里、字节跳动、DeepSeek等头部企业。与此同时,DeepSeek低调研发自有推理芯片近一年,首次开启外部融资约70亿美元。中美AI出口管制镜像博弈加剧,全球开发者面临技术选型新变局。