共 1567 篇相关文章

DeepSeek宣布进军自研AI芯片领域,剑指算力自主可控。本文深度解析其布局动因、软硬件协同潜力、芯片研发的现实挑战,以及对中国AI产业垂直整合趋势的深远影响。

手把手教你通过CC Switch将DeepSeek接入Claude Code,无需科学上网,10元即可开始AI编程。含API Key获取、环境安装、模型配置及实战演示,适合编程新手快速上手。

手把手教你在Windows本地安装Claude Code,并将底层模型替换为DeepSeek API,实现无需科学上网、低成本的AI编程体验。涵盖Node.js安装、Claude Code配置、DeepSeek API Key获取全流程。

DeepSeek投机解码算法(DSpark)已正式合并至vLLM主干代码,原生支持Qwen3、Gemma等主流开源模型。测试显示单用户Token生成速率提升接近150倍,整体吞吐量提升约40%-50%,是开源大模型推理加速的重要里程碑。

GitHub Copilot学生权益缩水?本文手把手教你在VSCode中安装Claude Code插件,通过CCSwitch工具接入DeepSeek V4 API,2.5折价格享受强大Agent能力,无需切换IDE,适合大陆开发者和学生党。

Kun是一款专为国内用户和DeepSeek优化的开源AI编程Agent,GitHub近5000星。支持需求草稿、内联代码对比、成本可视化及手机远程监控,实测缓存命中率高达97%,百万Token成本极低。免费支持Mac、Windows、Linux,适合成本敏感的国内开发者。

全面解析DeepSeek Coder从V1到V2的架构升级:MoE混合专家架构、128K超长上下文、90.2% HumanEval通过率,首个超越GPT-4 Turbo的开源代码模型。涵盖核心能力、部署方案与适用场景对比。

深度解析DeepSeek-V4系列模型:1.6万亿参数MoE架构、CSA+HCA混合注意力机制、MHC与MUON优化器三大核心创新,推理FLOPs降至V3.2的27%,百万Token上下文成本大幅下降,重新定义开源大模型SOTA。

DeepSeek联合北京大学发布DS Spark论文,通过置信度调度与半自回归投机解码,在不改变模型和GPU的前提下,将AI推理速度提升最高85%。深度解析这场"赌场式"推理革命的三大核心技术。

Unsloth v0.1.481-beta正式发布,新增DeepSeek-V4-Flash完整支持、NVFP4/FP8/imatrix GGUF多格式量化导出,GRPO训练提速1.3倍,MoE训练加速3-5倍,Studio升级为OpenAI兼容API服务系统,覆盖微调、导出、推理全链路。

DeepSeek开源推理加速工具包DSpec实测报告:草稿模型+智能调度实现无损加速,GSM8K接受长度达6,复现官方数据。本文拆解工作原理、显存占用与接受率衰减规律,适合本地部署开发者参考。

通过引入验证循环(verification loop)工程化推理框架,DeepSeek在复杂任务上的有效通过率可提升约4倍,追平Claude Opus表现,而成本仅为其七分之一。本文深入解析验证循环原理、推理时计算扩展趋势及其对AI开发者的实际启示。

Unsloth v0.1.48-beta版本发布,新增NVFP4/FP8量化导出、OpenAI兼容API热切换、MoE训练提速3-5倍、GRPO提速1.3倍,全面覆盖大模型微调、量化与本地部署全链路。

今日AI行业重磅:Cursor被以600亿美元全股票交易收购,智谱GLM-5.2以MIT协议开源发布;DeepSeek完成首轮外部融资估值突破500亿美元;Anthropic研究显示Agent编码经济价值7个月增长27%;NVIDIA推出物理世界机器人Agent系统Empire。

无ChatGPT账号也能用Codex!本文详解通过Codex++管理工具接入DeepSeek API的国内直连方案,涵盖安装配置、API Key获取、账户充值全流程,10元即可上手AI编程工具。

手把手教你安装Claude Code桌面版,开启开发者模式实现无账号使用,通过CC Switch接入DeepSeek API,完成中文汉化并使用自定义Skill,十分钟跑通全流程。

无ChatGPT账号也能用Codex!本文详解通过Codex++工具配置DeepSeek API的完整流程,包括安装、API Key获取、模型切换全步骤,10元即可国内直连使用Codex编程助手。

DeepSeek联合北京大学推出开源框架DiSpark,通过投机解码、半自回归生成与分级验证技术,在不更换硬件、不重训模型的前提下,让大语言模型推理速度提升60%至85%,同时保持输出质量。