共 154 篇相关文章

平头哥在WAIC发布开源AI软件栈T-Head SAIL,降低国产芯片开发门槛;Kimi K3登顶WebDev榜单,千问3.8 Max Preview激进降价;月之暗面筹备赴港IPO;Oracle数据中心改用燃料电池微电网,AI行业动态一览。

阿里巴巴开源2.4万亿参数Qwen大模型,同步推出Qwen Token Plan订阅服务。国产模型强势崛起冲击半导体市场,Kimi K3登顶全球榜单,国产芯片生态全链条突围,中国AI力量正全面重塑全球竞争格局。

月之暗面发布Kimi K3,2.8万亿参数MoE架构,价格仅为顶级闭源模型零头,当日引发英伟达领跌美股科技板块。本文深度解析K3的技术优势、对Anthropic等闭源公司的定价冲击,以及对A股港股算力板块的重估逻辑。

月之暗面发布全球参数量最大开源模型Kimi K3,2.8万亿参数配合MoE架构,训练效率较K2提升2.5倍。斯坦福AI报告显示中美顶尖模型差距已缩至2.7%。本文深度解析Kimi K3技术亮点、市场反应与中美AI竞争新态势。

全球科技板块深度回调背后,韩国120万散户杠杆账户触及爆仓线,中国Kimi K3以2.8万亿参数刷新开源大模型记录,再度冲击AI高估值叙事。本文深度解析这场从东亚蔓延至全球的AI泡沫震荡。

阿里千问第五代模型Qwen3全面解析:6款Dense与MoE架构模型覆盖0.6B至235B,全球首款开源混合推理模型,旗舰235B性能追平Gemini 2.5 Pro,开发者与企业部署的完整参考指南。

DeepSeek V4本月即将发布,Flash版或超越同级最强开源模型HY3,并首次支持原生视觉;OpenAI承认悄悄下调GPT-5.6推理预算;Anthropic延长Fable 5访问权限应对GPT-6竞争;字节Seedance 2.5支持180秒4K视频生成——AI竞争持续白热化。
软硬协同设计:构建硬件友好的LLM架构指南
深入解析AI模型协同设计(Co-Design)理念,探讨如何在准确率、吞吐量与延迟三维权衡中,通过硬件友好的LLM架构设计实现最优推理性能,涵盖MoE、GQA、FP8量化等关键技术策略。

国内31家企业联合签署首个智能体隐私自律公约,涵盖静默读屏物理授权、禁止隐私数据商业训练、自主付款资金红线三大核心条款。本文同步梳理国产大模型首次中立平台登顶、算力军备加速、开源生态效率优化等最新动态,解读AI智能体商业化落地的机遇与阵痛。
PrismML突破:270亿参数大模型如何跑进iPhone?
初创公司PrismML将阿里Qwen 3.6大模型从54GB压缩至4GB以内,实现270亿参数全激活在iPhone 17 Pro本地运行。本文解析其压缩技术原理、与苹果稀疏架构的差异,以及端侧AI的商业价值与待验证的关键疑问。

深度实测Cocos Creator AI智能体插件:上下文三级压缩、工具审批、多智能体并行,DeepSeek驱动全程自动搭建马里奥场景,AI辅助游戏开发能力边界一文看清。

腾讯开源推理模型混元HY3(Hunyuan 3)深度解析:MoE架构、2950亿总参数、Apache 2.0商用许可,编程与前端表现媲美DeepSeek V4 Pro,成本仅为专有模型的1/35。多方实测数据全面解读。

Unsloth针对Qwen3.6系列发布NVFP4量化版本,采用W4A4真4bit张量核心运算,相比NVIDIA官方实现最高2.5倍推理加速,MMLU-Pro等多项基准测试精度持平甚至超越BF16全精度,本地部署效率大幅提升。
SWE-1.7编程模型解析:专用AI如何逼近顶级通用模型
SWE-1.7专用编程模型在Hacker News引发热议,宣称性能接近GPT-5.5与Claude Opus。本文深度解析SWE系列模型的技术路线、评测标准的局限性,以及专用AI编程模型如何通过垂直优化挑战通用大模型,帮助开发者理性评估这一行业新趋势。

Miles团队联合AMD官方宣布,DeepSeek-V4 Flash强化学习训练完整迁移至AMD Instinct MI355X GPU,基于ROCm平台实现端到端稳定运行,AIME数学推理基准pass@1从0.39提升至0.49,标志着大模型训练算力生态多元化的重要突破。

深度实测AMD Ryzen AI Halo迷你AI盒子:搭载Ryzen AI Max Plus 395(Strix Halo)芯片,128GB统一内存,售价4000美元。对比英伟达DGX Spark,从Token生成、预填充速度到x86架构优势,全面解析谁更值得入手。

1X为NEO人形机器人发布全新机械手,25个自由度、力透明感知与触觉皮肤实现数据自标注;OpenAI同步推出GPT-5.6三档模型,编码能力与性价比全面提升。硬件与AI大脑协同进化,人形机器人商业化进程加速。

基于真实私有化部署实测,对比DeepSeek、千问3、智谱GLM、Kimi K2、MiniMax M3、腾讯混元3六款开源大模型的硬件成本、推理效率与落地难度,帮助企业找到最匹配的内网部署方案。

全面解析DeepSeek Coder从V1到V2的架构升级:MoE混合专家架构、128K超长上下文、90.2% HumanEval通过率,首个超越GPT-4 Turbo的开源代码模型。涵盖核心能力、部署方案与适用场景对比。

腾讯正式开源混元3(Hunyuan V3),295B MoE架构、21B激活参数,官方宣称超越DeepSeek-V4-Pro。支持FP8量化、vLLM/SGLang部署,但256K上下文与不支持多模态成为核心短板。本文深度解析其架构特性、横向对比与实际部署方案。