共 388 篇相关文章

开源大语言模型可能被植入定时释放后门,在特定条件触发时执行恶意行为。本文深入分析AI模型后门的工作原理、为何难以检测,以及企业如何通过模型溯源、权重签名和红队测试来防范AI供应链攻击。

一则Reddit热门漫画折射出中国开源大模型的全球影响力。从DeepSeek、Qwen到GLM,中国AI模型凭借开源策略和快速迭代,正在改变全球开发者的选择格局,本文深度解析这一趋势背后的行业信号。

深度解析阿里巴巴通义千问Qwen3系列最新动态,探讨其在多模态视觉理解、中文能力、开源生态等方面的核心优势,以及对开发者和行业的深远影响。

DeepSeek V4 Pro引发开源社区热议。本文分析DeepSeek从V2到V3的迭代路径、MoE架构的成本优势,以及开发者对下一代开源大模型的期待与理性判断建议。

研究发现去审查(uncensored)开源大模型比基础模型更乐观。本文解析去审查微调如何改变模型性格,探讨对齐训练的耦合效应及其对开发者的实际影响。

OpenRouter数据显示中国AI模型已占美国AI消费量58%。DoorDash、Airbnb等硅谷巨头纷纷采用Kimi、DeepSeek、通义千问等中国开源大模型,凭借低价高性能和开源权重优势快速渗透全球市场。

Kimi、阿里千问、DeepSeek凭借MoE架构、本土数据优势与开源飞轮效应,以极低成本逼近OpenAI、Anthropic等闭源巨头。本文深度拆解国产开源大模型的追赶逻辑与商业哲学差异。

月之暗面发布2.8万亿参数开源大模型Kimi K3,性能直逼Anthropic与OpenAI旗舰产品,再掀"DeepSeek时刻"。本文深度解析Kimi K3的技术冲击、算力封锁悖论,以及开源策略如何重塑全球AI竞争格局。

月之暗面、阿里、DeepSeek、美团四家同步冲进万亿参数门槛,中国开源大模型仅用18个月完成从B到T的数量级跃迁。本文深度解析万亿参数俱乐部的入场逻辑、智谱与MiniMax的追赶态势,以及参数军备竞赛背后的部署难题。

Kimi K3作为当前最强开源大模型正式发布,性能逼近闭源前沿模型。本文深度解析其无护栏特性、蒸馏浪潮的战略价值、视觉质量优势,以及AI市场泡沫与修正信号,帮助开发者和研究者把握本地AI部署的核心机遇。

Kimi K3正式发布,2.8万亿总参数、896个MoE专家、百万级上下文,编程基准超越GPT与Gemini。本文深度解析其线性注意力、Attention Vigilance等核心技术,以及Perception Bench多模态评测表现,带你读懂这款全球最强开源大模型。
每日AI新鲜事·07月16日早间版:GPT-Red红队AI与Murati开源…
2026年07月16日早间版 AI新闻速递+热点深度讨论
开源AI还剩6个月?深度解析开源大模型的生存危机与出路
一篇《开源模型只剩6个月》的文章引发技术圈热议。本文深度剖析开源大模型面临的算力鸿沟、能力代差、许可困境三重压力,以及中国开源力量崛起、小模型效率革命等破局路径,探讨开源AI生态的可持续发展之道。

Ollama是免费开源的大模型管理平台,支持一键部署DeepSeek等开源模型到本地,兼容macOS、Windows、Linux和Docker,提供API与命令行双模式,助你零成本构建私有化AI应用。

基于真实私有化部署实测,对比DeepSeek、千问3、智谱GLM、Kimi K2、MiniMax M3、腾讯混元3六款开源大模型的硬件成本、推理效率与落地难度,帮助企业找到最匹配的内网部署方案。

Ollama是一款免费开源的本地大模型管理平台,支持macOS、Windows、Linux和Docker,可轻松部署DeepSeek等开源模型。无需复杂GPU环境配置,支持API与CLI调用,助你零成本构建私有AI应用。
每日AI新鲜事·07月06日早间播报:agent开发难点与开源大模型
2026年07月06日早间播报 AI领域热点新闻速递,10条精选资讯

NVIDIA开源大模型Nemotron 3 Ultra正式上线Perplexity,面向Pro和Max用户开放。本文解析该模型的技术优势、Perplexity的模型聚合策略,以及开源模型商业化的多方共赢路径。