共 92 篇相关文章
国会致信奥特曼:要求公开HuggingFace安全事件真相
美国国会正式致函OpenAI CEO Sam Altman,要求就HuggingFace平台安全事件提供透明度说明。本文分析国会核心诉求、AI供应链安全挑战及对行业的深远影响。
每日AI新鲜事·08月14日午间版:Mistral OCR 4.1与供应链安…
2026年08月14日(周五)午间版 AI新闻速递+热点深度讨论

Embabel是一款基于Kotlin编写的JVM智能体框架,为Java/Kotlin开发者提供在熟悉技术栈中构建AI Agent的能力。本文深度解析其定位、技术优势及与Spring生态的协同价值。

Mistral AI申请「代码化工具调用」专利在开发者社区引发热议。本文解析代码化工具调用的技术原理、与传统JSON Function Calling的区别,以及专利化对AI Agent开源生态的潜在影响。

深入解析PagedAttention如何借鉴操作系统分页机制优化GPU显存管理,消除KV Cache碎片化问题,并探讨模型路由在多模型推理服务中的智能调度策略,助力大模型推理系统提升吞吐量与降低成本。
每日AI新鲜事·08月13日午间版:Qwen3.8超大MoE与Grok Bo…
2026年08月13日(周四)午间版 AI新闻速递+热点深度讨论
每日AI新鲜事·08月12日晚间版:科研Agent自动化与Claude Co…
2026年08月12日(周三)晚间版 AI新闻速递+热点深度讨论

详解如何在Azure Kubernetes Service上使用vLLM自托管大语言模型,涵盖GPU调度、NVIDIA GPU Operator配置、部署排错及成本控制等生产化实践要点。

中国大模型集体登顶OpenRouter周使用量排行榜,DeepSeek、Qwen、Kimi等开源模型凭借极致性价比和技术突破赢得全球开发者青睐,深度解析霸榜背后的原因与行业启示。

DeepSeek V4 Flash在Ollama Cloud上频繁出现推理死循环(Doom Loop),模型无法正确调用工具并陷入重复输出。本文分析死循环成因,探讨思考块与工具调用的冲突机制,并提供实用的检测与规避方案。

复盘OpenAI意外对Hugging Face造成DDoS攻击效果的完整事件经过,分析意外流量洪峰的技术原因,探讨AI基础设施的脆弱性、客户端责任与服务方防御策略,为大规模API消费方提供实践参考。

MiniMax H3团队在Reddit发起AMA,详解开源视频生成模型的架构设计、图生视频能力、推理优化及未来路线图,全面解析这款开源视频模型的技术实力与社区生态布局。

深入解析SPA分词器修复升级与更宽泛Tokenizer的技术意义,探讨词表扩展对模型性能的影响,涵盖分词器工作原理、边界处理修复、Playground验证环境等核心内容。

深入分析词错误率WER在语码转换语音识别场景下的局限性,介绍CSWER、CER、语言识别准确率等替代评测指标,并提供双语ASR测试集选择与构建的实践建议。

Homebench是一款开源的本地大模型评测工具,从速度、内存占用和输出质量三个维度综合评估LLM在本地硬件上的真实表现,帮助开发者做出最优的模型选型和量化方案决策。

Stickblade Arena是一个基于物理引擎的LLM评估基准,让大模型在2D竞技场中实时对战,通过空间推理和动态决策考验模型能力,有效避免训练数据泄漏问题。六轴Elo评级系统揭示了模型在不同物理约束下的细粒度能力差异。

Tomte是一款专为Apple Silicon优化的Gemma模型本地运行框架,免费开箱即用,提供高速推理体验。本文详解其核心功能、性能优势及与ChatGPT的对比,帮助Mac用户实现隐私安全的本地AI部署。

详解如何用AMD RX 7800 XT 16GB显存本地部署大语言模型驱动量化交易机器人,涵盖ROCm生态现状、7B-14B模型推荐(Qwen2.5、Llama 3.1)、Ollama/LM Studio部署方案及系统架构设计。