共 64 篇相关文章

AI创业公司Prismo宣称将270亿参数模型压缩至4GB,在iPhone 17 Pro上实现全参数本地运行,支持离线复杂对话、代码生成与自主编程代理。本文深度解析其压缩技术原理、与苹果MoE方案的差异,以及端侧AI的真实能力边界。

Google Chrome在用户不知情的情况下静默下载4GB的Gemini Nano本地AI模型,引发Hacker News热议。本文深度解析端侧AI的技术逻辑、用户知情权争议,以及本地AI模型成为基础软件标配的行业趋势与隐忧。

深入解析NVIDIA ACE Game Agent SDK与Unreal Engine 5的深度集成方案,了解端侧AI推理如何实现低延迟、隐私安全的智能NPC对话与行为决策,探索游戏AI从脚本驱动到智能交互的范式转变。

Google混合推理正式支持iOS平台,Android端新增Gemma 4模型,Chrome本地Web推理即将全面开放。深入解析混合推理技术原理、跨平台优势及开发者机遇。

深度解析苹果在AI浪潮中的克制策略。苹果为何不急于跟进AI军备竞赛?从后发制人的历史经验、泡沫破裂后的抄底逻辑到硬件生态护城河,全面剖析苹果AI布局的战略意图与潜在风险。

深度解析Radxa Cubie A7Z单板计算机在NPU极限负载下实现330ms glass-to-glass目标检测延迟的实测表现,涵盖延迟构成分析、实用场景评估及端侧AI优化方向。

面对美国芯片封锁与闭源垄断,中国AI开源模型凭何持续反击?本文深度拆解开源定价权博弈、光互联卡位、端侧场景三大核心路径,解析国产大模型韧性背后的真实逻辑。

OpenAI正式发布旗舰模型GPT-5.6,编码与长任务能力大幅提升;Anthropic紧急重置Claude使用额度;苹果起诉OpenAI专利盗窃;百度搭子智能体日均提问暴增20倍;机器人预判控制模型开源发布。一文速览AI行业最新动态。

系统梳理AI应用工程师面试必考技术点:PTQ/QAT量化、算子融合、推理管线、延迟吞吐分析,以及检测/分割/BEV模型的边缘部署实战要点,帮你建立端侧AI完整知识框架。

阿里千问第五代模型Qwen3全面解析:6款Dense与MoE架构模型覆盖0.6B至235B,全球首款开源混合推理模型,旗舰235B性能追平Gemini 2.5 Pro,开发者与企业部署的完整参考指南。

国内31家企业联合签署首个智能体隐私自律公约,涵盖静默读屏物理授权、禁止隐私数据商业训练、自主付款资金红线三大核心条款。本文同步梳理国产大模型首次中立平台登顶、算力军备加速、开源生态效率优化等最新动态,解读AI智能体商业化落地的机遇与阵痛。

开发者仅凭GDScript与Vulkan计算着色器,无需llama.cpp或外部依赖,在Godot 4引擎内完整运行Gemma大语言模型。本文深入解析其技术架构、性能表现与实际价值,探讨游戏引擎原生运行LLM的可行性。
PrismML突破:270亿参数大模型如何跑进iPhone?
初创公司PrismML将阿里Qwen 3.6大模型从54GB压缩至4GB以内,实现270亿参数全激活在iPhone 17 Pro本地运行。本文解析其压缩技术原理、与苹果稀疏架构的差异,以及端侧AI的商业价值与待验证的关键疑问。

苹果正式起诉OpenAI窃取商业机密,指控渗透"每个层级"。涉案前员工跳槽后利用漏洞下载机密文件,并在苹果内部系统留下自证聊天记录。本文深度解析案件证据、双方胜算与对AI硬件生态的影响。

Gemini Nano端侧AI模型目前语言支持有限,希伯来语、阿拉伯语等RTL语言尚无官方时间表。本文深度解析Gemini Nano多语言支持的技术瓶颈、商业优先级现实,以及未来一两年内的改善预期与实用替代方案。

MELTing Point论文首次以真实用户场景评测手机端大语言模型性能,覆盖iPhone、三星、Pixel等设备,测试TinyLlama、Mistral-7B等模型,揭示GPU推理优势、47度高温警告与prefill-decode分离方案,为边缘侧AI落地提供方法论参考。

大型AI模型依赖稳定云端连接,在弱网、偏远或资源受限场景中力不从心。本文深入解析小型AI模型如何通过离线推理、知识蒸馏与端侧部署,以更低成本、更高可靠性实现AI普惠,覆盖边缘计算、隐私保护等核心优势。

苹果芯片部门高管公开解析Mac Mini在AI开发者中需求激增的原因:统一内存架构突破显存瓶颈、优异能效比支持长时间本地部署,结合苹果端侧AI战略,Mac Mini正成为本地大模型推理的热门选择。

据法国爆料网站Dealabs消息,Google Pixel系列产品或将全面涨价。Pixel Watch 5 41mm版本起售价可能上调至399美元,LTE版本或达499美元,较前代Watch 4涨幅近15%。整个Pixel生态或均受波及,官方定价仍待正式发布确认。

本地大模型工具Ollama完成6500万美元B轮融资,累计融资8800万美元。900万开发者在用,85%财富500强企业内部已部署。本文深度解析企业青睐本地大模型的核心原因:数据合规、Agent降本、开源生态三大驱动力。