共 65 篇相关文章

Maple-Preview项目实现20B参数三元量化MoE模型在iPhone上以120 tok/s速度运行。本文拆解三元量化、MoE稀疏激活、端侧推理三大核心技术,分析端侧大模型部署的价值与挑战。


Supercut是一款主打隐私保护的本地化AI视频编辑器,所有处理在设备端完成,支持自然语言剪辑指令、屏幕录制自动缩放、自动字幕等40款工具,免费起步无需账户,适合注重数据安全的创作者。

everyone-can-use-english是GitHub上超3.5万Star的开源英语学习工具,集成Whisper语音识别、TTS和大语言模型,提供精听训练、跟读对比、AI对话等功能,帮助开发者和学习者零成本突破哑巴英语。

谷歌发布SL2T手语转文字模型,支持美国手语实时转换为英文文本,深度整合Gboard输入法与Live Transcribe,率先在Pixel 11端侧部署,为聋人及听障用户提供系统级无障碍交互体验。

Needle是cactus-compute团队开源的14MB超轻量基础模型,专为手机、可穿戴设备、智能家居和机器人等边缘设备设计。本文深入分析Needle的技术定位、端侧推理优势及其在边缘AI趋势中的意义。

Ododok是一款利用AirPods内置传感器实时追踪咀嚼次数、节奏和用餐时长的健康App,无需额外硬件即可量化饮食行为,帮助用户培养慢食习惯,改善消化健康。

Needle2是一个仅14MB的端侧智能体大模型(agentic LLM),专为手机、可穿戴设备、智能家居和机器人设计。本文深入分析其技术原理、极致压缩策略及应用场景,探讨端侧AI从云到端的范式转移趋势。

深度解析Papaya这款在设备端运行的私密AI应用,探讨其端侧推理技术架构、隐私设计理念、数据不离开手机的实现方式,以及敏感场景下AI产品面临的伦理挑战与行业趋势。

深度分析技术演进的底层逻辑与关键趋势,涵盖AI基础设施化、计算范式变革、人机协作模式演变,探讨如何构建对未来技术的判断力,为开发者和创业者提供前瞻性思考框架。

苹果在AI领域被质疑「慢半拍」,Siri落后于竞品,隐私优先策略限制了云端AI能力。本文深度分析苹果AI战略的争议、端侧智能的潜力,以及苹果生态整合能否实现后发制人。

深度分析苹果在生成式AI时代的战略困境:从Apple Intelligence落地不及预期、Siri智能化升级滞后,到隐私优先策略与AI能力的矛盾,解读苹果为何在AI竞赛中落后及未来翻盘机会。

Finamie是一款AI语音记账应用,用户只需说出消费即可自动完成记录和分类。本文深度评测其语音识别、智能分析等核心功能,分析语音记账的优势与挑战。

Hand Wave借助Meta智能眼镜摄像头,通过开源AI神经网络实时将手语翻译为文字和语音,支持iOS与Web端。了解这款无障碍沟通工具的核心技术、跨平台设计与未来潜力。

CoachAI是一款iOS健身应用,利用人体姿态估计技术通过iPhone摄像头实现自动计数和实时动作纠正。本文深度解析其技术原理、功能特点及与Kaia Health、Onyx等竞品的差异化定位。

谷歌推出Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber三款新模型,进一步完善Flash轻量级AI产品线。本文解析新模型定位、差异化策略及对开发者的影响。

一个基于BERT风格Transformer架构的开源血糖预测模型,仅1700万参数即可在手机端运行,利用DILATE和Pinball损失函数组合,实现2小时血糖变化曲线预测,为1型糖尿病患者提供个性化血糖管理方案。

Google DeepMind发布Gemini Robotics 2机器人基础模型,首次实现人形机器人全身控制、多步骤任务错误恢复、多机协同及端侧部署,详解其核心能力与安全机制。