共 64 篇相关文章

一位创作者开源了专门复刻GTA圣安地列斯RenderWare引擎画风的LoRA模型,能在复杂场景中稳定呈现PS2时代经典视觉风格。本文解析这款小众LoRA的技术特点、生成效果与怀旧美学价值。
科技前沿本周AI周报涵盖NVIDIA开源26亿参数世界模型、小米开源自动驾驶大模型Xiaomi One VL、OpenAI Codex快捷键升级、Anthropic 9000亿美元估值融资等重磅事件,一文掌握AI行业最新动态。
产品体验DiffSynth-Studio是ModelScope团队开发的扩散模型开源工具,GitHub星标超12000。本文从功能定位、社区热度、上手门槛三个维度详解这款AI图像生成工具为何值得关注。

8月18日AI日报:Cursor正式并入SpaceX AI团队打造Grok工具,阿里Qwen3系列开源模型单卡可跑200+ tok/s逼近前沿,GLM-5.3发布主打编码能力,GPT-5.6预览极速模式,开源Agent框架48小时破10万星。
每日AI新鲜事·08月24日午间版:低成本机器人遥操与AI隐私之争
2026年08月24日(周一)午间版 AI新闻速递+热点深度讨论

英伟达从AI芯片供应商转型全栈玩家,积极参与开源模型竞赛。本文深度解析英伟达下场背后的生态绑定策略、行业竞争白热化趋势,以及对AI开源生态和竞争格局的深远影响。
每日AI新鲜事·08月23日午间版:本地LLM体验优化与信任危机
2026年08月23日(周日)午间版 AI新闻速递+热点深度讨论

一位攀岩爱好者利用VLM视觉大模型、ViTPose+和RT-DETR三大AI模型,打造了抱石攀岩动作分析工具。无需训练专用模型,仅通过自然语言提示即可实现岩点分割、姿态估计和攀爬路径可视化,展示了AI辅助运动训练的全新可能。

NVIDIA推出Nemotron 3.5 Lightning开源模型,主打智能、快速、高效,专为连续长程Agent任务设计。本文解析其核心优势、开源策略及对AI Agent行业的潜在影响。

详解vLLM大模型推理部署与Unsloth高效微调全流程,涵盖命令行一键部署、Python代码调用、AutoDL云服务器环境搭建、ModelScope国内加速等实操细节,以DeepSeek-OCR视觉模型为例演示完整链路。

OpenAI计划在欧洲市场推出广告功能,将免费用户转化为收入来源。本文深入分析OpenAI选择欧洲作为广告试验田的策略考量、广告与用户信任的平衡难题,以及这一举措对AI行业商业化的深远影响。

Dograh是一款完全开源的语音AI智能体平台,提供可视化流程构建、30+模型集成、本地部署、电话通信及人工转接等功能,支持一条命令自托管,是VAPI的自由替代方案。

Meta推出Muse Code终端AI智能体,由Muse Spark 1.2模型驱动,具备持久化后台运行、仓库级执行和内置验证三大核心能力,专为长周期复杂编程任务设计,标志AI编程从辅助工具向自主工程师演进。

MiniMax H3团队在Reddit发起AMA,详解开源视频生成模型的架构设计、图生视频能力、推理优化及未来路线图,全面解析这款开源视频模型的技术实力与社区生态布局。

阿里通义Qwen系列大模型在Text Arena文本竞技场排行榜冲上第二名,通过真人盲评机制验证了其在回答质量、人类偏好对齐方面的顶尖实力。本文解析通义模型的技术优势、开源策略及对行业格局的深远影响。

阿里巴巴发布通义千问Qwen3-Max旗舰模型,定位编码与协作新标杆。本文深度解析其编码能力、协作定位、开源生态策略及行业竞争格局,帮助开发者全面了解这款大模型的核心优势与应用前景。

一条Reddit帖子引发热议:用户催更Kimi K3,拿DeepSeek低价做对比。本文深度解读国产大模型迭代速度、定价策略与用户忠诚度之间的博弈,分析月之暗面面临的竞争压力与行业启示。

DeepSeek V4 Pro引发开源社区热议。本文分析DeepSeek从V2到V3的迭代路径、MoE架构的成本优势,以及开发者对下一代开源大模型的期待与理性判断建议。