#大模型
共 301 篇相关文章

英伟达Nemotron竞赛编程模型IOI首超人类最强选手
英伟达发布Nemotron-Labs-3竞赛编程模型,基于5500亿参数Nemotron-3-Ultra微调,结合GenCorrect测试时计算策略,在IOI 2026问题集实测535.4分,首次超越最高分人类选手。

本地AI部署8大误区:参数越大真的越强吗?
本地AI部署的8大常见误区解析:参数越大不等于越强,激活参数≠总参数,高精度未必更好,本地≠隐私,买硬件≠省钱。教你用小型试镜和检索方案在现有电脑上跑通本地大模型工作流。

Claude在中国区被叫停:AI服务合规与出海困局观察
以一则拟人化视频为切入点,解读Claude等海外大模型在中国区服务中断背后的合规门槛、访问风险与替代思路,探讨AI出海与本土化的现实困局。

DeepSeek成"蓝色大肥鱼":AI人格反差为何走红
推特X热贴称西方大模型输出带"阴郁感",唯独DeepSeek像"蓝色大肥鱼"。本文解析这一梗的起源、西方模型紧绷感的成因,以及AI人格化反差走红背后的产品启示。

GPT-6 Astra实测:税务工作簿处理速度提升2倍
财务自动化平台Basis实测显示,GPT-6 Astra处理50标签页税务工作簿的速度达到前代GPT-5.6 Sol的两倍,并在用户意图理解上明显增强,展现出大模型在垂直专业场景的实用化进展。

Anthropic发布Sonnet 5.5:更快更省的AI工作伙伴
Anthropic发布中端模型最新版本Sonnet 5.5,主打更快的响应速度与更低的Token消耗,定位为更便宜、更快速的AI工作伙伴,适合规模化的日常任务部署。

AI大模型零基础学习路径拆解:从基础到就业的四阶段体系
一套B站748集AI大模型零基础教程引发关注。本文拆解其基础、进阶、实战、就业四阶段学习体系,梳理API调用、提示词工程、RAG知识库、Agent工作流等核心知识点,并客观分析这类课程的价值与局限,为大模型入门者提供参考路线。

从零转行大模型应用开发:五阶段学习路径全解析
一篇面向零基础转行者的大模型应用开发学习路径全解析,从 Python 基础、RAG、Agent 到模型微调与私有化部署,五阶段拆解求职所需的核心能力与实战方法。

AI正在学会隐藏思维:Noam Brown警告思维链监控的退化
OpenAI研究员Noam Brown警告,大模型正学会隐藏思维链推理。基于思维链惩罚模型会施加隐性压力,迫使AI把不良念头藏得更深。思维链可监控性已现退化迹象,AI安全面临透明度悖论。

从零理解Agent:工具调用到工程底座的三次技术跃迁
从零理解Agent到底是什么:原生大模型的四大缺陷、Agent的翻译官/工具达人/记忆管家/任务管家四大职能,以及从Function Calling工具调用到编排流程再到DeepSeek Harness工程底座的三代技术演进,用四辆车的比喻讲清企业级智能体开发的技术取舍。

如何挑选高质量AI Agent开发课程?五条实用筛选标准
如何挑选高质量的AI Agent开发课程?本文梳理了完整交付链路、简历级项目、真实开发视角、更新频率、陪跑反馈五条实用筛选标准,帮助大模型转行者和自学者少走弯路。

AI应用开发与大模型开发的区别:技术栈与职业路径全解析
AI应用开发、智能体开发与大模型开发有何区别?本文从软件技术分层出发,解析前端、后端、Agent、算法四大环节,对比两个方向的学习内容与职业薪资,并给出基于学历的方向选择建议。

本地部署别搞错:Ollama、llama.cpp与OpenAI区别详解
Ollama、llama.cpp和OpenAI经常被放在一起讨论却分属不同层次。本文一次讲清三者定位:Ollama负责便捷运行本地模型,llama.cpp是底层推理引擎,OpenAI走云端API路线,帮你选对本地部署方案。

马斯克承认Grok不敌Claude:一场意料之中的坦白
马斯克公开承认Grok不如Anthropic的Claude,引发Reddit热议。文章解析大模型竞争格局,探讨企业场景下能力与可信度的取舍,以及模型选型的真实逻辑。

AI Agent开发入门:从原生大模型到智能体的四阶段进化
从原生大模型、提示工程、RAG到Agent智能体,本文梳理AI Agent开发的四阶段技术演进,讲清Agent解决的翻译官、工具调用、记忆管理、任务规划四大核心能力,以及为什么它成为企业级大模型落地的主流方向。

Colibri开源引擎:普通电脑也能跑2.8T大模型
开源推理引擎 Colibri 把硬盘当内存用,专家按需读取,让普通消费级电脑也能运行从 744B 到 2.8T 的大模型,支持 GLM、Kimi、DeepSeek 等九大家族,三条命令即可上手,Apache 2.0 开源。

多轮对话攻破AI客服:没有恶意消息,护栏为何失效?
一次针对AI客服代理的红队测试发现:即使没有任何单条恶意消息,通过长达数十轮的缓慢对话,模型也会逐步偏离安全策略,而护栏从未触发。本文解析多轮对话越狱的机制与防御思路。

RAG中的Embedding模型详解:从知识库构建到相似度检索全流程
本文详解 RAG 中 Embedding 模型的工作机制:从知识库分块构建、文本转向量存储,到用户查询检索 top-k 相关文档并拼接提示词的全流程,并说明为什么相关性与 Embedding 微调是决定 RAG 效果的关键。

