共 10 篇相关文章

Z.ai发布GLM-5.3大模型,通过大规模后训练扩展在同一底座上实现编程能力跃迁,在智能体编程任务上达到开源SOTA水平,并在漏洞发现与网络防御领域展现涌现能力。深度解析其技术路线与行业意义。
每日AI新鲜事·08月16日晚间版:五年级LLM实验与vibe coding
2026年08月16日(周日)晚间版 AI新闻速递+热点深度讨论

Perplexity Comet用户反映AI代理能力明显退化,填写表单、自动化操作等功能频繁拒绝执行。本文从反自动化检测、合规风险、模型策略收紧等角度深入分析原因,并探讨AI代理产品面临的结构性困境。

阿里通义千问推出QwenGrowthPlan成长计划,邀请开发者用真实任务反馈推动Qwen3.8-Max模型迭代优化。深度解析该计划对agentic智能体能力提升、社区共建生态和大模型竞争格局的深远影响。

DeepSeek-V4-Flash-0731正式发布,以Flash级低价提供前沿智能体能力,官方称关键基准超越V4-Pro。原生支持Responses API和Codex CLI,适合AI编程和Agent应用开发者。本文解析其核心亮点与行业意义。
Clawk:为AI编程助手创建用完即弃的Linux沙箱隔离环境
AI编程助手(Claude Code、Cursor等)直接运行于本地机器存在严重安全隐患。Clawk项目提出核心解决方案:为AI智能体提供一次性disposable Linux虚拟机,彻底隔离SSH密钥、API令牌等敏感数据,构建更安全的AI编程工作流。
用Claude做约束优化研究:AI自动化科研的潜力与局限
探讨Claude等大语言模型如何参与约束优化研究,涵盖问题建模、代码生成、求解器调用全流程。分析LLM在自动化科研中的真实能力边界,以及人机协作模式的务实路径。

深度解析AI编程范式转变:从手动编写Prompt到构建代理自提示循环系统。了解如何通过代理自审代码、主动获取上下文等方法,实现规模化高质量AI编程,从Prompt工程师进阶为代理系统设计师。
产品体验深度解析DeepSeek V4万亿参数开源模型,从性能Benchmark、百万级上下文技术架构、API成本对比到MIT开源协议,全面拆解V4如何在编程、推理等维度超越GPT和Claude等闭源模型。
深度解读深度解析Google A2A协议的核心机制(Agent Card、Task、Transport),对比A2A与MCP协议的分工差异,解读AI Agent从工具调用到多智能体团队协作的技术演进路径,附详细对比表。