[KongchangAI]
Person

Theo

Theo是一位专注于技术内容创作的博主,主要围绕人工智能、编程工具及软件工程领域进行内容输出与观点分析。其内容涵盖AI辅助编程、开发工具评测及相关技术研究解读,在技术社区中具有一定影响力,以对前沿AI编程实践的深度讨论见长。

Core Facts

Timeline (last 90 days)

Oct 5

Theo推测OpenAI与Anthropic的根本分歧是工程与研究文化的差异:OpenAI由工程师主导,Anthropic相对不那么重视软件工程师

Unverified50%
Oct 5

Anthropic在Sonnet 4时期大量使用模型生成代码,积累了充满slop的代码库,现在用更强模型回头清理

Unverified50%
Oct 5

指标驱动优化存在风险:以减少React commit或V8调用次数为目标的agent容易砍掉不影响可交互性的网络请求,导致缓存过度激进而失效不足

Unverified50%
Oct 5

Theo实测发现Claude.ai存在数据一致性问题:在一个浏览器删除会话后刷新另一浏览器仍显示被删除会话,点击报错且不重新校验侧边栏

Unverified50%
Oct 2

Theo建议应避开low档和Max档,使用medium档大致够用

Unverified50%
Oct 2

Sonnet 5.5在前端设计上明显不如Opus,远不如Fable,而Theo认为Fable 5.1是最佳设计模型

Unverified50%
Oct 2

在代码库审计基准任务中,Sonnet成本约为Opus一半但得分略高,每分成本最佳,且Sonnet仅用约5分钟而Opus用了近两倍时间

Unverified50%
Oct 2

Theo实测Sonnet 5.5通过官方订阅平均约150 TPS,Opus约100 TPS

Unverified50%
Oct 1

Theo建议组合使用6.1 Sol做代码审查与深度审计,Opus 5.5做日常写码主力,并在Claude Code中配置让Opus调用6.1 Sol

Unverified50%
Oct 1

Theo实测中GPT-6.1 Sol每个请求平均只读取约11万Token,而Sonic 5高达36万Token

Unverified50%

40 more timeline events

All Facts (20)

Verified

Bug 报告自动生成 Skill 可依据预设模板自动产出包含复现步骤、预期结果、实际结果、优先级的结构完整报告

65%
Unverified

Theo认为如果信息在代码库中能找到就不应放在AgentMD里,因为模型已经非常擅长通过bash命令和工具探索代码库

90%
Unverified

Theo建议在AgentMD中写入指令让Agent在遇到令其惊讶的事情时提醒开发者,目的是利用Agent反馈发现代码库中的架构问题

90%
Unverified

在AgentMD中告诉模型不要使用某技术(如tRPC),模型反而会更多地想到该技术,类似于'粉红大象'效应

70%
Partially Verified

测评者建议让Opus 5.5负责实现和长程构建,让GPT-6.1 Sol负责审查、根因分析、代码库调查和任务分诊

65%
Partially Verified

Sonnet 5.5在网络攻防能力上与Opus 5.5处于同一水准,是Sonnet系列中首款采用同等网络安全防护机制的模型

65%
Unverified

Anthropic在Sonnet 4时期大量使用模型生成代码,积累了充满slop的代码库,现在用更强模型回头清理

50%
Unverified

指标驱动优化存在风险:以减少React commit或V8调用次数为目标的agent容易砍掉不影响可交互性的网络请求,导致缓存过度激进而失效不足

50%
Unverified

Theo推测OpenAI与Anthropic的根本分歧是工程与研究文化的差异:OpenAI由工程师主导,Anthropic相对不那么重视软件工程师

50%
Unverified

Theo实测发现Claude.ai存在数据一致性问题:在一个浏览器删除会话后刷新另一浏览器仍显示被删除会话,点击报错且不重新校验侧边栏

50%
Unverified

Theo建议应避开low档和Max档,使用medium档大致够用

50%
Unverified

Sonnet 5.5在前端设计上明显不如Opus,远不如Fable,而Theo认为Fable 5.1是最佳设计模型

50%
Unverified

在代码库审计基准任务中,Sonnet成本约为Opus一半但得分略高,每分成本最佳,且Sonnet仅用约5分钟而Opus用了近两倍时间

50%
Unverified

Theo实测Sonnet 5.5通过官方订阅平均约150 TPS,Opus约100 TPS

50%
Unverified

Theo建议组合使用6.1 Sol做代码审查与深度审计,Opus 5.5做日常写码主力,并在Claude Code中配置让Opus调用6.1 Sol

50%
Unverified

Theo实测中GPT-6.1 Sol每个请求平均只读取约11万Token,而Sonic 5高达36万Token

50%
Unverified

作者建议Sonnet 5.5不应被直接调用,而应作为Opus或Fable在拆解复杂工作时编排的子agent组件使用

50%
Unverified

Fable 5.1是作者评价中整体最佳的前端设计模型,Sonnet 5.5的设计能力弱于Opus和Fable

50%
Unverified

在 Theo 的 skate bench 测试中,X high 档平均每次响应 338 个 token、耗时 6 秒、最慢 31 秒

50%
Unverified

Theo 建议日常使用把推理档位留在 high 或 X high,不要使用 Max 模式

50%

Source Articles