01
国际通用模型更新
GPT、Gemini、Claude、Llama、Grok 等模型更新后的真实开发与推理任务验证。
GPT、Gemini、Claude、Llama、Grok 等模型更新后的真实开发与推理任务验证。
Qwen、DeepSeek、Kimi、GLM、豆包、混元等中文模型的能力、限制与使用判断。
代码理解、跨文件修改、故障定位、长上下文和工程约束,不使用脱离项目的玩具题替代。
长文、搜索问答、引用、SEO/GEO、资料研究和内容运营任务。
规划、Tool Use、结构化输出、权限和失败恢复,判断模型是否适合进入 Agent Runtime。
账号、地区、API、价格、上下文、速率限制和暂未开放能力都必须写清楚。