Codestral 这类垂直模型吃的是窄任务:补全、转写、出图。通用模型(GPT-5.6、Claude、Gemini)吃的是推理、工具和跨步骤编排。没有对照实验就不打分。数字只留厂商写过、且能点开官方页的那几条。
垂直模型:代码、语音、图像
2026 年 Autonomous Agent 状态:Devin、Manus、Cursor 的真实对比
能自主完成多步骤任务的 AI Agent。不需要人一步一步指挥,丢一个目标,它自己规划、执行、验证。
公开材料里经常被并列的是 Devin、Manus、Cursor Agent。没有跑过这三套的对照实验,这里不打分。
Go 最佳实践
一个可构建的 Go 树一份 go.mod。门禁是 gofmt、go test ./...、go vet ./...。按生产仓库会碰到的边界写:模块、错误、并发、测试。不把 Effective Go 再抄一遍。
多模态 LLM:图片、音频、视频怎么接
OpenAI 的图像与视觉接口 已经把看图写进通用模型;Gemini 和 Claude 各有官方视觉页。能力进了 API,不等于可以靠无出处准确率选型。没跑对照实验,就不打分。
GPT-5.4 的百万 token 上下文:终于不再截断
GPT-5.4 在 2026 年 3 月 5 日发布。两个主要升级:
之前的主流上下文上限是 128k(GPT-4o)和 200k(Claude 3.5)。GPT-5.4 直接拉到 100 万 token,约等于:
API 默认开启,不用额外申请。