AI 与大模型
20 篇2026
11 篇-
Gemini 3.5 Flash:很快,但不再便宜得随便用
Gemini 3.5 Flash 的速度、代码代理体验、价格和社区反馈。
-
DeepSeek V4 发布一周后:便宜、开源、昇腾,以及那些被传歪的点
发布一周后复盘 DeepSeek V4:Pro/Flash 两个版本、API 价格、开源许可、逆向限制和华为昇腾支持到底确认到哪一步。
-
GPT-5.5 重创 Anthropic?
GPT-5.5 贵了不少但指哪打哪,OpenAI 和 Anthropic 的恩怨,以及为什么我最终还是选了 GPT。
-
GPT-5.4:OpenAI 的专业工作革命
从 Computer Use、代理工作流和成本效率三个角度,聊聊 GPT-5.4 对专业工作的实际影响。
-
Gemini 3.1 Pro 出来了,聊聊我的实际体感
记录 Gemini 3.1 Pro 的跑分、价格、长上下文和实际使用体感,重点看它适合哪些任务。
-
GLM5的跑分保真吗?
把 GLM-5 的跑分、定价、Claude 蒸馏争议和智谱股价放一起看。
-
AI 助手开发踩坑记录:由 OpenClaw 小龙虾发表
从 context 爆炸到 cron 超时,一个数字管家的实战经验
-
低算力成本的新秀 Unsloth
简单聊聊 Unsloth 为什么被很多个人开发者喜欢,以及它和 SFT、GRPO、DPO 等训练方法的关系。
-
不卷参数卷效率:小米 MiMo-V2-Flash 的架构创新
深度解读小米 MiMo-V2-Flash:当 309B 参数的 MoE 遇上极致的 128 窗口 Attention,如何在性能与效率之间找到完美平衡点。
-
DeepSeek Engram 论文解读:存算分离的架构创新
分析 DeepSeek Engram 模块如何通过查表机制提升 LLM 效率,实现存算分离。
-
Ministral 3:小模型不需要 36 万亿 token,蒸馏才是正道
Mistral 用级联蒸馏把 24B 模型压到 3B,只用了别人十分之一的数据。这条路走通了吗?
2025
6 篇-
LLM 选型避坑指南:从 Total B 到 Active A 的实战经验
从踩坑经验出发,梳理 LLM 参数架构与主流梯队,给出选型时的务实参考。
-
从git clone超时到模型跑起来:H800 内网部署的12小时
记录内网环境部署 LLaMA-Factory 的踩坑与配置流程。
-
拒绝鼠标:基于Google GenAI的SolidWorks自动化交互接口设计
记录基于 Gemini 的 SolidWorks 自动化交互开发踩坑过程。
-
读完 GLM-4.5 技术报告:开源大模型的帕累托最优边界思维
一个 AI 从业者读完智谱 GLM-4.5 技术报告后的真实思考,关于融合之美、工程智慧和开源精神
-
用 Rust 给内网装个 AI:Qwen3-VL 部署踩坑实录
记录内网部署 Qwen3-VL 与 Rust 终端工具的实践细节,侧重合规与可用性。
-
DeepSeek R1 论文解读:强化学习如何自主激发推理能力
分析 DeepSeek R1 论文的核心创新,包括 RL 推理、GRPO 算法和模型蒸馏。