02 / MY ARTICLES

AI文章与实测

这里收录微信公众号「硅基斥候S01」的完整文章,聚焦大模型、AI Agent、AI工具实测和政企AI落地。

我用孙割的白描,写下腾讯混元 4 这张迟到的答卷

从参数规模、稀疏激活、Agent 能力和产品节奏,判断腾讯混元 Hy4 preview 这张迟到答卷的分量。

想让 Agent 连续工作 24 小时?先用这个 Prompt 设计一个能在 Loop 里持续推进的长任务

把长任务拆成可持续推进、可恢复、可检查的 Agent Loop,并给出可复用的任务体检 Prompt。

GLM-5.3-Flash:我才是后训练仙人,比 DeepSeek 更便宜,而且还是多模态,还用的国产卡

拆解 GLM-5.3-Flash 的价格、稀疏架构、多模态能力和国产算力适配,判断后训练带来的真实变化。

本地中文配音(TTS)怎么选?我测了 5 款开源配音模型,最后只推荐这款!

在同一台 Apple M5 上完成资格赛、正式赛和匿名盲测,比较 5 款本地中文配音模型。

400 多个 npm 包被投毒:程序员常用的“代码零件库”出事了,该怎么查?

解释 npm 供应链攻击如何扩散,并给出锁文件、缓存、镜像、凭证和构建环境的自查顺序。

小红书竟然也做大模型了:已开源,API 现在免费!

梳理小红书 dots 团队开源的 dots3-note Preview,以及免费 API、模型定位和公开信息边界。

我做了一套本体Ontology工程系统,让Agent能读懂企业数据

展示本体工程系统怎样连接数据库、文档、知识图谱和 Agent,并保留治理与人工确认边界。

开源 3D 数字人怎么选?我跑了 3 个项目,最后选了一个失败的项目

在 Apple M5 上实测三条开源 3D 数字人路线,并解释为什么最终选择长测失败但更完整的方案。

GLM5.3发布,晋西北打成一锅粥啦!

把 38 小时内连续发布的四款模型放在同一条时间线上,比较 GLM-5.3 与同期竞品的变化。

防火墙明明开着,Docker 怎么还会把端口暴露到公网?

结合真实服务器整改经历,解释 Docker 端口发布为什么可能绕过 UFW,以及如何完成公网收口。