Wink Pings

发现精彩内容,分享生活点滴

连接你我精彩世界

把Agent拆成15关练级,每关都能验收,这教程什么来头

一个把Agent开发拆成15关、每关可独立验证的开源教程《动手学Pi》,从离线轨迹到完整coding agent,告别抽象概念打转。

2026-08-13 04:34:25阅读全文

500个DOCX 1.7秒:这个转Markdown的工具,快得有点不讲理

处理文档的人都知道,把DOCX、PDF这些格式转成干净的Markdown有多烦。表格错位、标题丢失、脚注乱跑——每换一个格式,就要重新调试一次。AnyDoc的做法很直接:500个DOCX文件,1.7秒处理完,单个文件不到5毫秒。它不靠文件后缀判断格式,而是直接看内容。

2026-08-13 04:33:25阅读全文

多智能体管线注定失败,除非你砍掉分布式推理

斯坦福系统智能实验室发布了一篇关于多智能体编排的综述,指出多智能体在传递上下文时的衰减机制会让复杂任务在生产环境里失败。有一家制药分析公司也遇到了同样的坑。解决方案是:把信号检测移出LLM,砍掉分布式推理,用一个集中推理引擎加知识图谱控制平面来兜底。

2026-08-13 04:32:19阅读全文

你每天用的模型,核心组件来自一个中国研究员的个人博客

Llama、Mistral 以及你每天都在用的模型,其核心组件之一最初只在一个个人博客上发布,在中文 NLP 圈流传,后来才被志愿者推向全球。这个故事比想象中更有意思。

2026-08-13 04:26:20阅读全文

Jack Dorsey 甩出一个 26.2k star 的免费 repo:把 AI Agent 当队友拉进频道,公司就能自己跑

Jack Dorsey 开源了一个 26.2k star 的 repo,三步就能把 AI Agent 变成你的团队成员。但真正让人睡不着觉的,是 Boris Cherny 那套“手机触发 1000 个 Agent 过夜干活”的架构。

2026-08-13 03:39:40阅读全文

让AI写代码先写测试,可能是在花钱买心安

Martin Fowler站上有个实验:同样任务,AI走TDD和不走TDD各跑两遍,结果不走TDD的排前两名,token还省了3倍。TDD是给人类认知局限打的补丁,在AI coding时代不一定适用。

2026-08-13 03:36:06阅读全文

AI架构治理:从模板到工件的最后一公里

多数"AI做架构治理"的方案在第一个模板之后就崩了。ArcKit在Claude Code里用斜杠命令走完整个生命周期,每个步骤产出真实可追踪的markdown工件。安装三步,成本透明。

2026-08-13 03:35:25阅读全文

给Transformer加一个“预言家”投影,长上下文推理快1.7倍

NVIDIA和MIT的新研究SparDA,在注意力层中增加第四个投影Forecast,提前预测下一层需要的KV块,让CPU预取与计算重叠,解码速度提升1.7倍,准确率还涨了6.5分。

2026-08-13 03:34:12阅读全文

把营销计划拆成一张决策地图:Wayfinder 的实际玩法

Matt Pocock 的 Wayfinder 是一个 Claude Code skill,原本为工程项目规划而设计,但用来做营销战役规划同样顺手。核心思路:把一个大目标拆成一个个待决策的 ticket,逐个击破,最后拼成一份完整的 campaign brief。本文介绍这个工具的工作方式、四种 ticket 类型,以及它在实际使用中的注意事项。

2026-08-13 03:32:21阅读全文

3B小模型干翻8B大块头?Liquid AI新VL模型实测:屏幕理解80.7分,手机也能跑

Liquid AI发布LFM2.5-VL-3B,3.1B参数的视觉语言模型。ScreenSpot-v2拿下80.7分,比8B的Gemma-4-E4B高出近30分。228 tokens/s跑在M5 Max上,内存占用仅3GB,还能在手机上运行。屏幕理解、工具调用、物体定位,小模型这次真的站起来了。

2026-08-13 03:30:59阅读全文