发现精彩内容,分享生活点滴
连接你我精彩世界
斯坦福用两个模型互相审计破解重采样?论文里根本没有那两位
一条推文声称用 GPT-6 Astra 和 Claude Opus 5.5 拆了重采样墙,MATH500 涨了 28 个点。但读论文的人发现,实验模型是 1.5B 的开源小模型。方法可能有效,噱头却跑在了事实前面。
Agent 该用什么语言和人交流?Karpathy 的 50K 赞背后,是一场被忽视的争论
Andrej Karpathy 建议用 ASD-STE100、图表、网页和生成视频来驯服 LLM 的输出,获赞 50K。但 DAIR.AI 创始人 Elvis Saravia 认为,这只是冰山一角:人类和 agent 之间需要一种真正的通用界面。本文整理这场争论的核心观点和一手实验。
用Claude和Astra给Minecraft写原生Metal渲染器,老MacBook跑满60fps
一位开发者用Claude Opus和Astra为Minecraft Java版构建了原生Metal渲染器和配套着色器,在5年前的MacBook上以全视网膜分辨率稳定60fps。
一个 prompt,把 Claude Code 变成 IDE
桌面版太慢,有人让 Claude 给自己写了一套 Mods:文件树、搜索、diff、终端、Git、模型路由,全塞进终端。Mods 正在把扩展 Claude Code 变成一场对话。
Room Service 3.2.0:会话历史不是缓存
Room Service 3.2.0 把 Claude Code 会话列入 AI Apps 可审查列表,删除后能完整撤销;Rust 工具链和 Node 版本单独分类展示;clean 命令修掉了分组穿透的问题。先审后删。
她把自己炒了,给 Grok Bot 写了一份岗位说明
SpaceXAI 工程师 Lauren Tan 用 Grok Bot 搭出无人值守流程,然后把自己从浏览器前开除了。distort 的长文给出了可执行的招聘框架:岗位、权限、试用期、晋升标准。关键问题已经从模型智商,变成它能挣到哪些权限。
25美元API,三支广告:他给AI动画加了个会挑刺的模型
一位Reddit网友在单Prompt生成canvas动画的基础上,加入规划阶段、批评模型和视频审查,用25.17美元的API花费制作了三支广告片。他分享了具体做法和可复制的经验。
中国AI开源:丰裕叙事与算力现实
Reddit热帖称中国靠开源AI率先走向丰裕社会,评论区却从硬件门槛、农村差距、商业逻辑多个角度泼了冷水。开源本身不解决算力,也不自动消除贫富差距。
Altman批评Anthropic“神化”AI,网友:你家的模型叫Sol
OpenAI CEO公开批评Anthropic对AI意识的研究,认为将模型神化是安全风险。但Reddit网友立刻发现,OpenAI自己的模型叫Astra和Sol,而Sol是罗马神话里的太阳神。这场关于AI灵魂的争论,谁更荒谬?
ChatGPT在CarPlay里安静听了两小时,直到我们聊到烧烤才开口
有网友在CarPlay上装了ChatGPT,开完两小时车后发现,它一直在后台监听所有对话。当朋友提到烧烤时,它突然插话推荐餐厅。这背后是语音模式的持续监听机制——直到手动断开,它都在听。