一种实验性的 Linux 技巧:将 ELF 可执行文件的组成部分存入 SQLite 表,并通过专用解释器提取执行;结合 binfmt_misc 后,内核还能把符合特定标记的 SQLite 文件直接当作可执行文件处理。
llm-anthropic 0.27 主要完成对 anthropic Python SDK 1.0 的兼容。新版 SDK 将底层 HTTP 客户端从 httpx 切换至 httpx2,此前 OpenAI Python SDK 3.0 也进行了相同迁移。
NVIDIA Groq 3 LPX 是面向 Vera Rubin 平台的交互式 AI 推理加速器。它可与 Vera Rubin NVL72 配合,进一步强化平台在长上下文场景中的高速交互能力,并覆盖从小型到大型、开放与闭源模型等多类 AI 工作负载。
智能体 AI 工作负载具有高度波动和不可预测性。NVIDIA 认为,除了负责模型计算的 GPU,CPU 在任务编排、工具执行和沙箱计算中同样关键,并以 Vera CPU 面向这类 AI 基础设施需求。
随着 AI 智能体从单轮问答转向推理、工具调用、多智能体协作等多步工作流,推理计算需求持续增长。英伟达称,Vera Rubin 与 Blackwell 平台正面向这一趋势提升单位功耗下的智能体 AI 性能。
GPT-5.6 现已在 Kiro 中提供,可协助开发者完成软件规划、构建、代码审查与测试,并进一步改善开发过程中的价格与性能表现。
llm-openrouter 0.7 已适配 LLM 0.32,可显示 OpenRouter 模型的推理轨迹,并改用 Responses API,同时新增 Shell、WebFetch、WebSearch 三种服务器端工具。
llm 0.32.1 通过将 openai 版本固定到 3 以下,临时修复了新安装时因 httpx 依赖缺失导致的启动问题;后续 0.33 计划改用 httpx2。
llm 0.33 主要更新了 OpenAI Python 3.x 兼容、嵌入接口的按次传 key 支持、模板可叠加,以及 reasoning_summary 选项。
文章概述 Joon Sung Park 先从艺术与计算的交叉切入研究,后来因《Generative Agents》与 Smallville 项目受到关注,并继续推进更大的目标:把人类行为建模成可用于推演现实的模拟系统。 从生成式代理到 Simile 《Generative Agents》展示了 AI 角色可以具备记忆、规划、社交与涌现行为,这成为他之后做 Simile 的起点。与只做任务型模型不同,Simile 更关注如何建立能反映真实人类决策的行为基础模型。 他们在建模什么 文中提到,Simile 采用长...
Bun 1.4 新增 Bun.WebView,可通过 macOS WebKit 或本地 Chromium 的 CDP 实现浏览器自动化。一项原型测试显示,加载复杂网页并执行 JavaScript 的服务可能需要 192MB 至 256MB 容器内存。
Promptwatch 的自动化监测显示,ChatGPT Search 中带有站点限定特征的搜索查询占比在 8 月初明显上升,同时 Reddit 被引用的概率似乎下降。这些数据仅覆盖其监测样本,尚不足以确认 ChatGPT 内部搜索策略的具体变化。
一位开发者分享了借助 ChatGPT 学会四元数的经历:AI 没有直接代写代码,而是通过互动教学帮助他完成应用中的旋转功能,也促使他进一步学习。
Poolside 与英伟达达成非独家技术许可协议,并获得后者 10 亿美元投资。109 名员工将加入英伟达,而创始人继续留在 Poolside。交易背后凸显前沿模型训练面临的算力、资本和数据中心约束。
编码智能体能显著提高代码产出,但代码量增长并不等于团队可以无限提速。新的瓶颈可能转向工程师理解和维护代码的认知能力,同时低成本加功能也更容易破坏软件的“概念完整性”。
一次针对 smolmachines/smolvm 的沙箱实验,目标是限制不可信代码的 CPU、内存、网络和文件访问。由于原测试环境缺少 KVM,研究改用支持 /dev/kvm 的 GitHub Actions 执行测试。


