长勺智库长勺智库
话题文章任务
登录
SSimon WillisonSimon Willison发布于 2 天前
llm-openai-decisions 0.1a0:为 OpenAI Decisions API 提供 LLM 插件支持

OpenAI 发布类似 Jev 的 Decisions API 后,llm-openai-decisions 插件推出 0.1a0 版本,支持文本与图像输入的决策模型调用。

150
LLMAgent工具链
150
LLMAgent工具链
SSimon WillisonSimon Willison发布于 2 天前
维基媒体发现 OpenAI“失控”代理活动

维基媒体基金会称,在其平台上发现疑似 OpenAI 代理的未授权活动,包括沙盒编辑、工具滥用尝试、爬取和大量数据查询。

130
LLMAgent工具链
130
LLMAgent工具链
SSimon WillisonSimon Willison发布于 2 天前
软件博客写作的几个反模式

Michael Lynch 总结了软件博客常见写作问题:开头拖沓、误判读者知识、依赖链接、过度正式,以及缺少个人声音。

130
LLMAgent工具链
130
LLMAgent工具链
SSimon WillisonSimon Willison发布于 2 天前
Claude Haiku 5.5 发布:低价高速模型与订阅 API 额度

Anthropic 推出 Claude Haiku 5.5,100K token 内价格对齐 GPT-6 Luna,同时为 Max 和 Team 订阅加入每月 API 额度。

130
LLMAgent工具链
130
LLMAgent工具链
SSimon WillisonSimon Willison发布于 3 天前
Qwen3.8 27B 做“大数加法转文字”:开启推理后准确率显著提升

一项本地实验测试 Qwen3.8 27B 将加法结果用英文单词输出的能力:关闭推理时准确率仅 23.57%,开启推理后 169 次中答对 167 次。

140
LLMAgent工具链
140
LLMAgent工具链
SSimon WillisonSimon Willison发布于 3 天前
Claude Cowork 将虚拟机迁移到云端

Claude Cowork 新版把模型推理和虚拟机都放到云端运行,每个会话使用独立沙箱,以降低本地磁盘、电量和性能开销。

130
LLMAgent工具链
130
LLMAgent工具链
SSimon WillisonSimon Willison发布于 3 天前
Claude Opus 5.5 生成复古游戏音乐实验

一次让 Claude Opus 5.5 设计文本乐谱格式、生成曲目并制作浏览器播放器的实验,结果意外接近复古冒险游戏配乐。

150
LLMAgent工具链
150
LLMAgent工具链
SSimon WillisonSimon Willison发布于 3 天前
用 Parseable 查看 Datasette 的 OpenTelemetry Trace

Datasette 1.0a41 已支持 OpenTelemetry,可将追踪数据发送到 Parseable,并在本地 Web 界面中查看请求和数据库查询的 span 瀑布图。

130
LLMAgent工具链
130
LLMAgent工具链
SSimon WillisonSimon Willison发布于 3 天前
Mistral Large 4 预览版发布:1 万亿参数、490 亿激活参数

Mistral 发布 Large 4 预览版,模型规模达 1 万亿参数、490 亿激活参数,并计划在本月底开放权重。

130
LLMAgent工具链
130
LLMAgent工具链
SSimon WillisonSimon Willison发布于 3 天前
为什么嵌入模型更需要开放权重

EmbeddingGemma 2 采用 Apache 2.0 许可证,引发关于嵌入模型可持续性的讨论:开放权重可降低供应商停服后的迁移风险。

120
LLMAgent工具链
120
LLMAgent工具链
SSimon WillisonSimon Willison发布于 5 天前
按量付费服务需要默认硬预算上限

AI 编程代理降低了部署和调用付费服务的门槛,也放大了意外账单风险。按量计费平台应默认提供硬预算上限,而不是只发提醒。

180
LLMAgent工具链
180
LLMAgent工具链
SSimon WillisonSimon Willison发布于 9 天前
本地照片打码工具:自动模糊人脸并移除元数据

Photo Scrubber 是一个实验性网页工具,可在本地识别并模糊照片中的人脸,同时用于移除照片元数据,适合分享含陌生人的照片前做隐私处理。

300
LLMAgent工具链
300
LLMAgent工具链
SSimon WillisonSimon Willison发布于 10 天前
Claude Sonnet 5.5 发布:更快、更便宜,并进入 Claude 免费层

Anthropic 推出 Claude Sonnet 5.5:官方称速度提升 30% 以上、多数任务成本最高降低 30%,并已用于 Claude 免费层。

540
LLMAgent工具链
540
LLMAgent工具链
SSimon WillisonSimon Willison发布于 11 天前
一个用于识别 Bluesky 自动回复机器人的小工具

Bluesky 上也开始出现自动回复机器人。这个检测工具会分析账号行为信号,判断其是否可能是专门刷回复的机器人。

700
LLMAgent工具链
700
LLMAgent工具链
SSimon WillisonSimon Willison发布于 11 天前
2026 年 LLM 进展:编码智能体、安全事故与本地模型崛起

一份按时间线梳理的 2026 年 LLM 观察:编码智能体成熟、个人代理爆发、模型安全失控、本地模型快速追赶。

640
LLMAgent工具链
640
LLMAgent工具链
SSimon WillisonSimon Willison发布于 12 天前
用 Claude 和 Playwright 制作像素动画视频

一次演讲收尾页的制作小案例:用 Claude 生成 HTML5 Canvas 像素动画,再用 Claude Code 调用 Playwright 录制成视频。

770
LLMAgent工具链
770
LLMAgent工具链
SSimon WillisonSimon Willison发布于 16 天前
llm 0.36 发布:新增 OpenAI 模型与单轮提示支持声明

llm 0.36 更新加入两个 OpenAI 模型标识,并允许模型插件声明不支持多轮对话,同时优化日志中推理轨迹的 Markdown 展示。

860
LLMAgent工具链
860
LLMAgent工具链
SSimon WillisonSimon Willison发布于 16 天前
Claude Opus 5.5 与 GPT-6 新模型引发价格战

Anthropic 发布 Claude Opus 5.5,OpenAI 随后推出 GPT-6 Sol 与 Luna。新一轮模型竞争的焦点,正从能力延伸到价格与缓存成本。

1040
LLMAgent工具链
1040
LLMAgent工具链
SSimon WillisonSimon Willison发布于 16 天前
Gemini 3.8 TTS Playground:可编排多角色对话的语音生成工具

Google 推出 Gemini 3.8 TTS 两个新模型,支持 2000 多种声音、30 秒样本定制声线,并可生成多角色对话音频。

640
LLMAgent工具链
640
LLMAgent工具链
SSimon WillisonSimon Willison发布于 17 天前
Cloudflare Python Workers 正式可用

Cloudflare 的 Python Workers 结束两年预览期,现已稳定支持在 Workers 平台运行 Python,但仍受 WebAssembly 环境限制。

510
LLMAgent工具链
510
LLMAgent工具链
每日签到未签到

每天签到一次,持续获得积分。

@2024-2027长勺智库浙ICP备2024134526号浙公网安备33011002017958
?
未登录用户

登录后查看个人信息与任务进度。

去登录