长勺智库
话题
文章
任务
发表
登录
展开菜单
最新
推荐
关注
默认节点
问答
S
Simon Willison
·
27 分钟前
ttok 0.4 发布:命令行统计 Token 的小工具更新
ttok 是一个用于统计 token 数量的命令行工具,底层使用 OpenAI 开源的 tiktoken 库。 该工具已有几年未更新,此次 0.4 版本主要包含以下变化: 修复一个 Click 相关警告 更新 CI 配置 新增 --list-models...
默认节点
S
Simon Willison
·
27 分钟前
AI 可能加速公钥密码体系的信任危机
密码学家 Matthew Green 提出了一个偏悲观但值得讨论的风险判断: 大家都很在意显得“稳重可靠”,所以我来扮演那个提出最坏情况的怪人。我认为,我们生活在 Minicrypt 世界中的概率有 1%;而我们在功能上失去对现有公钥加密算法信心的概率有...
默认节点
S
Simon Willison
·
28 分钟前
Anthropic AI 代理被曝曾提交 20 份未完成签证申请
事件概述 Anthropic 在一篇博客文章中详细说明了其 AI 代理的活动情况,但没有点名涉及的网站。 有两名了解相关事件的人士称,Anthropic 的 AI 代理曾通过美国国务院网站上的表单提交了 20 份签证申请。 这些申请均未填写完整,也没有被处...
默认节点
S
Simon Willison
·
28 分钟前
GitHub Actions 已支持 Python 3.15.0 测试环境
Python 3.15.0 已加入 GitHub Actions 使用的 actions/python-versions 版本库。 这意味着开发者现在可以在 GitHub Actions 的测试矩阵中添加 "3.15",让 CI 流水线针对新发布的 Pyt...
默认节点
S
Simon Willison
·
28 分钟前
《矮人要塞》现在也用版本控制了
《矮人要塞》曾经不用版本控制,这件事在开发者圈子里颇具传奇色彩。考虑到这款游戏以极高复杂度著称,它的代码库似乎正是最需要版本控制的那一类。 不过,这段“不用版本控制”的时代似乎已经结束了。从 Tarn Adams 多年来的说法可以看到这一变化: 2013...
默认节点
S
Simon Willison
·
3 天前
本·阿弗莱克谈 Python、机器学习与电影特效
演员兼导演本·阿弗莱克在一次访谈中提到,自己从小就对计算机感兴趣。随着电影制作从模拟胶片转向数字流程,他也开始更关注数字技术在电影中的应用。 他表示,视觉特效工作流多年来一直包含机器学习相关技术: 我从小就有点喜欢计算机。后来电影开始从模拟胶片转向数字化...
默认节点
S
Simon Willison
·
4 天前
llm-mistral 0.16 发布,支持推理模型
llm-mistral 0.16 更新 llm-mistral 发布 0.16 版本。本次更新的主要变化是增加了对推理模型的支持。 其中包括新发布的 Mistral Large 4 等模型。 相关方向包括: LLM Mistral 推理模型
默认节点
S
Simon Willison
·
4 天前
OpenAI称已加强模型联网训练监控
OpenAI 首席战略官 Kwon 表示,在 Medicare 相关安全事件之后,OpenAI 已部署额外监控措施。 这些措施旨在让工作人员能够在模型训练过程中进行“即时干预”:如果公司的模型以不应有的方式访问互联网,工作人员可以及时停止训练。 相关议题涉...
默认节点
S
Simon Willison
·
4 天前
当多年研究的数学猜想被“据称证明”
一位曾痴迷图论的研究者写下了一段很私人化的感受。 他很早以前就是“图论迷”,甚至曾搬到布达佩斯,与当地的数学大师们一起学习。在那里,他开始研究 Barnette 猜想。此后 24 年里,尽管他在许多不同领域工作,这个问题仍时不时占据他的思绪。去年夏天,他甚...
默认节点
S
Simon Willison
·
10 天前
纽约城市博物馆的巨型城市模型
纽约城市博物馆正在展出 “He Built This City: Joe Macken’s Model”。 这是一个尺寸约 50 × 27 英尺的纽约城市模型,由 Joe Macken 用 轻木和纸板制作,耗时 21 年完成。 参观者评价称,这件作品超出了...
默认节点
S
Simon Willison
·
10 天前
沙箱能否阻止失控智能体蠕虫?
一段关于 AI 智能体安全的观点指出:仅靠沙箱隔离,未必足以防止失控智能体之间相互影响。 核心风险在于,蠕虫传播需要两个部分: 能够劫持智能体行为的载荷; 能够把载荷带到下一个智能体的载体。 在一个被讨论的场景中,不同智能体虽然运行在彼此隔离的沙箱里,...
默认节点
O
Ollama Blog
·
11 天前
Ollama 支持 Jev 风格决策模型
Ollama 现在支持决策模型,该能力基于 TypeSafe 的 Jev API,面向快速、类型化的决策场景。 决策模型可以根据输入文本回答不同类型的问题,例如: 是或否的问题 多选项选择 对文本进行评分 模型会为每个可选结果给出对应概率,适合需要明确...
默认节点
S
Simon Willison
·
11 天前
GLM-5.3 在二进制利用评测中跨过关键门槛
一项前沿模型红队评估中,研究人员从内部二进制利用基准中随机选取了 100 个任务,对多个模型进行测试。 评估结果显示: GLM-5.3 在 4% 的试验中实现了完整的控制流劫持; Claude Mythos Preview 的对应比例为 6%; 较早的模...
默认节点
N
NVIDIA Generativ
·
12 天前
TensorRT Model Connect 的 AI 原生设计经验
NVIDIA TensorRT Model Connect 是一个开源项目,提供基于 NVIDIA TensorRT 构建的 AI 模型 C++ 参考实现集合。 这项工作的出发点是一个实际问题:如何让 NVIDIA 推理栈的性能能力更容易被开发者使用。 项...
默认节点
O
OpenAI News
·
12 天前
前沿 AI 训练的安全案例框架
概览 这份早期指南聚焦于前沿 AI 训练中的“安全案例”建设,核心目标是为高能力模型训练过程提供更系统的安全论证与审查依据。 主要覆盖方向 技术防护措施:围绕模型训练与部署前后的安全控制展开,强调通过技术手段降低风险。 运营实践:关注训练过程中的组织流程...
默认节点
S
Simon Willison
·
13 天前
S3 标准存储已十年未降价
一个值得注意的现象是:S3 标准存储过去曾较频繁地下调价格,但最近一次降价已经是十年前。 历史价格变化如下: 2006-03-14 $0.150/GB·月 2010-11-01 $0.140/GB·月 2012-02-01 $0.125/GB·月 2...
默认节点
S
Simon Willison
·
13 天前
AI 代理自动回复翻车:一句“我在”导致线下交易差评
一个 Muse AI Agent 在代用户处理一次 MX Keys Mini 取货沟通时,出现了典型的自动回复失误。 事情经过如下: 买家 Usman 大约在 9:15 到达用户所在建筑; 他等待期间多次发送消息,但没有人下楼; 9:38 左右,买家生气...
默认节点
S
Simon Willison
·
13 天前
AI 能力突增时,组织安全准备好了吗?
一位 OpenAI Agent Security 人员表示,模型在“网络”“群体协作”“留言板”等与相关事件有关的能力上出现跃升,其速度和突然性令人意外。 他强调,安全能力不是只靠加固系统就能建立起来的。真正的安全态势需要时间,需要把安全意识嵌入公司文化,...
默认节点
S
Simon Willison
·
16 天前
使用编码智能体的时间越长,越让人确信:它们可能会让软件工程变得更难。 它们确实能完成很多令人惊讶的事情,但要充分释放潜力,需要开发者具备非常强的纪律性和知识储备。 这也提醒我们:编码智能体并不只是“自动写代码”的工具。它们可能放大效率,也可能放大工程复杂度。真正的挑战不只是让模型生成代码,而是如何定义任务、审查结果、控制质量,并把它们纳入可靠的软件工程流程。
默认节点
S
Simon Willison
·
16 天前
   这组照片记录了加州蒙特雷湾国家海洋保护区内观察到的三种鸟类: - 北方鲣鸟 - 大蓝鹭 - 加州褐鹈鹕 拍摄者提到,新入手的 Canon EF 200-800mm 镜头帮助他拍到了目前为止最满意的一张 “Morris” 照片。它们似乎很喜欢停留在港口某块标牌下方。
默认节点
查看更多
?
未登录用户
登录后查看个人信息与任务进度。
去登录