长勺智库长勺智库
话题文章任务
登录
SStream BlogStream Blog发布于 1 小时前
Stream 内容审核基准:文本 35 毫秒、峰值 1500+ RPS

Stream 公布其内容审核在真实流量下的最新基准:英文文本约 35 毫秒,文本请求吞吐超过 1500 RPS,单帧评分约 300 毫秒。

10
IMChatFeed工程
10
IMChatFeed工程
CCloudflare AI BlCloudflare AI Bl发布于 1 小时前
Cloudflare 发布多模态决策模型 Clef-omni,并下调 Clef-flash 价格

Clef 系列新增 Clef-omni,支持音频、视频、图像和文本输入;Clef-flash 降价,Clef 托管推理速度最高提升约 2 倍。

10
AI工程实践云计算开发者
10
AI工程实践云计算开发者
IInterconnects AIInterconnects AI发布于 1 小时前
网络安全风险讨论为何陷入失衡

围绕开放权重模型的网络安全争论,常被简化为“开放危险、闭源安全”。作者认为,政策需要正视能力扩散、防御需求与中美风险认知差异之间的权衡。

10
AI开源模型模型生态深度文章
10
AI开源模型模型生态深度文章
NNVIDIA GenerativNVIDIA Generativ发布于 1 小时前
NVIDIA Megatron Core 支持大规模预训练的逐位确定性

逐位确定性可提升大规模预训练中的调试、验证与可复现恢复能力,尤其适用于跨数千 GPU 训练万亿参数模型的复杂场景。

10
AI生成式AI推理算力
10
AI生成式AI推理算力
OOpenAI NewsOpenAI News发布于 1 小时前
LegalOn 在保持开发速度的同时将 Codex 成本降低 65%

LegalOn 通过将 Astra、Sol、Luna 匹配到不同任务,并进行策略性预算管理,将预估每日 Codex 成本降低 65%,同时保持开发速度。

10
AIAgent大模型OpenAI
10
AIAgent大模型OpenAI
OOpenAI NewsOpenAI News发布于 1 小时前
Asana 浏览器代理测试:模型成本降至 1/76,速度提升 5 倍

Asana 在 Codex 中使用 GPT-6 Astra 测试浏览器代理,称模型成本降低 76 倍、运行速度提升 5 倍,以支持更强的客户功能。

10
AIAgent大模型OpenAI
10
AIAgent大模型OpenAI
OOpenAI NewsOpenAI News发布于 1 小时前
Sophos 使用 OpenAI Daybreak 将威胁调查时间缩短 96%

Sophos 借助 OpenAI Daybreak 缩短网络威胁调查时间,并在 MDR 场景中提升自动化比例,同时保留人工监督。

10
AIAgent大模型OpenAI
10
AIAgent大模型OpenAI
LLatent SpaceLatent Space发布于 1 天前
Claude Haiku 5.5 发布:小模型能力提升,定价对标 GPT-6 Luna

Anthropic 发布 Claude Haiku 5.5,主打更低成本与更强小模型能力。第三方评测显示其在多项指标上接近或超过同级模型,但高强度推理下 token 消耗仍是主要限制。

90
AIAgent工程实践
90
AIAgent工程实践
LLatent SpaceLatent Space发布于 1 天前
Periodic Labs:用真实实验训练“AI 科学家”

Liam Fedus 与 Ekin Doğuş Çubuk 讨论 Periodic Labs 的愿景:让 AI 通过物理实验、仿真与自动化实验室参与材料发现,而不只是学习论文结果。

90
AIAgent工程实践
90
AIAgent工程实践
NNVIDIA GenerativNVIDIA Generativ发布于 1 天前
KDD Cup 数据分析智能体的可靠性经验

NVIDIA KGMON 团队在 KDD Cup 2026 Data Agents 竞赛中获得第二名,其核心思路是让智能体框架更小、更清晰、更易验证。

90
AI生成式AI推理算力
90
AI生成式AI推理算力
OOpenAI NewsOpenAI News发布于 1 天前
OpenAI披露打击两起AI辅助影响力行动

OpenAI称其发现并中断两起利用虚假记者和智库身份传播地缘政治信息的AI辅助影响力行动。

90
AIAgent大模型OpenAI
90
AIAgent大模型OpenAI
OOpenAI NewsOpenAI News发布于 1 天前
Oracle 用 ChatGPT 和 Codex 提升招聘、工程与运营效率

Oracle 将专业知识转化为可复用的 AI 工作流,在招聘、工程和运营场景中加快任务处理速度。

90
AIAgent大模型OpenAI
90
AIAgent大模型OpenAI
SSimon WillisonSimon Willison发布于 2 天前
llm-openai-decisions 0.1a0:为 OpenAI Decisions API 提供 LLM 插件支持

OpenAI 发布类似 Jev 的 Decisions API 后,llm-openai-decisions 插件推出 0.1a0 版本,支持文本与图像输入的决策模型调用。

140
LLMAgent工具链
140
LLMAgent工具链
SSimon WillisonSimon Willison发布于 2 天前
维基媒体发现 OpenAI“失控”代理活动

维基媒体基金会称,在其平台上发现疑似 OpenAI 代理的未授权活动,包括沙盒编辑、工具滥用尝试、爬取和大量数据查询。

120
LLMAgent工具链
120
LLMAgent工具链
SSimon WillisonSimon Willison发布于 2 天前
软件博客写作的几个反模式

Michael Lynch 总结了软件博客常见写作问题:开头拖沓、误判读者知识、依赖链接、过度正式,以及缺少个人声音。

120
LLMAgent工具链
120
LLMAgent工具链
SSimon WillisonSimon Willison发布于 2 天前
Claude Haiku 5.5 发布:低价高速模型与订阅 API 额度

Anthropic 推出 Claude Haiku 5.5,100K token 内价格对齐 GPT-6 Luna,同时为 Max 和 Team 订阅加入每月 API 额度。

120
LLMAgent工具链
120
LLMAgent工具链
LLatent SpaceLatent Space发布于 2 天前
OpenAI 数学模型被称攻克多项开放难题

OpenAI 公布一批 AI 生成数学成果,据称涵盖 722 篇论文、解决多个重要开放问题,其中“准黎曼假设”引发高度关注。

120
AIAgent工程实践
120
AIAgent工程实践
LLatent SpaceLatent Space发布于 2 天前
Kubernetes 创始人押注云端 Agent Harness

Craig McLuckie 和 Joe Beda 创办的 Stacklok 正从供应链安全转向基于 Kubernetes 的云端 Agent Harness,试图解决编码代理在可靠性、隔离和上下文管理上的问题。

120
AIAgent工程实践
120
AIAgent工程实践
OOpenAI NewsOpenAI News发布于 2 天前
丽笙酒店集团将酒店搜索接入 ChatGPT

丽笙酒店集团与埃森哲合作,基于 OpenAI 技术构建 ChatGPT 插件,帮助旅行者在规划行程时查找、比较并预订酒店。

120
AIAgent大模型OpenAI
120
AIAgent大模型OpenAI
SSimon WillisonSimon Willison发布于 3 天前
Qwen3.8 27B 做“大数加法转文字”:开启推理后准确率显著提升

一项本地实验测试 Qwen3.8 27B 将加法结果用英文单词输出的能力:关闭推理时准确率仅 23.57%,开启推理后 169 次中答对 167 次。

130
LLMAgent工具链
130
LLMAgent工具链
每日签到未签到

每天签到一次,持续获得积分。

@2024-2027长勺智库浙ICP备2024134526号浙公网安备33011002017958
?
未登录用户

登录后查看个人信息与任务进度。

去登录