中文浏览 · AI Hot

AI Hot 中文浏览

你选择了中文后,站内导航会保持在中文路径;未完全翻译的内容会回到中文入口说明,而不是跳回英文体验。

中文偏好已保持

选择中文后,顶部导航、热门线索、Feed 详情和主要栏目都会优先进入 `/zh/*` 路径;未完整本地化的深页会显示中文壳与明确说明,不再把你甩回英文页。

当前热门线索

快速扫读今日 feed 之前,先看最值得追的方向。

Top 3
  1. 1Claude Opus 5.5,GPT-6 Sol,GPT-6 Luna及新一轮价格战
  2. 2Rabbit新AI代理无需R1运行
  3. 3高通推出两款新智能手机芯片,重点在于AI
9月23日 · 今日
23:46
S
Simon WillisonSignal
@simonw
为什么重要 · 38
38

Claude Opus 5.5,GPT-6 Sol,GPT-6 Luna及新一轮价格战

昨日是Grok 4.7(鹈鹕)和MiMo v2.6 Flash/Pro(更多鹈鹕)。今天Anthropic发布了Claude Opus 5.5,大约一个小时后OpenAI发布了GPT-6 Sol和GPT-6 Luna。要全面了解这些新模型还需要一段时间,但以下是我目前的一些印象。

Blogaiopenaigenerative-ai

为什么重要

ai 角度:昨日是Grok 4.7(鹈鹕)和MiMo v2.6 Flash/Pro(更多鹈鹕)。今天Anthropic发布了Claude Opus 5.5,大约一个小时后OpenAI发布了GPT-6… 先看原文核实,再决定是否影响你的工具栈、供应商或研究判断。

9 hours ago
20:52
T
The VergeSignal
@theverge
为什么重要 · 38
38

Rabbit新AI代理无需R1运行

Rabbit公司推出的R1设备表现平平,现在正推出一个独立的AI代理,无需其硬件即可使用,如Wired此前报道。该初创公司表示,其新的OS3“代理操作系统”在云端运行,但可在Windows、Mac和Linux设备上本地操作。A

The Rabbit R1 in front of a window.
The VergeMedia

为什么重要

The Verge 角度:Rabbit公司推出的R1设备表现平平,现在正推出一个独立的AI代理,无需其硬件即可使用,如Wired此前报道。该初创公司表示,其新的OS3“代理操作系统”在云端运行,但可在Windows、M… 先看原文核实,再决定是否影响你的工具栈、供应商或研究判断。

12 hours ago
20:00
T
TechCrunchSignal
@techcrunch
为什么重要 · 38
38

高通推出两款新智能手机芯片,重点在于AI

高通表示,其新顶级芯片可以本地运行30B混合专家模型。

TechCrunchStartup

为什么重要

TechCrunch 角度:高通表示,其新顶级芯片可以本地运行30B混合专家模型。 先看原文核实,再决定是否影响你的工具栈、供应商或研究判断。

13 hours ago
18:48
S
Simon WillisonLLM Release
@simonw
值得关注吗 · 38
38

llm 0.36

发布:llm 0.36 新OpenAI模型:gpt-6-sol用于GPT-6 Sol和gpt-6-luna用于GPT-6 Luna。#1702 模型插件现在可以声明supports_conversation = False,用于只接受单轮提示的模型。当这些模型收到助手或工具历史记录时,LLM引发llm.ConversationNotSupported。

Blogopenaillm

为什么重要

openai 角度:发布:llm 0.36 新OpenAI模型:gpt-6-sol用于GPT-6 Sol和gpt-6-luna用于GPT-6 Luna。#1702… 先看原文核实,再决定是否影响你的工具栈、供应商或研究判断。

14 hours ago
18:00
H
Hacker NewsSignal
@hn
为什么重要 · 99
99

GPT-6 Sol和Luna

GPT-6 Sol和Luna — 来自Hacker News首页

HNCommunity

为什么重要

AI 角度:GPT-6 Sol和Luna — 来自Hacker News首页 先看原文核实,再决定是否影响你的工具栈、供应商或研究判断。

15 hours ago
18:00
17:55
A
ArXivSignal
@arxiv
值得关注吗 · 38
38

CliffCompaction:为长周期编码代理提供高效压缩

代理通常处理需要数百万个上下文标记的复杂问题,由于上下文窗口有限,需要跨会话进行压缩。我们开发了CliffCompaction,一种自动压缩技术,在有限上下文窗口下将成本降低高达50%,同时保持或提高性能。

ResearchArXivcs.AI

为什么重要

ArXiv 角度:代理通常处理需要数百万个上下文标记的复杂问题,由于上下文窗口有限,需要跨会话进行压缩。我们开发了CliffCompaction,一种自动压缩技术,在有限上下文窗口下将成本降低高达50%,同时保… 先看原文核实,再决定是否影响你的工具栈、供应商或研究判断。

15 hours ago
17:54
A
ArXivSignal
@arxiv
值得关注吗 · 38
38

SWE-Serve:生产推理服务中代理工程基准测试

我们介绍了SWE-Serve,一个用于评估代理在生产推理工程任务上的基准。实现推理功能可能需要协调服务栈中的多个更改,包括模型支持、运行时执行和公共API。现有的基准测试提供有限

ResearchArXivcs.AI

为什么重要

ArXiv 角度:我们介绍了SWE-Serve,一个用于评估代理在生产推理工程任务上的基准。实现推理功能可能需要协调服务栈中的多个更改,包括模型支持、运行时执行和公共API。现有的基准测试提供有限 先看原文核实,再决定是否影响你的工具栈、供应商或研究判断。

15 hours ago
17:40
A
ArXivSignal
@arxiv
值得关注吗 · 38
38

扩大 Harness,而非 Context:从无策略支架到可重用专家代理

大型语言模型(LLM)代理通常处理一系列相关任务,但标准 Harness 重复要求模型在每个任务的上下文中重建相同的控制决策。我们研究任务反馈是否可以替代重复控制,将其转化为可重用的可执行代码,同时保留

ResearchArXivcs.AI

为什么重要

ArXiv 角度:大型语言模型(LLM)代理通常处理一系列相关任务,但标准 Harness… 先看原文核实,再决定是否影响你的工具栈、供应商或研究判断。

15 hours ago
17:32
A
ArXivSignal
@arxiv
值得关注吗 · 38
38

基于 LLM 的代码漏洞修复中的度量失败:一项实证研究和变更感知筛选

大型语言模型(LLM)越来越多地应用于 C/C++ 安全漏洞的自动修复,编译率是常用的进度代理:生成的补丁是否可编译。我们认为编译率是单功能漏洞的科学不可靠指标

ResearchArXivcs.AI

为什么重要

ArXiv 角度:大型语言模型(LLM)越来越多地应用于 C/C++ 安全漏洞的自动修复,编译率是常用的进度代理:生成的补丁是否可编译。我们认为编译率是单功能漏洞的科学不可靠指标 先看原文核实,再决定是否影响你的工具栈、供应商或研究判断。

15 hours ago
17:14
S
Simon WillisonLLM Release
@simonw
值得关注吗 · 38
38

llm-anthropic 0.29

发布:llm-anthropic 0.29 增加对 Claude Opus 5.5 的支持:llm -m claude-opus-5.5 "提示语在此处" 标签:llm,anthropic

Blogllmanthropic

为什么重要

llm 角度:发布:llm-anthropic 0.29 增加对 Claude Opus 5.5 的支持:llm -m claude-opus-5.5 "提示语在此处" 标签:llm,anthropic 先看原文核实,再决定是否影响你的工具栈、供应商或研究判断。

15 hours ago
17:13
A
ArXivSignal
@arxiv
值得关注吗 · 38
38

AI 能否节省产品设计时间?AI 提示到设计工作流程的随机对照实验

数字产品设计中的 AI 工具现在提供从提示到设计的功能,允许设计师及其非设计师同事通过与大语言模型(LLMs)的对话工作流程创建原型。虽然这些工具承诺节省时间,但在产品设计方面的实验证据尚不明确。

ResearchArXivcs.AI

为什么重要

ArXiv 角度:数字产品设计中的 AI… 先看原文核实,再决定是否影响你的工具栈、供应商或研究判断。

15 hours ago