
Jev AI 模型为决策而生,而非写作
TypeSafe AI 的 Jev 正受到关注,因为它把软件智能视为一个概率问题:选择正确分支,附上置信度,并避免在代码只需要决策时还花钱让 LLM 写文本。
最新

TypeSafe AI 的 Jev 正受到关注,因为它把软件智能视为一个概率问题:选择正确分支,附上置信度,并避免在代码只需要决策时还花钱让 LLM 写文本。
全部文章

OpenAI 的法律领域发布,重点不在于新的基础模型,而在于围绕模型构建的系统:领域检索、可信工具、权限、基准测试和审查路径。

Long-running agents do not fail only because the window is small. They fail when files, tool outputs and stale history crowd out the task the agent was supposed to finish.

Dario Amodei 希望通过外部评估者、共享安全标准和国际协议,为前沿 AI 设定节奏。难点在于,当 Anthropic 据称正准备创纪录规模的 IPO 时,如何界定“太快”到底意味着什么。

围绕递归式自我改进更尖锐的担忧,并不是聊天机器人输出怪话,而是能够协作、优化指标,并帮助构建下一代模型的智能体——WIRED、MIT Technology Review、CNBC 和 The Guardian 的报道都反映了这一点。

OpenAI 称,AI agent 找到了一个 Navier–Stokes 奇点,并用 Lean 形式化了证明。更难的故事在后面:审查、署名,以及私有 agent 集群在数学中的力量。