观点里的产品与物品

提及清单

从内容中找到产品、网站和物品。看看谁支持、质疑或只是提及,并回到原始证据。

显示 33 / 33 项

工具与产品

ABBEL

1 个来源 · 1 次提及

支持 1

作者支持 ABBEL,报告其通用重建式信念分级器可将与全上下文模型的性能差距缩小约 50%,并显著降低内存使用量。

Jakob Bjorner, Aly Lidayan, Satvik Golechha, Kartik Goyal, Alane Suhr ·

查看观点与证据

网站

AlphaFold Database

1 个来源 · 1 次提及

仅提及 1

安东尼·科斯塔指出,英伟达及合作伙伴正通过 AlphaFold 数据库公开发布预测的病毒蛋白质结构,仅将其作为分发渠道进行事实性描述。

Anthony Costa ·

查看观点与证据

工具与产品

Amazon S3

1 个来源 · 1 次提及

仅提及 1

Simon Willison指出,虽然亚马逊S3的价格过去经常下降,但近十年来价格并未降低。

Simon Willison ·

查看观点与证据

工具与产品

Azure Search

1 个来源 · 1 次提及

仅提及 1

Cohere 团队将 Azure Search 用作 High Finance 基准测试中 Compass 的基准对照,仅报告其得分(64.8),未对其本身作出超出相对性能的评价。

Cohere Team ·

查看观点与证据

工具与产品

Baby AGI

1 个来源 · 1 次提及

反对 1

Demetrios Brinkmann回忆称,Baby AGI曾陷入递归循环并产生高额API费用,这使他对当时的智能体持怀疑态度。

Demetrios Brinkmann ·

查看观点与证据

工具与产品

BioNeMo Structure Prediction Pipeline

1 个来源 · 1 次提及

仅提及 1

安东尼·科斯塔指出,英伟达正在开源 GPU 加速的 BioNeMo 结构预测流水线,供研究人员预测蛋白质三维结构,未作评价性判断。

Anthony Costa ·

查看观点与证据

工具与产品

Claude

1 个来源 · 1 次提及

仅提及 1

Chris Olah指出,强制激活与欺骗相关的特定特征会导致Claude表现出撒谎行为,这说明了可解释性研究的发现。

Chris Olah ·

查看观点与证据

工具与产品

Claude Sonnet 5.5

1 个来源 · 4 次提及

支持 4

Base44 的 Gabriel Grinberg 表示,Claude Sonnet 5.5 在 118 次真实应用构建中与 Opus 5 达到同等评分,平均仅需 3.6 次迭代(Opus 5 为 7.7 次),且工具调用失败更少、中途停顿提问也更少。

Gabriel Grinberg ·

查看观点与证据

网站

Cloudflare

1 个来源 · 1 次提及

仅提及 1

Simon Willison 表示,多年来他一直希望 Cloudflare 支持 HTTP Vary 标头。

Simon Willison ·

查看观点与证据

工具与产品

Codex

1 个来源 · 1 次提及

仅提及 1

莫利克描述称,在OpenAI的群体实验中,Codex被用于在各代理组之间传递最佳想法。

Ethan Mollick ·

查看观点与证据

工具与产品

Compass

1 个来源 · 1 次提及

支持 1

Cohere 团队报告称,Compass 在 High Finance 基准测试中相较 Azure Search 准确率提升了 14–16 分,并指出这一差距对终端用户答案质量具有决定性影响。

Cohere Team ·

查看观点与证据

工具与产品

Firecracker

1 个来源 · 1 次提及

仅提及 1

奥利维亚·约翰斯顿提到 Firecracker 是一种为过时的信任单元解决隔离问题的技术,未表达支持或反对。

Olivia Johnston ·

查看观点与证据

工具与产品

Gemini

1 个来源 · 1 次提及

仅提及 1

Gemini在此摘录中仅作为Google DeepMind与Isomorphic Labs四步安全流程中的一个示例模型被提及,未对该模型本身作出明确的评价性判断。

Google DeepMind, Isomorphic Labs ·

查看观点与证据

工具与产品

gemini-3.8-flash-lite-tts

1 个来源 · 1 次提及

仅提及 1

谷歌发布了 gemini-3.8-flash-lite-tts 模型,作为其两款新的 Gemini 文本转语音模型之一。

Simon Willison ·

查看观点与证据

工具与产品

gemini-3.8-flash-tts

1 个来源 · 1 次提及

仅提及 1

谷歌发布了 gemini-3.8-flash-tts 模型,作为其两款新的 Gemini 文本转语音模型之一。

Simon Willison ·

查看观点与证据

工具与产品

Ghostwriter

1 个来源 · 2 次提及

支持 2

作者将Ghostwriter描述为已从需用户主动调用的工具,转变为嵌入Slack和Teams中的主动式、异步且富有创意的团队成员。

Bret Taylor, Clay Bavor ·

查看观点与证据

工具与产品

GitHub Copilot

1 个来源 · 2 次提及

仅提及 2

文本提供了关于如何为GitHub Copilot编写提示词的指导说明,将其描述为一个接受自然语言描述的工具。

Kayla Cinnamon ·

查看观点与证据

工具与产品

GPT-6 Astra Ultrafast

1 个来源 · 1 次提及

仅提及 1

该摘录指出,运行在NVIDIA Blackwell GPU上的GPT-6 Astra Ultrafast现已在OpenAI API中提供,并面向符合条件的ChatGPT Work和Codex用户开放。

Dion Harris ·

查看观点与证据

工具与产品

gVisor

1 个来源 · 1 次提及

仅提及 1

奥利维亚·约翰斯顿提到 gVisor 是一种为过时的信任单元解决隔离问题的技术,未表达支持或反对。

Olivia Johnston ·

查看观点与证据

工具与产品

Harvey

1 个来源 · 3 次提及

支持 3

Harvey 团队指出,Harvey Review Tables 特别适用于赔偿条款中数值型条款(如上限、门槛值、存续期)的并排比对,可跨协议提取离散数据点。

Harvey Team ·

查看观点与证据

工具与产品

Holo4

1 个来源 · 1 次提及

支持 1

作者支持 Holo4,将其定位为一个新型代理模型系列,通过 H Models API 提供两种规格(27B 密集型和 35B-A3B 混合专家型)。

Maxime Theillard, Frederic Renard, Vincent Coyette, Emrick Sinitambirivoutin, Avshalom Manevich, Antonio Loison, Antoine Bonnet, Maxime Langevin, Aleix Cambray (H-AI), Léonard Benedetti, Tony Wu, Mats L. Richter, Michael Eickenberg, Sławek Mucha, Matthias Brunel, Daniel Beechey ·

查看观点与证据

工具与产品

KernelBench

1 个来源 · 1 次提及

仅提及 1

Lilian Weng 将 KernelBench 呈现为一个包含 250 个 PyTorch 任务的基准,用于评估大语言模型生成正确且快速 GPU 内核的能力,其核心指标为 fast_p。

Lilian Weng ·

查看观点与证据

工具与产品

MLE-bench

1 个来源 · 1 次提及

仅提及 1

Lilian Weng 将 MLE-bench 描述为一个包含 75 个精选 Kaggle 竞赛的基准,用于评估机器学习工程智能体,Kaggle 公开排行榜作为人类基线。

Lilian Weng ·

查看观点与证据

工具与产品

MLX

1 个来源 · 1 次提及

仅提及 1

作者报告了其方法在 Apple Silicon 上 MLX 内核(Attention 和 Mamba SSM)的性能结果,将 MLX 视为目标运行环境,而非被批评或背书的工具。

Shiyi Cao, Gal Bloch, Assaf Toledo, Michael Factor, Gil Vernik, Joseph E. Gonzalez ·

查看观点与证据

网站

Open TTS Leaderboard

1 个来源 · 1 次提及

仅提及 1

作者澄清,Open TTS排行榜使用ASR词错误率(WER)和说话人相似度等客观指标作为可懂度和语音身份保持性的代理指标,而非直接测量,并不取代人类偏好排序。

Eric Bezzam, Steven Zheng, Eustache Le Bihan, mrfakename ·

查看观点与证据

工具与产品

OpenAI API

1 个来源 · 1 次提及

仅提及 1

OpenAI API被提及为因Baby AGI递归循环错误而产生80美元账单的来源。

Demetrios Brinkmann ·

查看观点与证据

工具与产品

Qwen3.5 4B

1 个来源 · 1 次提及

仅提及 1

埃尔·姆加里表示,Qwen3.5 4B被用作Together平台上他们新的Jev类分类器的基础模型。

Hassan El Mghari ·

查看观点与证据

工具与产品

RE-Bench

1 个来源 · 1 次提及

仅提及 1

Lilian Weng 将 RE-Bench 介绍为一个评估前沿 AI 智能体的基准,覆盖 7 个开放式的机器学习研究工程环境,并纳入人类专家表现数据用于对比。

Lilian Weng ·

查看观点与证据

工具与产品

SAP

1 个来源 · 1 次提及

仅提及 1

本尼迪克特·埃文斯将SAP列为美国大型公司使用的典型大型横向企业软件系统之一。

Benedict Evans ·

查看观点与证据

工具与产品

Seedance 2.0

1 个来源 · 1 次提及

仅提及 1

作者将Seedance 2.0描述为一种视频模型,可同时接收最多9张图像、3段视频片段、3个音频文件和一个文本提示,并为每种输入类型分配不同的创意角色。

shridharathi ·

查看观点与证据

工具与产品

Terminal-Bench-2

1 个来源 · 1 次提及

仅提及 1

Lilian Weng 指出,在 Terminal-Bench-2 上演化的编排系统未经进一步演化即成功迁移到 SWE-bench-verified,表明其编码的是通用工程经验而非特定基准的优化。

Lilian Weng ·

查看观点与证据

工具与产品

Workday

1 个来源 · 1 次提及

仅提及 1

本尼迪克特·埃文斯将Workday列为美国大型公司使用的典型大型横向企业软件系统之一。

Benedict Evans ·

查看观点与证据

立场属于具体说话者在这段内容中的表达。数量仅描述本站已审核的集合,不代表产品评分或市场共识。