Google Search Console 的 AI 报告已覆盖全球:先建立测量基线
Google 现在在全球报告生成式 AI 展现。使用这份逐字段工作表衡量可见性,但不要把它误认为流量。
分类
24篇文章属于此分类.
Google 现在在全球报告生成式 AI 展现。使用这份逐字段工作表衡量可见性,但不要把它误认为流量。
OpenAI 提议于 11 月 12 日结束在 Cursor 中的模型访问。使用这份固定任务矩阵和 30/14/7 天演练来测试替代方案并保留回滚能力。
Pipette 发布了许多配置下的延迟、吞吐量、内存和质量结果,但不同手机、运行时和量化方式并不能组成一个干净的排名。
Kubernetes Inference Perf 让模型服务器比较更加一致,但其结果仍取决于提示词、负载模式、token 数量和集群。
一项涉及 1,053 名学生的试验发现,ChatGPT 提高了经过评分的建议质量,但其原创性指标是计算得出的,研究也没有衡量之后的学习。
OpenAI 和 AWS 报告称,GPT-5.6 Terra 在 Kiro 中完成 Terminal-Bench 任务的成本大约降低了 82%,但仓库工作还会增加审查和修复成本。
OpenAI 现在已在圣保罗开展商业运营。应将本地团队和开发者项目与采用量主张、产品访问以及数据驻留区分开来。
OpenAI 的管理插件将工作区操作带入聊天,同时角色、已启用能力、审批、权威状态和回滚仍然是彼此独立的边界。
Google 现在可以连接代理测试和生产监测。在比较分数之前,了解哪些版本、样本、评审者、轨迹、成本和控制措施必须保持可见。
Visual Studio 18.10 Insiders 可以将本地和托管模型连接到 Agent 模式,但一次实测表明,端点可用并不意味着编码工作可靠。
OpenAI 的 Jalapeño 推理芯片在其发布的测试中领先,但延迟、功耗标准化、可用性和工作负载匹配度限制了采购结论。
Apple 的通用 Swift 会话 API 可以访问端侧模型、Private Cloud Compute 或其他提供商,但这些路径在隐私、容量和可用性上各不相同。
六个 Copilot 模型将在 9 月 1 日退役,其中一个建议替代模型又将在九天后退役。产品名称比模型目录更稳定。
Google 的 HEIR 编译器可以将多个模型转换为加密计算,但密文膨胀、内存、延迟和模型变化仍然是决定性因素。
Sentence Transformers v6 增加了多向量检索,而其自身结果显示,平均质量仅有适度提升,同时存储成本却大幅增加。
MCP 的规范、扩展、SDK 和传输层正在以不同速度演进。路线图中的优先事项并不会让两个产品实现互操作。
llama.cpp 现在在 nightly 构建之外也提供语义化版本发布。它的第一个稳定标签与一个构建标签共享代码,说明渠道名称描述的是策略,而不是质量。
Waymo 披露其定制边缘 AI 计算能力超过 1,000 TOPS,但没有公布精度、功耗、利用率、内存带宽和实测延迟。
蓝天行动将测试 AI 指导的高度变化能否减少繁忙北大西洋空域中的增温凝结尾迹,而不只是减少选定航班的尾迹。
Stripe 已同意收购 OpenRouter。提供商选择、路由元数据、定价、隐私、回退行为和可移植性,说明了中立性意味着什么,也说明了它不能意味着什么。
AI 助手帮助 Linus Torvalds 迭代完成 24 个调试补丁并启动内核 18 次,但在证据找到错误之前,它反复劝他放弃调查。
Mojo 编译器现在可以从源代码构建和修改。AI News 复现了构建过程,但许可和贡献治理仍是分开的限制。
OpenAI 在俄亥俄州的数据中心协议提出 8 GW 的目标,但首个明确阶段是 800 MW,且仍取决于电力、许可和建设。
实践性地了解评估选择如何影响模型声明、产品决策,以及读者应当检查 AI 公告中的哪些内容。