马斯克的 Grokipedia 推出 v0.3 更新,换上新设计
SpaceXAI 的 AI 百科 Grokipedia 发布 v0.3 更新,启用新 logo 并改版首页与实时编辑页。新首页新增精选条目、最多阅读条目和“最新编辑”追踪器,实时编辑页可一次看到更多近期改动。该站 2025 年 10 月底以 v0.1 上线,v0.2 于一个月后推出,此前曾被指超过三个月无条目变动。
SpaceXAI 的 AI 百科 Grokipedia 发布 v0.3 更新,启用新 logo 并改版首页与实时编辑页。新首页新增精选条目、最多阅读条目和“最新编辑”追踪器,实时编辑页可一次看到更多近期改动。该站 2025 年 10 月底以 v0.1 上线,v0.2 于一个月后推出,此前曾被指超过三个月无条目变动。
据 The Information 报道,Google 已接受约 100 家出版商加入 AI 内容贡献试点,当网站内容实质性贡献于 Gemini 驱动的 AI Overview 等搜索结果时可获付款。多位中小出版商称付款微薄,约相当于其广告收入的千分之一,数家大型出版商据报拒绝加入,希望迫使 Google 提供更优条件。
xAI 发布 Grok for PowerPoint,一款免费的 Microsoft 365 加载项,可从 Microsoft Marketplace 添加。用户可让 Grok 根据大纲生成完整幻灯片,包含 web 或 X 搜索的研究内容、图表和图片,也可单页添加、应用样式主题、重组章节,Grok 会主动提出澄清问题。
据 The Information 报道,Google 启动试点计划,按内容对 AI Overviews、AI Mode 和 Gemini 的贡献程度向出版商付费,约 100 家出版商参与。一位早期加入的出版商一年获得超过 100 万美元,另一位加入数月的获得约 5 万至 6 万美元。该计划推出之际,Google 正面临出版商诉讼及英国和欧盟监管机构对其 AI 搜索影响流量的审查。
Fireworks 成为 Voyage AI by MongoDB 首个且唯一合作的专用推理平台,Voyage 4 系列、voyage-multimodal-3.5 与 rerank-2.5 现已原生运行于 Fireworks,检索到生成全流程可在同一 API 上完成。
Baseten 宣布自 10 月 1 日 15:00 UTC 起新建 API key 将加 b10_ 前缀,便于在代码、日志和密钥扫描器中识别。Hosted Tools 通过 Baseten Grounded Inference 为 Model APIs 引入服务端联网搜索,可经 Exa、Keenable、Parallel 或 You.com 检索并抓取实时网页内容。
Introducing Cohere Embed 5: our new state-of-the-art family of embeddings models. Get frontier capabilities with Embed 5 Pro or low-latency performance with Embed 5 Fast.
工业搜索与推荐系统正引入 LLM 与多模态架构来缓解冷启动和长尾问题。YouTube 用 RQ-VAE 将 VideoBERT 内容嵌入压缩为 Semantic IDs。
Cloudflare 发布 Threat Signals,面向所有账户免费开放,用智能体技能把用户选择的开源安全报告自动摘要、打标签、提取和规范化 IOC,并以 Threat Event 形式存入账户私有威胁情报数据集,可直接用于 WAF 策略。
研究者提出 LLM-Guided Graph Pruning(LGP)框架,用 LLM 推理直接优化已有 ANN 图索引,把结构上"低价值"的邻居替换为 LLM 选出的语义替代项,同时保留原图的稀疏性与可导航性。在 DiskANN 和 HNSW 等图索引上,LGP 在语义检索基准中端到端表现稳定优于贪心图搜索和 LLM 重排序。
哥伦比亚大学等机构研究者发布 EMNLP 2026 论文,测试查询中的政治意识形态与方言信号是否会偏置检索结果。在政治新闻和消费者健康问答两个领域、五款稠密检索器加一个稀疏基线上,所有检索器都会返回与查询自身政治倾向一致的文章,且对非洲裔美国英语(AAL)问题的检索效果差于白人主流英语(WME);线性探针能从查询嵌入中恢复倾向与方言信息。作者指出此类偏差可能加剧极化和健康差距,代码已开源。
针对合成问题难度与局部检索能力不匹配的问题,研究者提出 latent anchor reasoning,并基于此构建 PrimeSeeker 框架,通过网页锚点结构与参考证据骨架联合生成问题和证据,共构造 9,221 条专家轨迹训练了一个 30B 搜索智能体。
Cloudflare 发布 Pay Per Use beta,AI 公司为内容的具体使用出价,出版方在 dashboard 中决定是否接受,Cloudflare 负责记录使用、向买方计费并按月付款给出版方。
Cloudflare 发文指出互联网出现了由软件代理人类访问的第二个受众:其网络 HTTP 请求从 2024 年底的每秒 6300 万增至近 1.15 亿,一年内 AI 智能体日请求增长超 1700%,今年首次过半流量非人类。
推荐理由:Cloudflare 用自家网络数据说明智能体流量如何改变流量与收入的关系,并给出可控授权和按使用付费的应对思路。
Airbnb 在秋季产品更新中上线 AI 搜索,用户可通过开关启用文本或语音提示搜索房源,系统会根据偏好显示动态筛选条件,例如输入 baby 会推荐婴儿床、游乐场等筛选,并用 AI 摘要对比心愿单房源。
Google Cloud 宣布 AlloyDB 和 Cloud SQL for PostgreSQL 17+ 预览原生 BM25 索引,基于 Tiger Data 的开源 pg_textsearch 扩展,无需再维护独立的全文搜索后端。
Google Research 提出 Retrieve-for-Train 框架,通过离线强化学习发现奖励对齐的查询扇出并编译为监督信号,再蒸馏进一个 53.9M 参数的扩散检索器,实现推理时单次非自回归的查询扇出。该方法在 Gemma3-4B 和 Qwen3-4B 上微调扇出语言模型,用集合级属性奖励评估整组结果,无需人工标注,也无需推理时的 CoT 思考 token。
Nous Research 推出 Hermes Agent 的 BackSearch 插件,可在冻结的新闻存档上做时间点(point-in-time)网页搜索与抓取。该插件归属 General Reasoning 方向,仓库名为 NousResearch/hermes-plugin-backsearch。
Sentence Transformers v6.0 引入 MultiVectorEncoder 模型类型,这篇教程完整演示如何训练和微调 ColBERT 式多向量模型,涵盖模型、数据集、损失函数、训练参数和评估器。
推荐理由:原文给出完整可复现的多向量模型微调配方和实测对比,读者可以按组件迁移到自己的领域数据上。
Hugging Face 详解 Papers with Code 论文搜索引擎的架构:用 PostgreSQL 全文检索加 pgvector 语义召回,经加权 RRF 融合为混合搜索,已为超过 11 万篇 arXiv 论文维护嵌入向量。
推荐理由:作者亲述 Papers with Code 混合搜索的架构与生产经验,读者可以借鉴其离线批量与在线查询分离的设计方法。
Hugging Face 在 GitHub 发布 huggingface/s2-cli 仓库,提供一个查询 Semantic Scholar 的命令行界面(CLI)和 Skill,面向智能体和人类使用。
Hugging Face 发布教程,介绍 Sentence Transformers v6.0 新增的第四种模型类型 MultiVectorEncoder,用于 ColBERT 式晚交互检索。
推荐理由:官方教程系统讲解多向量晚交互模型的使用、检索质量与索引体积权衡,并给出可直接运行的检索和重排方案。
Mistral AI 发布开源 Search Toolkit 公开预览版,这是一个用于构建 AI 应用生产级搜索管线的可组合框架。
推荐理由:原文给出框架的具体模块构成、内置检索与评测指标,以及可复用的 starter 模板命令,读者可据此评估是否替代自建检索管线。
FireRedTeam 开源了论文《ReMatch: Boosting Representation through Matching for Multimodal Retrieval》的官方实现,该工作已被 CVPR 2026 收录。ReMatch 通过匹配机制增强多模态检索的表征能力。
Sierra 发布两款自研搜索模型 Linnaeus(检索)与 Darwin(重排序),称其解决率最高提升 16 个百分点。Linnaeus 直接基于完整对话检索,recall@5 提升 20%、recall@30 约 95%,每次搜索延迟最多降低约 800ms;Darwin 负责重排序,兼顾精度与成本。Sierra 智能体每天执行超 200 万次搜索,P90 延迟与搜索成本均下降超 75%。
OpenAI 发布 Web search 指南,介绍模型如何通过网页搜索获取最新信息并返回带来源引用的答案。
Mistral AI 为 Le Chat 推出一批新功能:Deep Research 预览模式可生成带引用的结构化研究报告;语音模式由新语音输入模型 Voxtral 驱动。
Answer.AI 与 LightOn 发布 ModernBERT,一个替换 BERT 的 encoder-only 模型家族,含 base(149M 参数)和 large(395M 参数)两个尺寸,上下文长度达 8192 tokens。
推荐理由:发布方给出了速度、上下文长度和训练数据的具体改进点,读者可以据此评估它能否替换现有 BERT 类工作流。