跳到正文

#搜索

今日 2 条
今天10月1日周四
  1. The Verge:AI(RSS)24

    马斯克的 Grokipedia 推出 v0.3 更新,换上新设计

    SpaceXAI 的 AI 百科 Grokipedia 发布 v0.3 更新,启用新 logo 并改版首页与实时编辑页。新首页新增精选条目、最多阅读条目和“最新编辑”追踪器,实时编辑页可一次看到更多近期改动。该站 2025 年 10 月底以 v0.1 上线,v0.2 于一个月后推出,此前曾被指超过三个月无条目变动。

  2. Ars Technica:AI(RSS)57

    Google 付费网站为 AI Overview 供料的试点成效不彰

    据 The Information 报道,Google 已接受约 100 家出版商加入 AI 内容贡献试点,当网站内容实质性贡献于 Gemini 驱动的 AI Overview 等搜索结果时可获付款。多位中小出版商称付款微薄,约相当于其广告收入的千分之一,数家大型出版商据报拒绝加入,希望迫使 Google 提供更优条件。

9月30日周三
  1. xAI:News(网页)54

    Grok 推出 Microsoft PowerPoint 加载项

    xAI 发布 Grok for PowerPoint,一款免费的 Microsoft 365 加载项,可从 Microsoft Marketplace 添加。用户可让 Grok 根据大纲生成完整幻灯片,包含 web 或 X 搜索的研究内容、图表和图片,也可单页添加、应用样式主题、重组章节,Grok 会主动提出澄清问题。

  2. The Verge:AI(RSS)66

    Google 试点向约 100 家出版商付费换取 AI 搜索内容授权

    据 The Information 报道,Google 启动试点计划,按内容对 AI Overviews、AI Mode 和 Gemini 的贡献程度向出版商付费,约 100 家出版商参与。一位早期加入的出版商一年获得超过 100 万美元,另一位加入数月的获得约 5 万至 6 万美元。该计划推出之际,Google 正面临出版商诉讼及英国和欧盟监管机构对其 AI 搜索影响流量的审查。

  3. Aidan Gomez50

    Cohere 发布新一代嵌入模型家族 Embed 5,提供 Embed 5 Pro(前沿能力)和 Embed 5 Fast(低延迟)两个版本。Cohere CEO Aidan Gomez 转发称该系列可扩展性极强、精度达到 SOTA,并且一如既往支持完全私有化部署,可通过 Model Vault 使用。

    引用Cohere@cohere

    Introducing Cohere Embed 5: our new state-of-the-art family of embeddings models. Get frontier capabilities with Embed 5 Pro or low-latency performance with Embed 5 Fast.

  4. arXiv:cs.AI(全量分类)39

    用 LLM 引导剪枝改进最近邻图索引

    研究者提出 LLM-Guided Graph Pruning(LGP)框架,用 LLM 推理直接优化已有 ANN 图索引,把结构上"低价值"的邻居替换为 LLM 选出的语义替代项,同时保留原图的稀疏性与可导航性。在 DiskANN 和 HNSW 等图索引上,LGP 在语义检索基准中端到端表现稳定优于贪心图搜索和 LLM 重排序。

  5. arXiv:cs.CL(计算语言学,全量分类)50

    arXiv 论文:稠密检索器对查询中的政治倾向与方言身份信号敏感

    哥伦比亚大学等机构研究者发布 EMNLP 2026 论文,测试查询中的政治意识形态与方言信号是否会偏置检索结果。在政治新闻和消费者健康问答两个领域、五款稠密检索器加一个稀疏基线上,所有检索器都会返回与查询自身政治倾向一致的文章,且对非洲裔美国英语(AAL)问题的检索效果差于白人主流英语(WME);线性探针能从查询嵌入中恢复倾向与方言信息。作者指出此类偏差可能加剧极化和健康差距,代码已开源。

  6. Cloudflare Blog77

    Cloudflare:互联网出现第二个受众,智能体流量增长超 1700% 并推动内容付费新机制

    Cloudflare 发文指出互联网出现了由软件代理人类访问的第二个受众:其网络 HTTP 请求从 2024 年底的每秒 6300 万增至近 1.15 亿,一年内 AI 智能体日请求增长超 1700%,今年首次过半流量非人类。

    推荐理由:Cloudflare 用自家网络数据说明智能体流量如何改变流量与收入的关系,并给出可控授权和按使用付费的应对思路。

9月27日周日
9月25日周五
9月19日周六
9月16日周三
  1. Google Research29

    Google Research 提出 Retrieve-for-Train:用 RL 编译扩散模型绕过推理瓶颈,加速复杂 AI 搜索

    Google Research 提出 Retrieve-for-Train 框架,通过离线强化学习发现奖励对齐的查询扇出并编译为监督信号,再蒸馏进一个 53.9M 参数的扩散检索器,实现推理时单次非自回归的查询扇出。该方法在 Gemma3-4B 和 Qwen3-4B 上微调扇出语言模型,用集合级属性奖励评估整组结果,无需人工标注,也无需推理时的 CoT 思考 token。

8月29日周六
8月26日周三
  1. Hugging Face:Blog(RSS)76

    Sentence Transformers v6.0 教程:用 MultiVectorEncoder 训练和微调多向量嵌入模型

    Sentence Transformers v6.0 引入 MultiVectorEncoder 模型类型,这篇教程完整演示如何训练和微调 ColBERT 式多向量模型,涵盖模型、数据集、损失函数、训练参数和评估器。

    推荐理由:原文给出完整可复现的多向量模型微调配方和实测对比,读者可以按组件迁移到自己的领域数据上。

8月21日周五
  1. Hugging Face:Blog(RSS)62

    Hugging Face 解析 Papers with Code 混合搜索背后的架构实践

    Hugging Face 详解 Papers with Code 论文搜索引擎的架构:用 PostgreSQL 全文检索加 pgvector 语义召回,经加权 RRF 融合为混合搜索,已为超过 11 万篇 arXiv 论文维护嵌入向量。

    推荐理由:作者亲述 Papers with Code 混合搜索的架构与生产经验,读者可以借鉴其离线批量与在线查询分离的设计方法。

8月20日周四
8月18日周二
5月28日周四
  1. Mistral AI:News(网页)61

    Mistral AI 发布 Search Toolkit 公开预览版

    Mistral AI 发布开源 Search Toolkit 公开预览版,这是一个用于构建 AI 应用生产级搜索管线的可组合框架。

    推荐理由:原文给出框架的具体模块构成、内置检索与评测指标,以及可复用的 starter 模板命令,读者可据此评估是否替代自建检索管线。

5月18日周一
4月4日周六
  1. Sierra:Blog(RSS)42

    Sierra 推出 Linnaeus 与 Darwin 搜索模型,解决率最高提升 16 个百分点

    Sierra 发布两款自研搜索模型 Linnaeus(检索)与 Darwin(重排序),称其解决率最高提升 16 个百分点。Linnaeus 直接基于完整对话检索,recall@5 提升 20%、recall@30 约 95%,每次搜索延迟最多降低约 800ms;Darwin 负责重排序,兼顾精度与成本。Sierra 智能体每天执行超 200 万次搜索,P90 延迟与搜索成本均下降超 75%。

8月14日周四
7月17日周四
12月19日周四
  1. Answer.AI 官方研发博客(RSS)76

    Answer.AI 与 LightOn 发布 ModernBERT 编码器模型家族

    Answer.AI 与 LightOn 发布 ModernBERT,一个替换 BERT 的 encoder-only 模型家族,含 base(149M 参数)和 large(395M 参数)两个尺寸,上下文长度达 8192 tokens。

    推荐理由:发布方给出了速度、上下文长度和训练数据的具体改进点,读者可以据此评估它能否替换现有 BERT 类工作流。