AI 快讯列表

AI 快讯列表关于 检索增强

时间 详情
2026-08-27
14:45
斯坦福Storm自动化博士式研究

据@godofprompt称,Storm可生成多视角带引用报告,网页免费试用。

2026-08-26
00:13
OpenAI终止Agent Builder引企业转型

据@emollick称,OpenAI于2026年6月停用Agent Builder,企业正评估替代方案。

2026-08-25
21:02
LLM基础驱动Pillar1实战指南

据@DeepLearningAI,吴恩达发布Pillar1:涵盖LLM基础、数据检索增强、智能体、评测与生产运维。

2026-07-30
11:41
聊天机器人冲击理财顾问:5招应对

据@CNBC,客户用AI咨询理财,机构加速部署合规与审计AI。

2026-06-30
17:02
Claude Science测试版加速科研流程

据@claudeai称,支持代码溯源、按需环境与60余科研数据库连接。

2026-06-23
12:07
记忆AI削减Token成本融资9.8亿美元

据@CNBC称,该初创融资9.8亿美元以降低LLM推理成本。

2026-06-20
11:05
RAG架构指南:8种高效工作流

据_avichawla称,8种RAG架构与改进索引可降语料40倍、查询代币3倍。

2026-06-09
07:15
MCP服务器升级AI执行力:7款推荐

据@godofprompt称,7个MCP服务器让AI直连文件与工具,解锁自动化。

2026-06-06
12:15
Perplexity用6招强化分析级检索

据@godofprompt称,6个定向提示可解锁Perplexity全流程检索并附权威来源。

2026-06-04
21:50
NotebookLM上线来源溯源功能

据@NotebookLM称,现可查看提示与来源并一键迭代自定义。

2026-06-02
18:35
Grok4.3加速Notion AI工作流

据@grok称,Grok4.3与Build0.1登陆Notion AI,提升检索写作与数据库管理效率。

2026-05-28
16:55
非虚构出版遭AI事实核查危机

据emollick称,NYMag报道AI幻觉暴露出版缺乏核查与规范。

2026-05-23
10:18
代理运维最佳实践提升上线可靠性

据 @_avichawla 指出,路由、护栏、缓存与评测比核心逻辑更关键。

2026-05-22
19:12
向量嵌入驱动多模态检索指南

据DeepLearningAI称,嵌入支持跨文本音频图像视频的检索与语义搜索。

2026-05-11
16:44
Grok连接器上新20+源提升工作流

据grok称,新增20+连接器接入文档日历邮箱与代码,强化检索与自动化。

2026-04-26
08:07
稀疏注意力将128K上下文成本降至60%以下:扩展大模型上下文长度的实用技术指南

根据X平台用户@_avichawla 的帖子,采用稀疏注意力后,128K上下文下的预填充成本约从$0.65降至$0.35每百万token,解码成本约从$2.4降至$0.8,并且V3.2在部分长上下文基准上表现不降反升。该帖指出,关键在于在不牺牲质量的前提下实现稀疏注意力,这为更大上下文窗口与更低推理成本同时成立提供了路径。结合业界公开研究报道,扩展上下文的常见方法还包括:RoPE或YaRN等位置编码缩放以稳定超长序列、Performer与Hyena等线性注意力以降低二次复杂度、RAG检索增强将长背景外置存储、分块加跨块注意力的层级条件建模、滑动窗口与状态压缩保持语境连续、以及推理时的attention sink与KV缓存淘汰策略控制显存增长。对于企业,这些方案可显著降低长文档问答、合同审阅、代码理解与多模态转录的服务成本并提升产能,来源均基于上述帖文与公开研究综述。

2026-04-26
08:06
长上下文Transformer详解:7大技术削减64倍内存膨胀(2026深度分析)

据X平台用户@_avichawla 所述,传统Transformer上下文扩展8倍会因自注意力二次复杂度导致内存增加64倍;据Vaswani等人在2017年Transformer论文所述,这一O(n^2)特性是全局自注意力的固有限制。根据学术与产业报告,业界采用多种技术控制成本:1)滑动窗口与空洞注意力限制KV缓存规模(据Longformer,Beltagy等,2020);2)块级局部‑全局稀疏模式将复杂度从平方降至近线性(据BigBird,Zaheer等,2020);3)低秩投影压缩K/Q矩阵(据Linformer,Wang等,2020);4)循环状态摘要避免全局二次注意力(据RWKV与RetNet论文,arXiv);5)检索增强仅对召回片段做注意力(据Meta的RAG与OpenAI Cookbook);6)段级复用与记忆token高效延长上下文(据Transformer‑XL,Dai等,2019;Memorizing Transformers,Wu等,2022);7)分组/多查询注意力在推理端缩小KV缓存(据Google MQA与OpenAI推理文档)。据Anthropic的Claude长上下文评测与Google Gemini技术报告,以上方法可降低延迟与GPU显存占用,并在长文问答与代码任务上提升准确率。对企业而言,结合多查询注意力、滑动窗口与检索,可在通用GPU上实现20万至100万token上下文并保持质量(据Mistral推理笔记与FlashAttention、vLLM文档)。

2026-04-25
16:47
最新分析:用 GPT‑4.1 与 Claude 3 进行论文评审显著减少虚假引用并简化合规

据 Ethan Mollick 在 X 表示,关于 AI 辅助论文评审的讨论过度聚焦“幻觉”和“隐私”,而最新前沿模型已很少产生虚假来源,且知识产权合规更易实现。根据 Mollick 的帖文与 OpenAI、Anthropic 文档报道,结合检索增强、强制引用的系统提示词、企业级数据管控(关闭数据留存、不用于训练),可用于文献筛选、参考文献核验与评审综述,并通过人类审阅负责制与可追溯日志实现合规。对期刊、出版社与高校而言,近期可落地的机会包括:部署标准化评审助手以强制引用校验、自动敏感信息与利益冲突涂抹、保留审稿审计记录,同时将最终责任归于人类审稿人——这与 Mollick 的观点一致。

2026-04-24
17:53
NotebookLM 新功能发布:自动标注与分类来源,显著提升多文档研究效率|2026 最新分析

据 @NotebookLM 在 X 上发布的信息,Google 的 NotebookLM 正在推出当来源数量达到 5 个及以上时的自动标注与分类功能,帮助用户更快定位材料与提升研究流程效率(来源:@NotebookLM,2026 年 4 月 24 日)。据同一来源,用户还可对来源分组进行重命名、重组与个性化(含表情符号),以优化多文档语境管理与长文本综述。根据该官方渠道披露,此更新有望减少无效滚动时间,强化企业知识管理与学术综述等场景的生产力价值。

2026-04-24
17:13
多模态AI讲故事:超越LLM的2024趋势与商机深度解读

据God of Prompt在X平台表示,5月14日的专题讨论将延续SXSW24上“多模态AI用于叙事”的热点话题,参与者包括@itzik009,并与Carlos Calva及@skydeas1合作。根据Carlos Calva在X上的介绍,SXSW24讨论聚焦于文本、音频与视频生成的协同应用,强调内容本地化、交互式媒体与自动化预演等可落地商业场景。依据其分享的面板链接信息,热度集中在多模态模型如何协同叙事结构、素材生成与后期流程,反映出对语音合成、图生视频与检索增强管线等一体化工具链的需求。据God of Prompt在X报道,即将举行的5月14日讨论旨在给出更具体的用例与采购侧需求,提示影视与代理公司可尝试试点多模态流程,评估合规数据来源,并围绕首稿产出时长与本地化吞吐量等指标衡量ROI。