AI 快讯列表关于 工具调用
| 时间 | 详情 |
|---|---|
|
2026-08-16 13:32 |
Claude Code借助Graft提速省本
据@godofprompt称,Graft令162次测试中耗时降60%、令牌降42%,精度不减。 |
|
2026-08-10 19:03 |
Claude Sonnet5定价永久生效
据@claudeai称,Sonnet5维持$2输入与$10输出价,利好自主代理应用成本。 |
|
2026-08-03 22:25 |
OpenAI GPT Live驱动实时语音突破
据OpenAI称,GPT Live可边听边说并不中断推理与工具调用。 |
|
2026-07-23 19:34 |
Claude语音升级拓展工具与多语
据@claudeai称,语音模式用更强模型,支持多语并可中途调用外接工具。 |
|
2026-07-15 21:12 |
GPT Live强化多任务与实时规划
据@OpenAI称,GPT Live可边对话边查航班、天气并生成行程。 |
|
2026-07-09 17:10 |
GPT5发布带来多模态速度突破
据@sama与OpenAI称,GPT5与GPT6提升多模态速度、工具使用与可靠性。 |
|
2026-07-06 21:40 |
Claude Code起源揭示安全驱动构建
据@bcherny称,Anthropic发布视频回顾Claude Code源自安全研究与早期用户反馈。 |
|
2026-07-06 17:45 |
HuggingFace本地应用助力OpenClaw代理
据@openclaw称,OpenClaw在HuggingFace本地应用上本地运行,无需云与密钥。 |
|
2026-06-23 16:00 |
语音AI挑战引爆7天实战冲刺
据DeepLearningAI称,赛事含实时反馈、榜单与奖品,聚焦智能人机接管。 |
|
2026-06-09 17:42 |
Claude Fable 5大幅提升编程效率
据@bcherny称,Fable 5在Claude Code显著减促发,提高工具与代码质量。 |
|
2026-05-19 19:58 |
Gemini 3.5 Flash多代理构建城市
据GoogleDeepMind称,Gemini 3.5 Flash以多代理协同完成城市设计与建造演示。 |
|
2026-05-10 12:15 |
Gemini API更新解锁步骤时间线与中途控制
据@godofprompt称,谷歌加入步骤时间线并准备中途引导与异步工具,旧接口6月6日失效。 |
|
2026-05-02 20:42 |
Claude Code团队代理新增三大能力
据@_avichawla称,团队代理具备任务依赖、同伴互信通信与持久上下文,助力多代理协作落地。 |
|
2026-04-30 04:01 |
Gemini 聊天机器人暴露易用性缺口
据@emollick称,Gemini常误判文件与工具并轻易放弃,影响业务价值。 |
|
2026-04-25 22:43 |
OpenAI联创Greg Brockman暗示“Tenet”梗:解析2026年GPT路线与代理式工作流机遇
据OpenAI联合创始人Greg Brockman在X(Twitter)上发文称“oh, that’s what tenet was about”,并于2026年4月25日附上链接,引发业界将其解读为对时间对称或双向计算思路的提示。根据Brockman账号的动态,此举与OpenAI近月强调的编排与代理式循环相呼应,或指向可逆推理、工具调用调度及通过预判式解码降低时延的技术路径。依据The Verge年内对OpenAI开发者简报的报道,OpenAI正在强化多步工具使用与代理式工作流,为企业在流程自动化、推理成本优化与并行化方面带来落地空间。彭博社对投资人动向的报道亦指出,代理框架与推理效率将影响2026年AI利润率,这为AIOps工具、可观测性与评测套件的采购带来短期机会。 |
|
2026-04-25 20:05 |
MIT 递归式LLM对比常规LLM:2024最新分析揭示自调用模型的推理与效率突破
据 @_avichawla 在推特所述,MIT 研究介绍了可“自调用”的递归式LLM,通过分解任务、验证中间步骤并迭代收敛,与常规一次性解码不同;据 MIT CSAIL 与其解读材料报道,该架构以控制器协调子调用用于规划、工具调用与自我批改,使多步推理与代码生成基准的准确率更高。根据 MIT 的研究,递归控制器能将复杂问题拆解为子问题(解析、规划、求解、验证),并缓存与复用中间结果,较单体长提示在复杂查询上减少无效token并改善时延。依据 MIT 的解读,商业落地场景包括更可靠的数据分析代理、结构化子查询的RAG,以及通过选择性递归与提前停止策略降低推理成本。MIT CSAIL 指出,在每层递归接入步骤验证器与外部工具(检索、求解器)可降低幻觉,相比单次生成更易审计,利好金融、医疗文档与软件质检等企业工作流。 |
|
2026-04-24 19:10 |
GPT-5.5 登陆 OpenRouter:长时任务 SOTA 表现与业务机会深度分析
根据 Greg Brockman 在 X 的信息,OpenAI 的 GPT-5.5 与 GPT-5.5 Pro 已在 OpenRouter 上线,其中 GPT-5.5 在代码、数据与工具等长时运行任务上达到 SOTA 表现,GPT-5.5 Pro 面向更复杂的推理与分析。依据 OpenRouter 在 X 的公告,开发者已可通过 OpenRouter API 直接接入这些模型,用于多步流程与工具增强任务。根据 OpenRouter 公告,这将为构建智能体、数据处理流水线与软件研发流程的企业带来机会,有望降低长任务中断率并提升吞吐量与稳定性。 |
|
2026-04-23 18:25 |
GPT 5.5 发布:面向真实工作与自治智能体的新级别智能—深度解读与5大商业影响
据 The Rundown AI 在 X 平台披露,GPT 5.5 被定位为“面向真实工作与驱动智能体的新级别智能”。据 The Rundown AI 报道,这一表述指向企业级应用与代理式工作流,强调在规划、工具调用与多步任务自治方面的能力升级。根据 The Rundown AI,企业可在文档密集型后台流程、全渠道客服与销售运营等场景开展试点,以获取短期效率红利;同时需建立自治智能体治理,包括审计、合规与成本管控。上述信息均来源于 The Rundown AI 对产品定位的公开发布。 |
|
2026-04-23 18:16 |
OpenAI 发布 GPT‑5.5:性能升级、成本优化与企业落地深度分析
据 The Rundown AI 报道,OpenAI 在其 Index 页面发布《Introducing GPT‑5.5》,宣布新模型面向生产级与多模态任务升级,据 OpenAI index 页面信息。根据 OpenAI 公告页面,GPT‑5.5 强化推理速度、指令遵循和工具调用稳定性,有望降低企业部署时的时延与成本。依据 OpenAI 文档说明,模型扩展了视觉、文本与代码的多模态支持,带来客服自动化、分析助理与内容运营等应用机会。依照 OpenAI 开发者说明,安全与事实性改进减少幻觉并优化引用,有助于满足合规行业需求。根据 OpenAI 产品概览,早期基准显示 GPT‑5.5 在代码与推理任务上较上一代模型精度提升,可帮助从 GPT‑4 级系统迁移至 GPT‑5.5,在呼叫中心、营销流程与基于检索增强的知识助手中提升投资回报。 |
|
2026-04-23 18:06 |
OpenAI 发布 GPT-5.5:面向真实工作与智能代理的最新突破,工具调用与自检现已登陆 ChatGPT 与 Codex
据 OpenAI 在 Twitter 发布的信息,GPT-5.5 能理解复杂目标、使用工具、自我检查并推进更多任务直至完成,现已在 ChatGPT 与 Codex 上线。据 OpenAI 公告称,这一升级凸显面向“代理化工作流”的能力,可将高层业务目标分解为多步执行,提升自主性与可靠性。根据 OpenAI 的说明,强化工具使用与结果自检意味着与企业 API、知识库与自动化平台更好集成,有望减少人工质检与跨部门交接。据 OpenAI 表示,即时在 ChatGPT 与 Codex 可用,为研发、运营、数据分析与代码变更的工作流代理落地创造短期机会,并形成更紧密的反馈闭环。依据 OpenAI 公布的信息,面向真实工作的定位将为客户支持自动化、企业内协作助手与数据流程带来可量化的效率提升,尤其适用于多步规划、工具调用与结果校验等场景。 |