AI快讯 - 实时AI新闻和趋势 | Blockchain.News

AI快讯

维基媒体25周年:与亚马逊、Meta、微软、Mistral AI、Perplexity合作开放高速维基百科API,助力模型训练|2026深度分析

据DeepLearning.AI在X平台报道,维基媒体基金会与亚马逊、Meta、微软、Mistral AI及Perplexity达成合作,向这些AI企业提供高速访问维基百科及相关数据集的API,以提升模型训练效率与数据时效性。根据DeepLearning.AI,此举适逢维基媒体成立25周年,计划为开发者提供更可靠、可追溯的知识语料,并强化使用透明度。依照DeepLearning.AI的消息,该计划有望降低数据管线摩擦、加速RAG工作流、改进内容归因与治理信号,带来企业级知识检索、评测数据集与更安全微调的商业机会。 (来源)

2026-02-13 04:00
Gemini 3 Deep Think最新更新上线:Google AI Ultra用户即刻可用|功能解析与商业影响

据Google Gemini官方X账号称,Gemini 3 Deep Think已向Google AI Ultra用户开放,可通过网页链接或在Gemini应用的工具菜单中选择Deep Think启用(来源:@GeminiApp,2026年2月13日)。据该账号介绍,该功能定位为强化推理模式,面向多步问题求解,可用于代码辅助、数据分析与研究流程,体现谷歌在长链推理与规划能力上的发力。根据同一来源,先向付费Ultra用户开放,显示其通过高阶推理功能拉动订阅转化与留存的策略;并且在应用内作为可复用工具集成,便于企业将其嵌入标准化工作流,如分析报告、产品路线图与技术文档编制。 (来源)

更多来自 Google Gemini App 2026-02-13 02:41
Grok 语音模式升级:iOS 一键导出对话为视频或播客——功能与商业机会分析

据 Grok 官方在 X 平台披露,Grok 语音模式现已支持在 iOS 上将与 AI 的语音对话直接导出为可分享的视频或播客音频,便于在社媒与播客平台分发(来源:Grok,2026 年 2 月 12 日)。据 Grok 称,该功能显著降低内容生产门槛,创作者、营销团队与教育机构可将 AI 对话快速转为短视频剪辑或长时节目,用于知识解说、访谈预演与对话式学习等场景,并具备通过视频与播客渠道变现的潜力(来源:Grok)。此外,据 Grok 表示,此升级将 Grok 从对话助手延伸为“即录即发”的 AI 内容工作流中枢,利好多平台分发与增长(来源:Grok)。 (来源)

更多来自 Grok 2026-02-12 22:26
AI项目成功指南:避开初学者最大误区的5步法(先定义问题,再选模型)

据@DeepLearningAI 在推特发布的信息显示,多数AI初学者在选模型前未定义真实用户问题与可量化目标,导致项目早期即失败。根据DeepLearning.AI于2026年2月12日的帖子,企业应先进行问题发现、用户痛点量化与成功指标设定,再依据数据、时延与成本约束选择合适模型。DeepLearning.AI指出,这种“问题优先”流程可缩短迭代周期、避免范围蔓延并提升ROI,适用于客服自动化、企业协作助手等场景。帖子还强调,应在明确需求后再将任务映射到模型类别(如用于推理的GPT4级LLM、用于长上下文分析的Claude3或领域微调模型)。 (来源)

2026-02-12 22:00
Gemini 3 Deep Think重磅分析:面向数学与物理的专家级科研助手与应用前景

据Demis Hassabis在X平台介绍,Gemini 3 Deep Think以专家级学科知识与工程实用性为核心,为数学、物理、化学等领域研究者提供辅助(来源:Demis Hassabis,X,2026年2月12日)。据其分享的视频与帖子,Lisa Carbone教授展示了在复杂研究中的实际用法,包括分步推理、符号运算与代码生成,用于验证推导与快速测试假设(来源:Demis Hassabis,X)。据该内容所述,该模型有望缩短证明与仿真的迭代周期,提升学术与企业R&D团队的研究效率(来源:Demis Hassabis,X)。从商业机会看,潜在方向包括:面向科研软件的专业Copilot、与数值仿真与符号计算工具的集成、以及面向合规研发场景的可追溯与可复现解决方案(来源:Demis Hassabis,X)。 (来源)

更多来自 Demis Hassabis 2026-02-12 21:02
Gemini 3 Deep Think上线:Google AI Ultra订阅用户率先体验—功能亮点与2026商业影响分析

据@demishassabis表示,Google AI Ultra订阅用户现已可在Gemini应用中启用Gemini 3 Deep Think模式,详见Google官方博客。根据Google博客,Deep Think面向多步推理与长时思考,支持复杂规划、代码生成与数据分析等需要更长上下文与内部推理的任务。依据Google博客报道,此次先行开放于AI Ultra高级订阅,体现将高阶推理功能作为增值能力的商业路径,并在企业级推理基准上与OpenAI o3、Anthropic Claude Opus形成直接对标。根据Google博客,典型场景包括多来源调研综述、财务建模、长文结构化与编辑,SaaS厂商可通过Google生态集成以提升RFP撰写、合规审阅等高准确度流程。另据Google博客披露,功能强调可靠性与使用指引,长时推理带来更高单次调用成本,但有望提升知识工作与开发效率的任务完成率。 (来源)

更多来自 Demis Hassabis 2026-02-12 21:02
Gemini 3 Deep Think 创下新基准纪录:ARC‑AGI‑2 84.6%、HLE 48.4%、Codeforces 3455 Elo 权威解析

据 Demis Hassabis 在 X(推特)发布的信息,Google DeepMind 的 Gemini 3 Deep Think 在 ARC‑AGI‑2 上取得 84.6%,在 Humanity’s Last Exam 无工具条件下达到 48.4%,并在 Codeforces 获得 3455 Elo,均为最新纪录。根据该公告,这些成绩表明其泛化与程序竞赛能力显著提升,可在企业场景中用于更可靠的科学分析、代码生成与自动化测试。依照该来源,ARC‑AGI‑2 领先与高 Elo 水平意味着更强的多步推理与错误恢复能力,为研发提效、软件交付加速与生产推理重试率降低带来可量化机会。 (来源)

更多来自 Demis Hassabis 2026-02-12 21:01
Gemini 3 Deep Think上线:Google AI Ultra订阅用户抢先体验—功能亮点与商业影响分析

据@demishassabis表示,Google AI Ultra订阅用户现已可在Gemini应用中体验Gemini 3 Deep Think模式,详细信息见Google官方博客。根据Google博客,Deep Think面向多步推理、长上下文规划与工具增强的问题求解,适用于复杂编程辅助、多文档综述与研究计划制定等场景。依据Google博客披露,Deep Think作为Ultra级别的高级能力先行开放,可提升订阅价值并在企业与专业用户市场形成差异化。根据Google博客,Deep Think强化类链式推理的规划输出并配套安全控制,有望提升在RFP撰写、数据管道调试、PRD要点归纳等工作流中的可靠性。依@demishassabis所述,本次为即时上线,为开发者验证长上下文智能体、企业试点结构化推理助手、内容创作者加速从检索到成稿的端到端流程带来短期落地机会。 (来源)

更多来自 Demis Hassabis 2026-02-12 20:59
Gemini 3 Deep Think深度解析:面向数学物理化学的专家级科研能力与应用

据Demis Hassabis在X平台表示,Gemini 3 Deep Think将专家级科学领域知识与工程化工具结合,用于支持数学、物理、化学等研究场景,Lisa Carbone教授已在其复杂科研中实际应用(来源:Demis Hassabis在X)。同一来源称,该系统面向严谨问题求解与逐步推理,可用于定理探索、符号推导与实验方案辅助,为高校与工业研发带来流程加速与质量提升。基于该消息,科研机构、AI科研工具厂商与企业研发部门可围绕面向学术领域的推理模型部署、合规审计与可重复性工作流,拓展产品与服务机会。 (来源)

更多来自 Demis Hassabis 2026-02-12 20:59
Simile上线:Karpathy加持,探索LLM原生人格空间的突破与5大商业场景

据Andrej Karpathy在X平台表示,Simile已上线,核心在于挖掘大语言模型的“原生人格空间”,而非固定单一人设,从而实现多人格交互与更丰富的对话与对齐测试。根据Karpathy的帖子,这一较少被探索的方向可用于客服自动化、创意写作、市场调研、教育辅导与智能体编排,通过动态抽样与组合不同人格提升效果。Karpathy亦称其为小额天使投资人,显示出专家背书与潜在对顶级LLM技术栈的接入优势。依据该公告,商业价值在于通过人格多样性提升留存与转化、用可复用人格模板降低提示工程成本,并以多视角压力测试改进安全与对齐评估。 (来源)

更多来自 Andrej Karpathy 2026-02-12 20:12
Anthropic年化营收达140亿美元:企业级智能平台增长与2026商业机遇分析

据Anthropic在Twitter发布的信息显示,其年化营收运行率已达140亿美元,且过去三年每年均实现超10倍增长,主要受企业与开发者对其智能平台采用推动(来源:Anthropic,2026年2月12日)。据Anthropic链接公告,该增长反映Claude系列在生产环境、API调用与企业安全工具中的渗透加速,带来LLM集成、推理成本优化与安全合规部署等商业机会。根据Anthropic披露,其作为“首选智能层”的定位将推动伙伴生态、合规方案与大型企业席位合同扩张,并在企业助手、RAG检索增强与代理自动化等领域与OpenAI和谷歌竞争加剧。 (来源)

更多来自 Anthropic 2026-02-12 19:01
Grok Imagine多图编辑上线:风格与角色融合升级,5大商业场景与2026趋势分析

据Grok在X平台发布的信息,Grok Imagine新增多图编辑功能,可在单一流程中融合多张参考图的风格、角色与环境,实现合成图生成与角色连贯渲染(来源:Grok,2026年2月12日)。据该公告,创作者可导入多张参考图进行版式与风格迁移,从而加速品牌物料产出、社媒多版本内容与概念美术迭代(来源:Grok X官方帖)。该帖还称,多参考图组合有助于构建统一场景,为市场营销团队、游戏工作室与电商卖家带来规模化本地化与创意A/B测试机会(来源:Grok X官方帖)。 (来源)

更多来自 Grok 2026-02-12 18:55
OpenAI发布超低时延GPT-5.3 Codex Spark:性能解析与7大落地场景

据Greg Brockman在X平台表示,OpenAI推出超低时延的GPT-5.3-Codex-Spark研究预览版,面向更快的代码生成与编辑交互。根据OpenAI在X上的发布,该模型主打近乎即时的代码建议与工具控制,可显著缩短开发者等待时间并提升IDE响应速度,覆盖补全、重构与行内调试等场景。依据OpenAI在公告视频中的介绍,低时延为实时终端助手、结对编程机器人与需要快速函数调用的本地代理创造更高可用性。按照OpenAI在X上的信息,产品与平台团队可将其用于现场原型开发、自动化测试用例生成与CI管道修复,从而缩短提交到部署周期并降低上下文切换开销。鉴于OpenAI强调该版本为研究预览,企业应先在沙箱中试点,基准对比现有代码模型的延迟与可靠性,并评估安全与合规后再扩大部署。 (来源)

更多来自 Greg Brockman 2026-02-12 18:09
OpenAI 将 Codex 新功能推出至 ChatGPT Pro:覆盖应用、CLI 与 IDE 插件的2026最新发布与商业影响分析

据 OpenAI 在 X 平台发布的消息,Codex 新功能今日向 ChatGPT Pro 用户推出,覆盖 Codex 应用、命令行工具与 IDE 扩展,直接嵌入开发者工作流以提升代码生成与自动化效率(来源:OpenAI 于2026年2月12日发布的 X 帖文)。据 OpenAI 公告,此次多入口分发可减少上下文切换,加速原型开发,并在代码补全、重构与测试生成等场景带来可衡量的效率提升。根据 OpenAI 的说明,先面向 ChatGPT Pro 订阅者开放,显示其商业化路径有利于企业以受管方式在 IDE 与 CLI 侧试点 AI 编程助手。正如 OpenAI 公告所示,多端集成将 Codex 定位为全栈开发助手,为 SaaS 与 DevOps 厂商通过 IDE 与终端插件嵌入 AI 代码操作、CI 集成与安全审查流提供机会。 (来源)

更多来自 OpenAI 2026-02-12 18:07
OpenAI 推出 GPT-5.3 Codex Spark 研究预览:更快的代码生成与原型搭建

据 OpenAI 在 X 平台发布的信息,GPT-5.3 Codex Spark 已进入研究预览阶段,旨在帮助开发者更快地生成代码与搭建原型。根据 OpenAI 官方公告,该模型面向加速应用脚手架与代码迭代,或已优化代理式编程、上下文处理与工具调用时延。依据 OpenAI 的说明,此举为团队带来业务机会,包括缩短功能交付周期、自动化样板代码、在 CI 流水线中集成模型助手以加速代码评审与测试生成。正如 OpenAI 在 X 上所述,提前开放表明其聚焦开发效率,预计优先落地于 IDE 插件、低代码平台与内部工具,在强调快速原型的场景中具备优势。 (来源)

更多来自 OpenAI 2026-02-12 18:07
Gemini 3 Deep Think上线:Ultra用户即时可用,企业与研究者获API早期访问|深度推理与5大商业场景分析

据Sundar Pichai在X平台表示,谷歌已在Gemini应用向Ultra订阅用户开放新版Gemini 3 Deep Think模式,并首次通过Gemini API向部分研究机构与企业提供早期访问。据谷歌官方博客称,Deep Think面向多步推理与长周期任务,适用于复杂招标文档解析、财务模型推演、科研文献综述归纳、多文档计划编排等企业级场景。根据谷歌博客介绍,早期访问计划面向经过审核的合作方,体现其以高价值推理工作负载切入合规与研究密集型行业的商业化路径。另据谷歌博客披露,经由API集中承载“链式规划”与工作流编排,有望降低多代理与多步骤管线的开发与运维成本;而面向Ultra消费者的开放将形成真实使用反馈闭环,加速模型在企业级推理基准上的迭代优化。 (来源)

更多来自 Sundar Pichai 2026-02-12 17:38
Gemini 3 Deep Think重磅升级:基准得分84.6%,推动车理性推理新突破

据Sundar Pichai在X平台表示,谷歌的Gemini 3 Deep Think完成重要升级,与科学家和研究人员深度合作以解决复杂的真实世界问题,并在高难度推理基准上取得前所未有的84.6%成绩(来源:Sundar Pichai,2026年2月12日)。据其披露,此次优化聚焦于严苛推理任务,强化分步求解与长上下文规划,预计将拓展在科研研发、金融建模、供应链与运营优化等企业场景的落地(来源:Sundar Pichai)。根据原帖,此升级面向最具挑战性的评测,意味着面向工程、数据分析及高合规行业的专业助手与工具链将迎来商业化机会,尤其是可验证推理与稳健工具调用能力的解决方案(来源:Sundar Pichai)。 (来源)

更多来自 Sundar Pichai 2026-02-12 17:38
A2A Agent2Agent 协议课程:与谷歌云和IBM研究院合作的跨框架智能体互操作最新指南

据AndrewYNg在X平台发布的信息,DeepLearning.AI 推出A2A(Agent2Agent)协议短课,由谷歌云与IBM研究院共同打造,并由Holt Skinner、Iván Nardini与Sandi Besen授课,旨在标准化不同框架智能体之间的通信。据AndrewYNg报道,该课程直面跨框架对接常需大量定制集成的问题,提供可复用的协议层以实现互操作与编排。依据AndrewYNg,此举将降低集成成本并提升可靠性,帮助企业更快落地多智能体应用,如企业流程自动化、客服与供应链协同,构建厂商中立的智能体生态。 (来源)

更多来自 Andrew Ng 2026-02-12 16:30
DeepLearning.AI招募客户经理:2026企业AI落地与培训加速机会解析

据DeepLearning.AI在X平台发布的信息显示,该公司正在招聘客户经理,职责包括通过企业培训、用例共创与落地推动AI采用,并使用AI工具进行调研、流程自动化和外联扩展(来源:DeepLearning.AI 推文,2026年2月12日)。据该推文称,该岗位聚焦企业AI赋能,释放出对技能提升、实施路线图与ROI导向PoC管线的即时需求。从官方说明看,这为市场带来机会点:模型评测与选型服务、提示工程课程体系、以及支持销售与运营的LLM自动化方案,均将受益于企业大规模AI部署趋势。 (来源)

2026-02-12 16:29
DeepThink实战落地:高等数学论文纠错的最新分析与应用前景

据OriolVinyalsML在X平台发布的帖子显示,DeepThink已用于帮助研究人员在高等数学论文中发现推理错误,展示了在证明校验与审稿流程中的实际影响。根据该帖附带的视频内容,系统可标记论证不一致之处,为数学家在同行评审与预印本自检中提供辅助层。依据该来源,这为学术出版社、arXiv作者与研究团队部署自动化定理校验与形式化推理管线创造机会,有望缩短修订周期并提升可复现性。 (来源)

更多来自 Oriol Vinyals 2026-02-12 16:20