行业动态

追踪 AI 与 Web3 行业的最新进展与深度洞察

深度文章

从快讯延伸到产品观察和工具分析。

AI 工具目录

按能力、行业和场景查找可用工具。

首页精选

查看最新工具、行业动态和精选内容。

Particle推出Radar平台,支持13万+播客可搜索及AI代理调用

OmniTools 8月26日消息,AI新闻阅读工具初创公司Particle(由前Twitter工程师创立)正式发布Radar——一个面向播客的智能索引与搜索平台。该平台已转录并结构化分析超13万档播客,覆盖Apple Top 200榜单全部135个垂直类目,日均新增2万期内容。 Radar不仅提供高精度语音转文字,还标注说话人、提取关键语句与实体(如人物、公司、品牌、话题),并支持跨节目追踪实体提及、定制化实时告警(通过邮件/Slack/webhook推送)。其API与MC...

前Meta科学家创立Perceptron,推出面向工业场景的视觉AI模型Isaac 0.5

OmniTools 8月26日消息,由两名前Meta基础人工智能研究(FAIR)科学家Armen Aghajanyan与Akshat Shrivastava于2024年11月联合创办的初创公司Perceptron,本周正式发布其新一代视觉AI模型Isaac 0.5。该模型旨在赋予机器在物理环境中“感知、推理与行动”的能力,适用于仓库、工厂等复杂工业场景中的视觉导航与任务执行。 Isaac 0.5支持视觉引导机器人完成空间识别、标签读取、路径规划及多步骤操作序列决策,并可从机器...

腾讯混元将端侧翻译模型 Hy-MT2-1.8B 压缩至 440MB,已落地 B 站直播弹幕翻译

OmniTools 8月26日消息,腾讯混元团队通过 2 bit 与 1.25 bit 量化技术,将端侧翻译模型 Hy MT2 1.8B 压缩至 574MB 和 440MB 两个版本,翻译质量几乎无损,在 FLORES 200 基准测试中表现优于 Microsoft Translator 等商业 API。 该模型已完成与英特尔 x86 平台的适配,目前已在哔哩哔哩直播场景中投入实际应用,支持弹幕实时翻译,单条弹幕处理耗时为 500 800 毫秒。

实测飞书与豆包工作联动:首个企业级Agent的8个使用技巧

OmniTools 8月26日消息,豆包工作(豆包 Work)是当前企业接入Agent门槛较低的路径之一,需使用飞书账号登录以解锁完整功能。实测显示,该Agent支持手机远程控制最多7台设备、设置定时任务、自动读取本地Skill、通过侧边栏直接编辑并同步至飞书,且聊天记录对管理员不可见。分析认为,该Agent可能带来较高的token消耗,其与飞书原生生态的深度集成被视为相较Claude Cowork、Codex Work等同类产品的核心优势。

C2PA相机认证在Android平台存在伪造风险

OmniTools 8月26日消息,安全研究员David Buchanan披露,C2PA(内容凭证与证明联盟)相机认证机制在Android设备上存在安全缺陷。攻击者可通过利用root权限提升漏洞(如CVE 2026 43499),调用StrongBox硬件密钥模块对任意图像或视频数据生成合法C2PA签名,实现内容来源的伪造。 该攻击无需物理接触设备,亦不依赖传统硬件攻击手段,且因涉及底层信任链设计,无法通过常规软件补丁修复。研究人员已按负责任披露流程,提前90天向相关厂商及C...

智谱开源 GLM-5.3-Flash 原生多模态模型,限时折扣价为 GLM-5.3 的 1/20

OmniTools 8月26日消息,IT之家 8月26日消息,智谱正式上线并开源 GLM 5.3 Flash(320B A18B),为 GLM 5 系列首个原生多模态模型,总参数量 3200 亿,激活参数仅 180 亿。 该模型在 AA 综合智能指数中得分为 57 分,与 Claude Opus 4.8 持平,在编程任务上表现相近。其商用定价为 GLM 5.3 的 1/10,限时折扣价为 GLM 5.3 的 1/20,相当于 Claude Opus 4.8 定价的 1/40。...

AI代理时代客户体验新挑战:编排能力成关键

OmniTools 8月26日消息,随着企业加速在消息、语音及数字渠道部署AI代理与语音AI,底层架构的演进速度已明显滞后。Tata Communications客户交互套件全球负责人Gaurav Anand指出,多数企业正将对话式AI“硬连接”至原本未为此设计的遗留系统,导致虽工具众多,却鲜有真正集成、可扩展且支持无缝编排的平台。 这一断层使人工坐席需在彼此割裂的系统间手动拼凑上下文,以确认AI已向客户传达的信息,显著增加认知负荷。核心问题并非数据不可得,而是缺乏统一的企业...

Z.ai确认开发神秘开源模型Ox Alpha,权重将于周三发布

OmniTools 8月26日消息,AI实验室Z.ai正式确认其为近期引发广泛关注的开源大模型Ox Alpha的开发者。该模型此前以匿名方式发布于OpenRouter平台,已在多项基准测试和排行榜中表现突出。 Z.ai表示,Ox Alpha是其GLM系列的最新迭代,定位为面向编程、长周期智能体任务及生产级工作负载的推理模型,支持长程软件工程、复杂推理以及图文协同工作流。 公司计划于本周三公开Ox Alpha的模型权重,供开发者使用。此前,Z.ai于本月早些时候发布了GLM 5...

机器人AI大脑正走出GPT-2阶段,行业聚焦数据与仿真瓶颈

OmniTools 8月26日消息,TechCrunch 8月26日消息,物理AI(Physical AI)正加速发展,但当前机器人“大脑”仍处于类似GPT 2的早期阶段——具备基础能力,尚难稳定执行高价值任务。Unitree近期IPO后市值一度达660亿美元,但随后缩水近半,凸显市场对实际落地能力的审慎态度。 在Actuate机器人AI开发者大会上,参会人数已达1500人,较2023年增长三倍。多家基础设施公司如Foxglove、Avala和Antioch聚焦于解决核心瓶颈...

QueryStory 完成 600 万美元种子轮融资,推出面向企业数据库的可信 AI 查询平台

OmniTools 8月26日消息,TechCrunch 8月26日消息,AI 初创公司 QueryStory 正式结束隐身状态,宣布完成 600 万美元种子轮融资,投资方为 Brightmind Ventures 和纽约人寿风险投资(New York Life Ventures),投后估值 6000 万美元。该公司由前 Google 工程师 Shapor Naghibzadeh 联合创立,核心团队成员来自 Google、EvolutionIQ 和 Accenture。 Qu...

通义千问发布多模态 MoE 模型 Qwen3.8-Flash,为 Qwen4 架构早期预览

OmniTools 8月26日消息,通义千问正式发布 Qwen3.8 Flash,一款多模态混合专家(MoE)模型,同时作为 Qwen4 架构的早期技术预览版本,现已开放模型权重。 该模型总参数量为 1250 亿,每 token 仅激活 60 亿参数,原生支持 262K 上下文长度,可扩展至 100 万;训练成本约为 Qwen3.7 Plus 的九分之一。 在编码与办公类任务上,Qwen3.8 Flash 相较前代模型表现更优。

Arga 完成 1000 万美元种子轮融资,专注企业级 AI 智能体训练环境构建

OmniTools 8月26日消息,Arga 宣布完成 1000 万美元种子轮融资,由 General Catalyst 领投,Box Group、Emergence、Gradient 和 SV Angel 跟投。 该公司致力于构建面向企业软件(如 Salesforce、Workday 和邮件客户端)的 AI 智能体训练环境。其核心方案是创建具备完整权限系统与 Webhook 的数字孪生环境,而非仅提供无状态 API 接口,从而支持多系统协同场景下的高保真训练。 Arga 指...

听力科技初创公司Legato完成1200万美元融资,推出AI助听眼镜Legato Frames

OmniTools 8月26日消息,TechCrunch 8月26日消息,美国听力科技初创公司Legato正式结束隐身状态,宣布完成1200万美元融资,并首次公开其AI助听眼镜Legato Frames。该产品将专利助听技术集成于眼镜镜腿中,采用开放耳道设计与双扬声器系统,可定向传递声音并抑制99%的外泄声。 Legato Frames面向轻度至中度听力损失人群,主打轻量化、隐蔽性与易用性,无需复杂配置,目标是让助听体验如佩戴普通眼镜般自然。其AI系统专注于区分人声与背景噪音...

Runable 完成 2100 万美元 A 轮融资,聚焦 AI 代理助力中小企业获客增长

OmniTools 8月26日消息,TechCrunch 8月26日消息,印度初创公司 Runable 宣布完成 2100 万美元 A 轮融资,由 Susquehanna Venture Capital 和 Nexus Venture Partners 共同领投,Together Fund 与 Array VC 等现有投资者跟投。本轮融资为全股权融资,投后估值 6500 万美元。 Runable 成立于 2025 年,总部位于班加罗尔,团队规模约 15 人。其 AI 代理平台...

印度语音AI公司Ringg获Peak XV 1000万美元融资,拓展语音AI智能体平台

OmniTools 8月26日消息,印度语音AI初创公司Ringg宣布完成1000万美元A轮融资扩展,由Peak XV Partners领投。该公司此前已于2026年早些时候完成550万美元A轮融资,本轮后A轮总融资额达1550万美元。 Ringg最初以文本转语音起家,后转向构建企业级语音AI智能体,目前月处理通话尝试量超2000万次。其客户包括Cred、Flipkart、Practo、Groww和PolicyBazaar等印度主流科技企业,并已在Practo平台为1200家...

机器人初创公司 Generalist 估值达 30 亿美元

OmniTools 8月26日消息,据 TechCrunch 报道,知情人士透露,机器人初创公司 Generalist 最新估值已达 30 亿美元。该公司近期完成近 2 亿美元融资,由 8VC 领投,此轮融资为今年 6 月宣布的 4 亿美元 B 轮融资(当时估值 20 亿美元)的延伸,使该轮总融资额达 6 亿美元。 Generalist 成立于 2024 年,创始团队包括前 Google DeepMind 研究员 Pete Florence 与 Andy Zeng,以及前 B...

OpenAI数据中心负责人克里斯·马洛内离职,高管离职潮持续

OmniTools 8月26日消息,OpenAI前数据中心主任克里斯·马洛内(Chris Malone)已于上周离职。马洛内于2025年3月加入OpenAI,此前曾在Meta和Google累计任职逾15年。其离职正值OpenAI推进“星门计划”(Stargate Project)——一项由美国政府支持、总额5亿美元的本土数据中心建设计划,OpenAI与Oracle、Nvidia、SoftBank及Microsoft同为该计划关键合作伙伴。 据《华尔街日报》报道,马洛内离职前,...

LangChain 与 Airbyte 宣布集成,支持生产级数据摄取

OmniTools 8月26日消息,LangChain 与 Airbyte 宣布推出官方集成方案,旨在将基于检索的 AI 应用扩展至生产环境。该集成通过内置调度机制、自动化文本拆分及对 50 多种嵌入模型的支持,实现端到端数据摄取流程的自动化。开发者可借此构建具备可扩展性与稳定性的生产级数据管道。

OpenRouter 推出编辑器内实时 AI 模型选型框架

OmniTools 8月26日消息,AI 行业动态 8月25日消息,OpenRouter 近日提出一套面向开发者的 AI 模型选型框架,强调以任务完成效果与成本为决策核心。该框架分四步:明确定义任务目标;基于实时用量数据与第三方基准筛选候选模型;横向对比各提供商的定价、延迟与可靠性;最后使用自有提示词进行端到端测试。 框架摒弃传统“每 token 成本”指标,转而采用“每完成任务的成本”作为核心评估标准。配套的 MCP 服务器已支持集成至 Claude Code、Cursor...

OpenWorker 发布新版,内置三类网络安全智能体

OmniTools 8月26日消息,AI 行业动态 8月25日消息,Andrew Ng 团队开源的智能体框架 OpenWorker 推出新版,重点强化安全工作流能力。其核心 harness 组件完全开源,支持安全团队审计,确保无后门。 新版集成代码漏洞扫描、依赖供应链注入检测、云安全配置检查三类网络安全智能体。所有功能支持本地运行开源权重模型,便于在隔离环境中处理敏感代码。

Stability AI 完成 7600 万美元新一轮融资,累计融资达 2.32 亿美元

OmniTools 8月26日消息,Stability AI 宣布完成 7600 万美元新一轮融资,公司迄今累计融资总额达 2.32 亿美元。本轮融资参与者包括环球音乐集团、索尼音乐集团、华纳音乐集团、艺电(EA)、AMD Ventures 及 Pacific Alliance Ventures。 该公司表示,本轮资金将用于拓展其面向创意生产的 AI 产品组合,并加强专业服务团队建设。Stability AI 目前提供图像、音乐与视频生成等多模态 AI 模型,近年持续与主流娱...

OpenRouter 推出统一异步视频生成 API,支持 Seedance/Veo/Wan 等多模型

OmniTools 8月26日消息,OpenRouter 正式推出统一的异步视频生成 API。开发者可通过 POST /api/v1/videos 提交生成任务,后续通过轮询获取状态并下载 MP4 文件。 该 API 支持 Seedance、Veo、Wan 等多个视频生成模型,切换模型仅需修改请求中的 model 标识符,无需调整接口调用逻辑。 此举旨在简化多模型视频生成服务的集成流程,提升开发者接入效率。

Claude 记忆功能打通聊天与 Cowork,支持逐条查看与编辑

OmniTools 8月26日消息,Anthropic 旗下 Claude 已全面统一聊天界面与 Claude Cowork 的记忆系统,用户在任一对话场景中均可调用历史积累的上下文,减少重复说明。 记忆内容在对话过程中实时更新,用户可通过 Memory 设置按主题查看、编辑或删除单条记忆。 健康、信仰等敏感话题默认不存储,但可在设置中手动开启;身份证号、犯罪记录等高敏信息则始终不被保存。

Anthropic 为 Claude 推出跨 Chat 与 Cowork 共享记忆功能

OmniTools 8月26日消息,Anthropic 宣布为 Claude 推出跨 Chat 与 Cowork 的共享记忆系统,用户在任一界面中提供的项目背景、偏好等上下文信息,将自动同步至另一界面,无需重复输入。 新功能默认启用,覆盖免费版、Pro 与 Max 计划,支持网页、桌面端及移动端(iOS/Android 需更新至最新版本)。用户可随时查看、编辑或删除 Claude 记忆中的任意主题内容。 Anthropic 表示,默认情况下系统不会存储健康数据、种族、宗教信仰...

Dylan Patel 预测:Anthropic 与 OpenAI 将于 2028 年掌控全球大部分可用算力

OmniTools 8月26日消息,AI HOT 精选 RSS 8月25日消息,在最新一期播客中,SemiAnalysis 创始人 Dylan Patel 与 Dwarkesh Patel 探讨了人工智能实验室的经济模型。 两人指出,Anthropic 和 OpenAI 凭借更强的算力变现能力及更高的出价能力,有望在 2028 年前控制全球大部分可用 FLOPs。 该预测基于当前头部模型公司对算力资源的采购优势与商业化效率差异。

Google AI 发布 WeatherNext 气旋预测模型,提前五天预警五级飓风

OmniTools 8月26日消息,Google AI 正式发布 WeatherNext 气旋预测模型,可同步预测风暴路径、强度与规模,较现有系统多提供约一天预警时间。该模型在 2025 年飓风季实战测试中,成功提前五天预测飓风 Melissa 在牙买加的五级登陆,美国国家飓风中心首次在实时业务中部署该 AI 模型。 WeatherNext 单场风暴可生成最多 1000 次模拟,其代码与模型权重已开源。

Anthropic启动500万美元AI福祉影响评估研究资助计划

OmniTools 8月26日消息,Anthropic宣布启动一项总额500万美元的资助计划,支持独立研究人员开展人工智能对用户福祉影响的评估研究。该计划将提供资金、模型访问权限及技术支援,重点资助构建开源评估工具与基准的项目。 资助对象需完全独立开展研究,并将成果以开源形式发布,供全行业开发者使用。Anthropic强调,当前AI在心理健康支持、陪伴对话等场景中的应用日益广泛,但缺乏统一、严谨的福祉影响评估标准,尤其在多轮对话中识别风险演变、适配个体语境等方面仍存挑战。 A...

英伟达RTX Spark平台获多家游戏厂商支持,Gamescom公布多款大作适配进展

OmniTools 8月25日消息,英伟达在德国科隆举办的Gamescom展会期间宣布,RTX Spark平台已获得Electronic Arts、Ubisoft、Embark Studios等多家主流游戏厂商支持,多款即将发售的PC大作将原生适配该平台。其中包括EA SPORTS F1 25、Apex Legends、Anno 117: Pax Romana、ARC Raiders和THE FINALS等。 RTX Spark平台面向新一代Windows PC,整合RTX技...

IBM发布Granite 4.2系列推理大模型,含3B/8B/30B三尺寸

OmniTools 8月25日消息,IBM 8月25日消息,IBM正式发布Granite 4.2系列大语言模型,包含3B、8B和30B三种参数规模,均为从零训练的dense decoder only架构,支持最长512K上下文。该系列首次聚焦显式推理能力,所有模型均具备链式思维(CoT)生成、思考/非思考模式切换、低开销思考模式及原生工具调用功能。 Granite 4.2采用五阶段预训练策略,基于约15万亿token数据;监督微调(SFT)使用约720万样本(约100B to...

英伟达发布 Jetson Orin Nano 2 边缘 AI 机器人计算模块

OmniTools 8月25日消息,英伟达正式发布 Jetson Orin Nano 2 机器人计算模块,面向入门级边缘人工智能应用。该模块提供 78 TOPS AI 算力、8GB 内存和 8 核 Arm CPU,在相同尺寸下推理性能较前代 Jetson Orin Nano Super 提升 2 倍,15W 模式下功耗降低 40%。 Jetson Orin Nano 2 支持运行轻量化大语言模型与视觉语言模型(如 NVIDIA Cosmos、Nemotron、Gemma 4...

Gamma 收购 Accel 投资的设计初创公司 Lica,组建新设计研究团队

OmniTools 8月25日消息,AI 演示文稿工具公司 Gamma 宣布收购由 Accel 等机构投资的设计初创公司 Lica。Lica 成立于 2023 年,曾开发基于截图与录屏生成演示文稿和营销视频的工具,后聚焦于为电商客户定制符合品牌规范的视频内容。 Lica 联合创始人 Priyaa Kalyanaraman 和 Purvanshi Mehta 将加入 Gamma,牵头组建新的设计研究团队。双方表示,此次整合旨在深化对视觉化沟通方式的研究,探索更富交互性、个性化与...

IBM 发布 Granite Speech 5.0 TurboCTC 语音识别模型,实时转录速度超 12600 RTFx

OmniTools 8月25日消息,IBM 近日在 Hugging Face 平台正式发布 Granite Speech 5.0 系列语音识别模型,包括两款 470M 参数的英文 ASR 模型:granite speech 5.0 470m turboctc(Apache 2.0 许可)与 granite speech 5.0 470m turboctc nc(CC BY NC SA 4.0 许可)。二者均采用纯编码器架构,支持流式识别,实测在 NVIDIA H200 GPU...

苹果发布 M6 与 M5 Ultra 芯片,AI 算力与性能显著提升

OmniTools 8月25日消息,苹果正式发布 M6 与 M5 Ultra 两款自研芯片。M6 采用 2nm 工艺,集成 12 核 CPU、12 核 GPU 及双 16 核神经引擎,统一内存带宽最高达 170GB/s,多线程性能较前代 M5 提升 1.2 倍。 M5 Ultra 采用四芯片封装架构,最高配置达 36 核 CPU 与 80 核 GPU,内存带宽达 1.2TB/s,相较 M3 Ultra 提升 50%。 两款芯片将分别搭载于新款 Mac mini 与 Mac S...

OpenAI发布Jalapeño芯片,推理性能与能效超越当前业界标杆

OmniTools 8月25日消息,OpenAI在Hot Chips大会上公布了自研AI推理芯片Jalapeño的首批基准测试结果。该芯片在Semianalysis推出的InferenceX基准测试中,单位用户生成token数和每千瓦时吞吐量均高于当前可用的最先进推理处理器。 据OpenAI硬件负责人Richard Ho介绍,Jalapeño在单位功耗下可服务更多AI请求,同时响应延迟更低,兼顾高吞吐与低延迟。测试对比对象为Nvidia Blackwell系统,但Ho指出,待...

苹果发布 M6 与 M5 Ultra 芯片,分别用于新款 Mac mini 和 Mac Studio

OmniTools 8月25日消息,苹果正式发布 M6 和 M5 Ultra 两款芯片。其中 M6 是苹果首款基于 2nm 工艺制程的芯片,将搭载于新款 Mac mini;M5 Ultra 则为当前性能最强的苹果自研芯片,面向 Mac Studio 机型。 两颗芯片均在 CPU、GPU 及 AI 加速能力方面实现显著提升,重点强化了本地大模型推理、视频生成与多模态任务处理性能。 苹果未公布具体算力数值或能效参数,但强调新芯片可支持更复杂的端侧 AI 应用场景。

Keenable 完成 2600 万美元种子轮融资,构建面向 AI 代理的超千亿级网页索引

OmniTools 8月25日消息,TechCrunch 8月25日消息,AI 基础设施初创公司 Keenable 正式结束隐身状态,宣布完成 2600 万美元种子轮融资,由 Accel 领投,Conviction Partners 及多位天使投资人跟投。 该公司由前 Yandex 搜索、AI 与云业务负责人 Andrey Styskin 与德国 AI 科学家 Matthias Petri 联合创立,致力于构建专为 AI 代理优化的新型网页搜索基础设施。其索引已覆盖超 100...

NVIDIA Vera Rubin NVL72 提升智能体能效:每兆瓦吞吐量最高提升 30 倍

OmniTools 8月25日消息,NVIDIA 实测数据显示,Vera Rubin NVL72 在 AI 智能体工作负载下,每兆瓦吞吐量较 GB300 NVL72 最高提升 30 倍,每百万 token 计算成本降低至原方案的 1/35。 该性能提升基于 NVIDIA 对智能体典型任务场景的基准测试,涵盖推理延迟、并发请求处理及长上下文调度等维度。Vera Rubin NVL72 采用新一代架构与液冷优化设计,面向大规模智能体集群部署。

FORGE基准揭示检索增强推荐系统脆弱性:单个污染页面可致最高73.8%推荐失准

OmniTools 8月25日消息,一项新发布的基准测试FORGE评估了检索增强型大语言模型(LLM)在消费推荐场景中的鲁棒性。该基准覆盖225个真实产品、15个类别及5个消费场景,对12个主流商业与开源LLM进行测试。 研究发现,所有被测模型均易受GEO内容污染攻击:仅污染单个网页即可导致最高27%的推荐错误率;若污染检索结果前3位页面,错误率升至73.8%。 结果表明,当前检索增强推荐系统存在显著安全风险,可能无意中推广虚假或低质产品。

特朗普购入SpaceX股票,买入价约150美元/股

OmniTools 8月25日消息,据公开财务披露文件显示,美国前总统唐纳德·特朗普于6月23日购入价值最高达5万美元的SpaceX股票,距该公司历史性IPO约两周。当时SpaceX股价处于每股150美元中段区间。 截至8月23日(周一)收盘,SpaceX股价回落至IPO发行价135美元/股,特朗普所持股份账面价值或已低于买入成本。 SpaceX近期持续获得大量政府合同,并受益于监管环境变化。其IPO前曾推动主流指数调整纳入规则,以加速被纳入指数基金。白宫方面表示,特朗普个人...

AI对冲基金Situational Awareness遭美国证监会调查

OmniTools 8月25日消息,美国证券交易委员会(SEC)已就AI对冲基金Situational Awareness展开调查,向多家与该基金有业务往来的银行发出传票,要求其保存相关交易及资金支持信息。据悉,调查聚焦于银行对基金交易的监督职责及融资渠道管理。 该基金由前OpenAI员工Leopold Aschenbrenner创立,曾因重仓AI相关资产一度成为华尔街焦点。但7月底AI股大幅回调导致其资产缩水数十亿美元,公司随后陷入经营困境。 Situational Awa...

GPT-5.6 模型家族上线开发智能体 Kiro

OmniTools 8月25日消息,GPT 5.6 模型家族已正式接入软件开发智能体 Kiro,包含 Sol、Terra 和 Luna 三款模型。在 Terminal Bench 2.1 测试中,GPT 5.6 Terra 在 Kiro 环境下完成任务的成本降低约 82%。该版本由 OpenAI 与 AWS 联合优化,聚焦减少迭代次数、提升 token 利用效率,以支持开发者生成更高质量代码。

Meta开源专为AI设计的RDMA协议MetaRoCE

OmniTools 8月25日消息,Meta公司设计并开源了MetaRoCE协议,一种面向AI工作负载的新型RDMA传输协议,已通过Open Compute Project(OCP)发布规范、参考软件实现及合规测试套件。 该协议将智能逻辑移至端点,原生支持乱序交付、多路径传输、无损容忍和双向拥塞控制,无需依赖PFC机制,可在百万级GPU规模集群中实现高吞吐与低尾延迟。 MetaRoCE兼容现有RDMA Verbs API及软件栈,无需修改即可部署运行。

Replit CEO Amjad Masad 将出席 TechCrunch Disrupt 2026 主舞台

OmniTools 8月25日消息,Replit 联合创始人兼首席执行官 Amjad Masad 将于10月13日至15日在旧金山莫斯康西馆举行的 TechCrunch Disrupt 2026 大会上登台发表演讲。 Masad 将围绕编程的未来展开分享,探讨 AI 普及背景下创意快速转化为产品的发展趋势,以及 Replit 在其中的技术定位与实践路径。 据公开信息,Replit 当前年化营收已接近10亿美元,较2024年报告的280万美元显著增长;公司估值亦于今年早些时候升...

Mistral与HUMAIN达成战略合作,推进中东地区主权AI建设

OmniTools 8月25日消息,Mistral AI 8月24日消息,Mistral AI与沙特阿拉伯科技公司HUMAIN宣布建立战略合作伙伴关系,共同推动沙特及中东地区的主权AI发展。合作涵盖AI基础设施建设、先进模型本地化开发及AI解决方案部署,初期聚焦网络安全与语音技术领域。 双方计划联合开发高性能阿拉伯语大模型,并探索利用HUMAIN数据中心设施满足区域日益增长的本地算力需求。合作规模达数亿欧元,将支持金融、制造、电信、公共部门等对数据主权、合规性与运营自主性要求...

AI助手Instinct引发隐私与安全争议

OmniTools 8月25日消息,AI个人助手Instinct目前处于私测阶段,因其强大的任务执行能力(如自动订餐、安排行程、整理邮箱等)受到早期用户高度评价,但其广泛的数据访问权限和用户协议正引发隐私与安全担忧。 据公开条款显示,Instinct要求用户授予其“永久且不可撤销”的许可,可访问、存储、处理甚至用于训练模型的各类用户数据,包括邮件、屏幕截图、键盘输入及位置信息。部分用户反馈,即使断开授权后,系统仍能基于历史数据生成邮件摘要,且曾出现未经确认即代发邮件的情况。...

General Intuition获Valor、Point72等投资,投前估值达60亿美元,聚焦具身智能与机器人

OmniTools 8月24日消息,据TechCrunch报道,纽约初创公司General Intuition正就新一轮融资进行洽谈,投前估值达60亿美元。新投资者包括Valor Equity Partners、Point72 Ventures和Seven Seven Six,现有股东Khosla Ventures与General Catalyst亦参与本轮融资。 该公司致力于构建可训练通用AI智能体在时空维度中行动的基础模型,其数据源自创始人此前运营的游戏视频平台Medal...

OpenAI 推出 ChatGPT Work:面向白领的自主式 AI 代理工具

OmniTools 8月24日消息,OpenAI 近日正式发布 ChatGPT Work,一款面向非技术岗位白领用户的自主式 AI 代理产品,定价 20 美元/月,已上线其最低订阅层级。该工具基于 Codex 技术演进而来,旨在让会计、投资、医疗等领域的从业者无需编程能力,即可完成多步骤数字任务,例如自动生成周报、整合 Slack 对话生成图表、同步邮件日历事件等。 据 OpenAI 内部工程师介绍,ChatGPT Work 的核心是强化“harness”(模型封装层),使其...

SpaceXAI 采用 NVIDIA Vera CPU 加速大规模智能体 AI

OmniTools 8月24日消息,SpaceXAI 宣布将部署 NVIDIA Vera CPU,以加速其下一代智能体 AI(Agentic AI)工作负载。Vera 是全球首款专为 AI 智能体设计的 CPU,具备 88 个 NVIDIA 自研 Olympus 核心、空间多线程技术及高达 1.2TB/s 的 LPDDR5X 内存带宽,可提升任务完成速度达 1.8 倍。 SpaceXAI 将基于 NVIDIA Vera Rubin 平台扩展 Grok 相关 AI 基础设施,并...

NVIDIA Groq 3 LPX 正式量产,专为智能体 AI 提供世界级推理速度

OmniTools 8月24日消息,NVIDIA 官方消息,NVIDIA 宣布 Groq 3 LPX 推理加速器已进入全量生产阶段。该芯片作为 Vera Rubin 平台的扩展组件,专为智能体 AI(Agentic AI)设计,聚焦超低延迟、高吞吐量的 token 生成能力。 在 Artificial Analysis 基准测试中,Groq 3 LPX 运行 Gemma 4 31B 开源模型(上下文长度达 10 万 token)时,实现每秒 3400 个输出 token,创下...

NVIDIA Vera Rubin NVL72实测:AI智能体推理能效达GB300 NVL72的30倍,Token成本降低35倍

OmniTools 8月24日消息,NVIDIA 官方消息,8月24日公布的实测数据显示,Vera Rubin NVL72系统在AI智能体(agentic AI)工作负载下,每兆瓦功耗的推理吞吐量最高可达GB300 NVL72的30倍,单百万token成本较后者降低35倍。 该数据基于SemiAnalysis AgentX真实编码轨迹工作负载测得,完整保留上下文累积、工具调用与子智能体调度等典型智能体行为。测试覆盖Kimi K3、MiniMax M3、GLM5.3、Qwen3...