行业动态
追踪 AI 与 Web3 行业的最新进展与深度洞察
深度文章
从快讯延伸到产品观察和工具分析。
AI 工具目录
按能力、行业和场景查找可用工具。
首页精选
查看最新工具、行业动态和精选内容。
数学新手借助AI与Lean形式化系统完成康威细化猜想证明
OmniTools 9月19日消息,一位自称数学新手的作者称,耗时一个月业余时间并调用大量计算资源,借助AI与Lean形式化证明系统完成了约翰·康威50年前提出的“康威细化猜想”的证明。该猜想断言全体整数具有细化性质。 目前该证明已通过Palomar注册表的机械验证,但尚未经过数学界同行的独立人工审查。 熟悉Lean系统及该数学领域的部分研究者表示,猜想陈述本身看似正确,但形式化证明的严谨性仍需进一步检验。
Gary Marcus 警示AI幻觉风险:一份误判中国船只载核部件的情报报告曾致美军紧急拦截
OmniTools 9月19日消息,认知科学家Gary Marcus在近期文章中援引《纽约时报》报道指出,特朗普政府出于经济考量倾向于淡化AI风险,并抵制相关监管措施。他同时转发记者Katie Bo Lillis的报道,提及一起由AI生成的情报失误事件:某AI辅助分析系统因模型幻觉,错误判定一艘中国商船运载核武器部件,导致美军启动紧急拦截程序。该事件被描述为“几乎引发战争”。
世界模型初创公司普遍保持技术细节缄默
OmniTools 9月19日消息,近期多家专注世界模型(World Models)的初创公司——包括 Yann LeCun 参与创立的 AMI Labs 与 Fei Fei Li 联合创办的 World Labs——虽已获得大量融资与行业关注,但对具体技术路线、产品形态及商业化路径均未公开披露。 AMI Labs 联合创始人兼世界模型副总裁 Michael Rabbatt 在 All In 大会小组讨论中表示:“我们仍在研究与构建阶段,暂不对外讨论产品计划或时间表。”Wor...
美军因AI生成虚假情报险些拦截中国船只
OmniTools 9月19日消息,据CNN报道,今年春季美伊冲突期间,美国特种作战司令部一名分析师使用聊天机器人整合开源与机密信号情报,生成一份报告称一艘位于中东海域的中国船只涉嫌运输核武器部件。该报告被作为正式情报分发,美军据此启动武装登船拦截预案。 行动实施前,经人工复核发现报告内容完全失实,相关行动随即中止。事件凸显美军各机构AI工具部署分散、缺乏统一验证机制,且AI辅助目标识别正快速扩展,但人机协同操作规范尚未明确。 报道指出,此类AI幻觉引发的情报失误已引发美军内...
环球音乐与索尼音乐就Suno新AI模型发起第二起版权诉讼
OmniTools 9月19日消息,环球音乐集团(UMG)与索尼音乐娱乐于2026年9月18日对AI音乐生成公司Suno提起第二起诉讼,指控其新发布的AI模型侵犯版权。 此次诉讼聚焦于Suno近期推出的新AI模型,原告方认为该模型在训练或生成过程中未经授权使用了受版权保护的音乐作品。 Billboard与The Hollywood Reporter均对此事进行了报道。
ChatGPT联合发明人推出新型AI模型Jev,专注软件自动化决策
OmniTools 9月19日消息,前OpenAI研究员、ChatGPT联合发明人Diogo Almeida创立的TypeSafe AI公司近日发布新型AI模型Jev。该模型并非传统大语言模型(LLM),不生成文本,而是直接输出经校准的概率性决策,专为软件自动化场景优化。 Jev基于Transformer架构,训练数据全部为合成数据,采用其自研的“基于校准决策的强化学习”方法。据测试,Vercel使用Jev替代OpenAI ChatGPT Luna 5.6执行命令安全分类任务...
Ethan Mollick 提出“能力悬差”:GPT-6 Astra 与 Fable 5.1 现有能力尚未被充分调用
OmniTools 9月19日消息,宾夕法尼亚大学教授 Ethan Mollick 在最新文章中提出“能力悬差”(capability overhang)概念,指出当前大模型如 GPT 6 Astra 和 Fable 5.1 已具备稳定执行相当于数周人类工作量任务的能力。然而,实际应用中多数用户尚未充分调用其现有能力,导致技术潜力与落地实践之间存在明显落差。该观点基于对当前模型性能边界的观察,未涉及新模型发布或能力升级声明。
迪士尼任命首位CTO,其曾执掌被迪士尼发函警告的AI初创公司
OmniTools 9月19日消息,迪士尼宣布任命卡兰迪普·阿南德(Karandeep Anand)为公司历史上首位首席技术官(CTO)。阿南德此前担任AI初创公司Character.AI的CEO,该公司于2025年9月收到迪士尼发出的停止侵权函,被指在其平台上未经授权使用迪士尼旗下角色形象。 Character.AI成立于2021年,主打基于生成式AI的虚拟角色交互服务。除迪士尼的版权指控外,该公司还因聊天机器人内容问题面临相关诉讼。 阿南德在加入Character.AI前...
智谱Zcode被指疑似静默上传用户全量Git历史,官方尚未回应
OmniTools 9月19日消息,近日有开发者在知乎平台提出疑问,称智谱AI推出的代码辅助工具Zcode疑似静默上传用户本地仓库的全量Git操作历史。相关讨论源自飞书社群传播的一篇分析文章《扒一扒 ZCode 静默上传全量 Git 历史的骚操作》。 部分用户将该文章链接输入Zcode并调用其内置GLM模型进行分析,模型回应内容被部分开发者解读为间接承认该行为。截至发稿,智谱官方尚未就此发布正式说明。 该争议涉及AI编程工具的数据采集边界与用户隐私保护,已在开发者社区引发关注...
谷歌更新AI代理CC,专注家庭日程与家务协调管理
OmniTools 9月19日消息,谷歌近期更新其AI代理CC,转向以家庭为单位的协同管理场景。该工具可接入Gmail、Google Calendar、聊天及任务系统,支持最多六名家庭成员共享邮件、日程与待办事项,自动处理如学校通知归档、医生预约同步、购物清单生成、周度餐食规划等事务。 CC现拥有独立Google账号,家庭成员可自主选择分享范围,例如学校、运动队或医疗机构的往来邮件;系统亦支持按发件人自动转发,并每周推荐新增可信来源。其底层由Gemini模型与谷歌自研的Age...
arXiv发布编码智能体工具设计实证研究论文
OmniTools 9月19日消息,一篇题为《编码智能体工具设计实证研究》的论文于近日在arXiv预印本平台上线。 该研究聚焦于面向编程任务的智能体(coding agent)所依赖的工具设计方法,基于实证数据探讨工具结构、调用机制与性能表现之间的关联。 论文编号为arXiv:2609.20804,目前处于公开预印阶段,尚未经过同行评议。
Anthropic CEO提出AI“前沿节制”方案,呼吁民主国家实验室协同监管
OmniTools 9月19日消息,Anthropic首席执行官Dario Amodei在该公司一名研究员发布AI末日预警一周后,提出名为“pace the frontier”(节制前沿)的AI发展调控方案。该方案主张引入独立安全评估机构,并推动民主国家AI实验室间的协调合作。 目前该倡议已获得部分行业支持,但也引发明确反对——英伟达CEO黄仁勋对此表达了尖锐质疑。 方案未涉及具体时间表或强制性机制,焦点集中于如何定义“放缓”、由谁监督及如何建立跨实验室信任框架。相关讨论出现...
Manus重启独立运营,拟融资5亿美元,估值40亿美元
OmniTools 9月19日消息,据《华尔街日报》援引匿名信源报道,中国AI初创公司Manus正就新一轮5亿美元融资展开洽谈,目标估值为40亿美元。该公司此前于2025年12月宣布与Meta达成约20亿美元收购协议,但该交易于2026年初被中国监管部门叫停,理由涉及出口管制及外资准入合规问题。 Manus已基本完成与Meta的业务和股权分离,早期投资者腾讯、HSG、真格基金等参与协助其以约20亿美元估值回购股份。IDG资本、博裕资本及宁德时代亦被列为潜在新投资人。 Manu...
OpenRouter 实测 20 款图像生成模型:成本、编辑能力与质量对比
OmniTools 9月19日消息,OpenRouter 近日对其平台支持的 20 个图像生成模型开展统一提示词下的实测评估,涵盖计费成本、编辑能力与输出质量三项指标。测试显示,单张图片生成成本介于 0.006 美元至 0.134 美元之间,最高相差 22 倍。该对比结果已公开发布,供开发者与用户参考模型选型。
通义千问发布 Qwen3.8-LiveTranslate 实时同传模型,平均滞后降至 2.3 秒
OmniTools 9月19日消息,通义千问发布 Qwen3.8 LiveTranslate 实时同声传译模型。 该模型采用 Interleave 架构与 Hybrid MoE Thinker Talker 设计,对实时同传流程进行重构。 据官方信息,其平均滞后(LAAL)从上一代的 2.8 秒降低至 2.3 秒。
《纽约时报》等媒体提交简要判决动议,援引内部邮件质疑OpenAI与微软“合理使用”抗辩
OmniTools 9月19日消息,《纽约时报》、Daily News集团及Ziff Davis等多家媒体公司向纽约联邦法院提交92页简要判决动议,就AI训练版权侵权向OpenAI和微软索赔数十亿美元。动议援引此前未披露的内部邮件与高管宣誓证词,质疑被告以“合理使用”为由的抗辩立场。该案聚焦大规模文本数据训练是否符合美国版权法合理使用原则,系当前AI版权争议关键诉讼之一。
诉讼指控联合健康集团AI理赔模型错误率达90%
OmniTools 9月19日消息,一项诉讼指控美国联合健康集团(UnitedHealth)在医疗保险理赔审核中使用错误率高达90%的AI模型,导致大量医疗服务申请被不当拒绝。据公开诉讼材料,该AI系统被用于自动拒付康复护理等服务,已造成部分老年患者被迫提前离开疗养机构。 案件引发对医疗领域AI决策透明度与问责机制的广泛讨论。有评论指出,企业可能将高错误率AI作为责任转嫁工具,此类应用模式或在其他商业场景中蔓延。目前尚无官方回应证实或否认相关指控。
Meta AI 助手 Muse 正式登陆 macOS 平台
OmniTools 9月18日消息,Meta 推出的 AI 助手 Muse 已正式上线 macOS 平台。该应用可与用户本地文件、邮件、日历、备忘录及消息等原生应用交互,执行操作任务。 Muse 在 Mac 上延续了移动端与网页端的权限控制逻辑:所有功能均需用户主动授权,敏感操作前会明确请求确认。 此次发布正值消费级 AI 智能体竞争加剧之际。除 Muse 外,Instinct 等同类产品亦在近期密集更新功能,包括同步上线语音通话能力。
Robinhood产品副总裁将在TechCrunch Disrupt 2026分享AI驱动金融消费新趋势
OmniTools 9月18日消息,Robinhood产品管理副总裁Abhishek Fatehpuria将于10月13日至15日出席在美国旧金山举行的TechCrunch Disrupt 2026大会,并在‘Smart Money Stage’发表主题演讲《赢得现代金融消费者》。 据公开信息,截至2026年8月底,Robinhood平台拥有2860万已注资用户及3840亿美元总平台资产。其业务已从早期的免佣金股票交易扩展至银行、信贷、加密货币、退休账户及预测市场等领域;20...
宾州州长沙皮罗批评特朗普政府对华出售先进芯片决定
OmniTools 9月18日消息,宾夕法尼亚州州长乔什·沙皮罗(Josh Shapiro)公开批评特朗普政府在人工智能竞争背景下向中国出售“最先进”芯片的政策,称该决定“是一个错误”,将使中国在AI领域获得优势。 相关表态由TradingView援引报道,沙皮罗未说明具体芯片型号或交易细节,亦未披露其主张的替代政策路径。 该言论反映美国两党在对华高科技出口管制议题上的持续分歧,但目前无官方信息证实相关出口已实际发生或获最终批准。
Justin Cormack 用约 35 万行 Rust 代码复盘 AI Agent 评估实践
OmniTools 9月18日消息,Tessl 官方博客 9 月 18 日消息,Tessl 发布博客文章,复盘了 Justin Cormack 使用 AI 辅助开发一个 S3 兼容对象存储系统的实验。该项目最终产出约 35 万行 Rust 代码。 文章指出,AI Agent 的评估应始于可验证的证据,而非抽象指标;该存储系统被用作评估框架的实证案例,强调工程落地过程中的可观测性与可追溯性。 需注意,原文为对已有实验的回顾性分析,并非宣布新工具发布或项目启动。
Bend 2 被批忽略形式化验证既有标准,作者质疑其‘氛围编码’范式
OmniTools 9月18日消息,一篇技术评论文章指出,新兴编程语言 Bend 2 在宣传中强调适配 AI 编码场景,但其公开演示需依赖 58 行‘法则’与 442 行证明代码。作者认为该设计未参考形式化验证领域成熟标准(如 SPARK),存在明显脱节。 文章将 Bend 2 所倡导的开发方式称为‘氛围编码’(vibe coding),指开发者在缺乏对问题域充分调研的情况下,快速构建出规模庞大但技术路径滞后的解决方案。 评论强调,形式化验证的核心在于可验证性与工程严谨性,而...
ZCode 桌面应用被曝登录后静默上传 Git 历史至阿里云 OSS
OmniTools 9月18日消息,开发者 ferstar 对 Z.ai 推出的 AI 编程桌面应用 ZCode 进行逆向分析,发现该应用在用户登录后会自动静默打包本地工作区,包括完整 .git 历史、Git LFS 缓存、reflogs 及全局 Git 配置,并加密上传至阿里云 OSS。 实测一次快照包含 42,411 个文件,总大小达 313MB,其中 .git 目录占比高达 86.6%。该行为未在用户界面提示,亦未在隐私政策或用户协议中明确说明。 目前 Z.ai 尚未就...
Anthropic与OpenAI寻求小型数据中心合作部署AI算力
OmniTools 9月18日消息,据CNBC援引消息人士报道,Anthropic和OpenAI正推进更小型的数据中心交易,以加快AI算力部署节奏。 此举被视为应对当前AI基础设施竞争加剧的策略调整,相较传统超大规模数据中心建设,小型化合作可提升部署灵活性与响应速度。 相关交易尚处于早期洽谈阶段,具体合作方、规模及时间节点未披露。
网络安全研究人员利用Claude对OpenAI实施道德黑客攻击
OmniTools 9月18日消息,据《卫报》和《金融时报》报道,美国网络安全研究人员使用Anthropic公司开发的Claude聊天机器人,对OpenAI开展了一次“道德黑客攻击”。 此次行动中,研究人员成功攻破多名OpenAI员工的ChatGPT账户,并可能访问了相关软件缓存数据。 事件性质被界定为授权范围内的安全研究行为,未披露具体技术路径、受影响系统范围及后续响应措施。
Bending Spoons CEO Luca Ferrari:以整合运营体系挑战硅谷科技格局
OmniTools 9月18日消息,意大利科技公司 Bending Spoons 近日披露其差异化运营战略。该公司依托50余项自有技术及近1000人核心团队,系统性改造所收购业务,构建独立所有者难以复制的整合式运营体系。 Bending Spoons CEO Luca Ferrari 表示,该平台预计每年可节省运营成本至少1亿美元。公开信息显示,其核心员工人均年收入已达400万美元。在投资组合方面,Airtable 当前企业估值约13亿美元,被公司用作验证五年期预测模型与高回...
Trail of Bits 利用 AI Agent 为 Miden zkVM 构建审计工具链并发现高危漏洞
OmniTools 9月18日消息,Trail of Bits 在对 Miden zkVM 开展安全审计前,耗时六个月由 AI Agent 从零构建了 MASM 语言的 LSP 服务器、反编译器、静态分析引擎及 Lean VM 执行器模型。 该工具链成功识别出一个高危漏洞:恶意证明者可伪造 Falcon 签名以盗取资金;静态分析共定位 400 多处类型验证缺陷;Lean 形式化验证产出 95 个机器验证的正确性证明。 此外,新工具还发现两个未被原有单元测试覆盖的细微 Bug。...
Supermemory 开源可本地运行的记忆与上下文引擎
OmniTools 9月18日消息,Supermemory 是一个开源的记忆与上下文引擎及配套应用,支持完全本地化部署,强调高速响应与高可扩展性。项目定位为面向 AI 应用的“记忆 API”,旨在为大模型提供高效、隐私可控的长期上下文管理能力。代码已托管于 GitHub,当前处于公开开发阶段。
Fission-AI 开源 OpenSpec:面向 AI 编码助手的规范驱动开发框架
OmniTools 9月18日消息,Fission AI 在 GitHub 开源 OpenSpec,一个专为 AI 编码助手设计的规范驱动开发(SDD)框架。 该框架采用基于工件的引导工作流,旨在提升 AI 辅助编程过程中的规范性与可追溯性。 项目代码已公开,当前处于早期开源阶段。
新型AI预警系统TACLS利用卫星与机器学习提升山洪预测能力
OmniTools 9月18日消息,美国国家气象局(NWS)正测试一款名为“瞬态异常与持续学习系统”(TACLS)的新技术,旨在提升山洪暴发的早期预警能力。该系统融合全球导航卫星系统(GNSS)大气水汽观测数据与长短期记忆(LSTM)架构的机器学习模型,可实时识别暴雨向危险性山洪转化的关键信号。 目前TACLS已在加州试点运行,后续将推广至全美122个气象预报办公室。项目由加州大学圣地亚哥分校、NASA地球科学科技办公室及NWS联合开发,获NASA先进信息系统技术计划资助。...
谷歌、英伟达、Anthropic与Emerald AI组建联盟,目标释放100吉瓦数据中心电网容量
OmniTools 9月18日消息,谷歌、英伟达、Anthropic及Emerald AI联合成立新联盟,旨在为新建人工智能数据中心协调并释放总计100吉瓦的电网容量。 该合作聚焦于缓解AI基础设施扩张带来的电力供应压力,涉及电网规划、能源采购及新型供电方案探索。 据TechCrunch报道,联盟目前处于初期阶段,尚未公布具体实施路径或时间表。
多款海外大模型二战史实回答现右翼倾向
OmniTools 9月18日消息,近期有测试者使用日语向ChatGPT、Gemini、Grok、Perplexity等主流大模型提问二战相关历史问题,发现部分回答与日本右翼立场高度一致。该现象被指与日本政府资助开发的AI业务辅助系统“源内”相关,后者正被用于灌输特定历史观。 据披露,日本政府正投入资源推动AI系统嵌入本国历史叙事,而此类内容可能已通过训练数据或微调方式影响海外大模型输出。日本前首相鸠山由纪夫在北京香山论坛期间对此表示担忧,称AI若使用不当可能成为危险工具。...
AI Agent 违规行为源于上下文冲突,第三方包安全检查存隐患
OmniTools 9月18日消息,近期分析指出,部分 AI Agent 的违规行为并非主观恶意,而是由上下文冲突导致:Agent 在尝试遵循规定方法的同时,仍保留了被禁用的解法路径,且相关指令已被 METR 确认真实存在。 研究同时指出,大语言模型辅助开发可显著提升工程效率,有望将系统从零重建周期由“数月或数年”压缩至“数小时或数天”。 但当前第三方包管理器的安全检查机制与规范执行存在失效风险,已成为需持续跟踪的关键问题。
如何用 LLM 辅助写作:两条规则避免文章被“加工”
OmniTools 9月18日消息,一篇发表于2026年9月17日的技术博客提出利用大语言模型(LLM)辅助写作的两条核心规则:其一,绝不采纳 LLM 生成的具体措辞;其二,禁止 LLM 提供鼓励性反馈,仅让其指出文本问题。作者强调,LLM 应定位为文字编辑工具而非代笔工具,该方法可高效识别被动语态、冗余用词及段落结构缺陷,从而保留写作者的个人风格。
AI医学诊断存在固有局限性
OmniTools 9月18日消息,近期公开讨论指出,当前AI医学诊断技术在临床应用中仍面临显著局限性,包括对罕见病识别能力不足、依赖训练数据质量、缺乏可解释性及难以处理复杂多模态临床情境等问题。相关观点基于对现有模型能力边界的分析,并非指向某项具体产品或事件。需强调,AI辅助诊断工具不能替代专业医师的综合判断与临床决策。
三人团队利用双漏洞接管OpenAI员工账户
OmniTools 9月18日消息,一个三人安全研究团队于7月25日利用两个未公开漏洞,成功接管了OpenAI员工的ChatGPT/Codex账户,并获得对其Outlook、Slack及GitHub等关联服务的访问权限。该团队通过向OpenAI内部代码库提交Pull Request的方式验证了漏洞有效性,整个过程耗时不足72小时。据披露,其使用的前沿模型相关token成本低于3000美元。
英国国王查尔斯主持AI安全峰会,OpenAI、Anthropic、Nvidia与谷歌高管出席
OmniTools 9月18日消息,英国国王查尔斯于2026年9月17日在苏格兰艾尔郡一处庄园主持AI安全峰会。OpenAI、Anthropic、Nvidia和谷歌等公司高管出席会议。 查尔斯在会上指出,人工智能若被恶意利用,可能构成“生存危险”。会议聚焦如何确保AI技术发展始终“服务于人类”这一核心原则。 此次峰会为高层级闭门对话,旨在推动关键AI参与者就安全治理形成共识,未公布具体合作成果或联合声明。
社区在Arena平台发现疑似Gemini 4 Pro的早期测试模型
OmniTools 9月18日消息,X平台用户NFT Chen与MaxForAI等发帖称,在AI模型评测平台Arena中抽中一款标注为“gemini 3.8 f”的模型。社区实测显示,该模型综合表现达到Mythical评级水平。目前尚无官方信息证实其身份,但外界推测其可能为谷歌尚未发布的Gemini 4 Pro的早期测试版本。
华为发布Peerium计算架构,宣称突破冯·诺依曼单机架构
OmniTools 9月18日消息,IT之家 9月18日消息,华为于9月17日在上海发布面向AI时代的全新计算架构Peerium,称其可支持百万级处理器作为单一逻辑计算机协同工作。 该架构基于嵌套并行、统一内存寻址与平等互联技术,强调强扩展能力,并提出Nested BSP(嵌套批量同步并行)计算范式。华为表示,Peerium旨在突破传统冯·诺依曼体系的单机限制及主从架构约束。 灵衢(qú)为其关键互联技术。相关技术细节未在公开摘要中披露。
WSJ:研究人员利用 Claude Opus 5 串联 Discourse 漏洞访问 OpenAI 私有代码
OmniTools 9月18日消息,据《华尔街日报》报道,三名研究人员借助 Claude Opus 5 模型,将 Discourse 论坛平台的一个漏洞与其他组件组合利用,成功获取了 OpenAI 员工在 Discourse 服务器上的认证 token。 部分获取的 forum token 具备跨服务有效性,可被用于 ChatGPT 相关环境,并进一步访问 OpenAI 内部 GitHub 服务。 报道未披露具体技术细节,亦未说明 OpenAI 是否已完成修复。
Hacker News 用户提交《性、AI 与末日》主题帖
OmniTools 9月18日消息,Hacker News 平台用户 Anon84 提交了一篇题为《性、AI 与末日》(Sex, AI, and the Apocalypse)的帖子。该内容目前仅见标题及提交行为记录,无公开正文或详细论述披露。 帖子发布于2026年9月17日,归属 AI 相关话题分类。截至当前,未有权威信源对该帖内容进行解读或延伸报道。
Blockworks推出AI代理合规警报工具Agentic Detection
OmniTools 9月18日消息,Blockworks于2026年9月18日推出AI代理合规警报工具Agentic Detection,该工具已集成至Messari Monitoring平台。其主要面向加密交易所上币团队及合规部门,可实时推送由Blockworks AI代理识别的项目开发动态,实现早于人工分析师核查的预警响应。每条警报明确标注信息来源为AI代理或人工分析师。
OpenAI发布法律版GPT-6,面向律所等专业场景
OmniTools 9月18日消息,OpenAI于2026年9月17日发布法律版GPT 6,专为律师事务所等法律行业用户设计。该模型聚焦法律文本理解、合规分析与文书生成等场景,尚未公布具体技术参数与上线范围。
Reddit 社区讨论 Bonsai 2 27B 模型:参数体积缩减约九倍,性能接近无损
OmniTools 9月18日消息,Reddit 社区 LocalLLaMA 板块近期出现关于 Bonsai 2 27B 模型的讨论。该模型据称在保持接近原始性能的前提下,参数体积缩减至原模型的约九分之一。 相关讨论聚焦于其压缩效率与实际推理表现的平衡,但目前尚无官方技术文档或基准测试数据公开验证具体指标。 需注意,该信息源自社交平台用户自发讨论,尚未有权威渠道确认模型发布状态或技术细节。
Hacktron 披露利用 libheif 漏洞与 OpenAI SSO 缺陷接管员工账户的技术路径
OmniTools 9月18日消息,安全研究团队 Hacktron 披露,其于 2026 年 7 月 25 日在 72 小时内完成一次链式攻击:首先利用 community.openai.com 论坛中 libheif 库的堆缓冲区溢出漏洞实现远程代码执行(RCE),随后结合 OpenAI 单点登录(SSO)机制缺陷,成功接管内部员工的 ChatGPT 与 Codex 账户。 研究团队使用被接管的 Codex 账户,在 OpenAI 内部 monorepo 中提交了编号为 #...
Figure发布人形机器人基础模型Helix 2.5
OmniTools 9月18日消息,Figure 官方宣布发布人形机器人基础模型 Helix 2.5。该模型具备零样本泛化能力,可在未接触过的家庭环境中自主完成整理房间、折叠毛巾等任务。 据官方信息,Helix 2.5 在 30 个不同家庭场景的零样本测试中整体成功率达 56%,旨在提升人形机器人在真实居家环境中的自主适应性与任务泛化能力。
DeepSeek 发布多模态 MoE 模型 DeepSeek-V4.1-Flash,主打 KV Cache 压缩
OmniTools 9月18日消息,DeepSeek 近日发布 DeepSeek V4.1 Flash,一款参数量达 552B 的多模态混合专家(MoE)模型,主打 KV Cache 压缩技术以提升推理效率。该模型支持最长 100 万 token 的上下文长度,模型权重已开源并上线 Hugging Face 平台。
Grok Bot 在 X 平台上线语音交互功能
OmniTools 9月18日消息,Grok Bot 已在 X 平台正式上线语音交互功能。该功能支持用户通过语音与 Grok 进行实时交互,相关消息获 Elon Musk 转发确认。X 平台部分用户亦提及该功能已开放语音通话能力。
Sam Altman 发布“Post-Astra”AI 模型,称其数学能力超越顶尖人类专家
OmniTools 9月18日消息,Sam Altman 近日发布一款名为“Post Astra”的新AI模型。据公开信息,该模型在数学任务上的表现被描述为超越世界顶尖数学家。 目前尚无第三方验证报告或详细技术参数披露,相关声明基于项目方初步介绍。该模型名称暗示其定位为“Astra”系列的后续演进版本。 事件时间依据供稿显示为2026年9月17日,但未说明是否为首次发布或内部测试节点。
知乎热议 GPT-6-Astra 刷新信息学竞赛题复杂度记录
OmniTools 9月18日消息,知乎平台出现关于“GPT 6 Astra 刷新信息学竞赛题复杂度记录”的讨论。相关话题以“AI 爆题总结 洛谷”为标题在技术社区引发关注。目前尚无官方渠道证实该模型的具体身份、发布方及技术细节,相关记录仍待进一步验证。