Groq

Groq

基于自研LPU引擎的高性能AI推理平台,为开发者提供极速、低成本的模型推理服务与API。

访问官网

编辑点评

"Groq凭借自研LPU芯片在AI推理赛道脱颖而出,以极速响应、线性定价与OpenAI兼容性吸引开发者,是追求性能、成本与工程效率平衡的优质选择。"

优势

  • 自研LPU架构带来显著的速度与能效优势
  • API高度兼容OpenAI,迁移成本极低
  • 提供批量处理API,降低大规模异步任务成本

局限

  • 免费版或试用版通常带有额度与功能限制,持续高频使用往往需要升级付费方案

Q&A

快速了解这个工具的常见问题与答案

Q
这个工具是否提供免费版?
Answer

是的,Groq提供免费API密钥供开发者测试使用;所有模型与功能均按实际用量计费,无功能限制。

Q
这个工具如何收费?
Answer

采用线性、可预测的按量计费模式,根据输入/输出Token数量或音频处理时长计费;支持Prompt缓存折扣,缓存命中时输入Token费用减半,且无隐藏费用或闲置基础设施成本。

Q
这个工具是否支持API?
Answer

完全支持,提供与OpenAI兼容的RESTful API,开发者可通过修改少量代码快速接入。

Q
使用这个工具需要技术背景吗?
Answer

需要基础编程能力以调用API,但平台提供详细文档与示例代码,降低集成门槛。

工具介绍

产品简介

Groq是一家专注于人工智能推理加速的硬件与软件平台。通过自研的LPU(Language Processing Unit)推理引擎,Groq为开发者提供云端(GroqCloud™)与本地(GroqRack™)部署解决方案,支持Llama、Qwen、Whisper等主流开源模型,致力于以毫秒级延迟和可预测成本实现高效AI推理。

核心功能

  • 自研LPU架构带来显著的速度与能效优势
  • API高度兼容OpenAI,迁移成本极低
  • 提供批量处理API,降低大规模异步任务成本
  • 覆盖开发与编程相关需求
  • 覆盖自动化与智能体相关需求

适用场景

  • 应用开发
  • 编码辅助
  • 流程自动化

适合谁用

  • 开发者
  • 技术团队
  • 需要集成 AI 能力的产品团队

核心能力

主能力
开发与编程
次要能力
自动化与智能体

适用场景

应用开发
编码辅助
流程自动化
价格与版本
Subscription
访问方式
Web AppAPI
支持语言
English

产品动态

查看官方发布和相关报道,了解这个产品的最新进展。

相关报道

更多
2026年6月28日
开源工具 Wayfinder Router 发布:实现本地与托管 LLM 的确定性查询路由

OmniTools 6月29日消息,开源项目 Wayfinder Router 近日发布,旨在实现本地与托管大语言模型之间的确定性查询路由。该工具通过分析提示词的结构特征(如长度、标题、列表、代码)进行微秒级路由决策,全程离线运行,无需调用额外模型。 默认仅启用结构分析,词汇线索(如“证明”“数学”“硬约束”等)因盲测中泛化能力不足而默认关闭。相比依赖模型调用的路由方案(如 RouteLLM、NotDiamond),Wayfinder Router 可有效规避延迟、成本及输出...

2026年6月22日
AI芯片公司Groq确认完成6.5亿美元融资,转向“新云”业务并重组高管团队

OmniTools 6月23日消息,AI推理芯片制造商Groq正式确认完成6.5亿美元新一轮融资。此次融资发生在Nvidia于2025年12月与Groq达成非独家技术授权协议并吸纳其核心创始团队约六个月后。 根据披露信息,Nvidia此前支付约20亿美元获得Groq语言处理单元(LPU)技术授权,并聘请了Groq联合创始人兼CEO Jonathan Ross及总裁Sunny Madra等关键人员。原高管Doug Wightman留任并接任CEO。Nvidia随后在2026年3...

2026年6月9日
贾斯汀·欧内斯特通过SPV模式向Anthropic、SpaceX等公司投资近4亿美元

OmniTools 6月10日消息,据TechCrunch 6月9日报道,Sabertooth VC创始人贾斯汀·欧内斯特(Justin Ernest)未设立传统风投基金,而是依托约30家中小型机构投资者组成的LP网络,通过特殊目的载体(SPV)形式,在过去12个月内向Anthropic、Anduril、Databricks、PsiQuantum和SpaceX等10家高成长性科技公司投资近4亿美元。 其操作模式为:在企业官方融资轮次中获取股票配额,再以单项目SPV方式向LP提...

2026年6月8日
小米 MiMo-V2.5-Pro-UltraSpeed 实现单节点千 token/s 推理速度

OmniTools 6月8日消息,小米 MiMo 联合 TileRT AI 发布 MiMo V2.5 Pro UltraSpeed 模型,首次在单台标准 8 GPGPU 节点上实现 1 万亿参数 MoE 模型超 1000 tokens/s 的推理输出速度,无需依赖 Cerebras 或 Groq 等专用硬件方案。 该模型提供限时免费聊天体验,UltraSpeed API 定价为普通版本的 3 倍,实测输出体验提升约 10 倍。申请开放时间为 6 月 8 日至 23 日(PDT...