郭震 AI公众号:郭震AI

实时 AI 消息

法国初创公司Kog:GPU并非不适合智能体推理工作负载

法国初创公司Kog认为,GPU不适合智能体工作负载的说法可能是一种误解,公司正致力于从GPU中榨取更多推理性能。TechCrunch的报道显示,这家初创公司选择在接近硬件的层面深耕优化,为智能体时代的推理基础设施提供了一条务实路线。

发布时间

TechCrunch的一篇报道介绍了法国初创公司Kog的最新方向:这家公司正在更深入地挖掘GPU的推理潜力,并挑战一个流行的观点——GPU并不适合智能体(agentic)工作负载。

Kog认为,GPU不适合智能体工作流的说法可能是一种误解。随着AI智能体在真实任务中频繁调用模型,推理环节的形态正在发生变化,而Kog押注GPU仍能通过底层优化释放更多价值。

报道没有给出具体的产品名称或性能数字,更多是描绘公司的技术路线与判断。对于一家处于早期阶段的初创公司来说,这种往深处走的定位意味着其优化工作发生在接近硬件的层面。

这一方向与当前行业趋势吻合:智能体应用爆发后,推理负载变得更加动态和碎片化,如何提高GPU利用率成为云厂商与基础设施公司共同关注的问题。

值得关注的是,如果Kog的路线成立,它可能为智能体时代的推理基础设施提供一条不同于专用芯片叙事的路径,即继续压榨通用GPU的潜力。

接下来可以留意Kog是否会公布更多技术细节、基准测试结果或融资信息,以验证其GPU推理优化方案的实际效果。

为什么重要

Kog对GPU推理潜力的押注代表了一种务实路线:在智能体工作负载爆发之际,先通过底层优化释放现有硬件的价值,而非急于更换算力方案。

微博邮件

KogGPUInference
返回AI日报

附近消息

全部

08/14 23:00

Qwen开源多模态模型Qwen3.8-27B上架Hugging Face,同步推出FP8量化版

Qwen团队在Hugging Face官方模型库上架了全新的多模态模型Qwen3.8-27B,该模型采用image-text-to-text架构,支持图像与文本的跨模态对话,并以Apache 2.0许可证开源。同一天,团队还发布了基于该模型的FP8量化版本Qwen3.8-27B-FP8,进一步降低部署门槛。

08/14 22:05

新预测称美国部分地区天然气价格或涨至三倍,超大规模数据中心成本承压

TechCrunch援引的一项新预测指出,美国部分地区天然气价格可能涨至目前的三倍,这将让押注天然气为AI数据中心供电的超大规模云厂商背上巨额电费账单。如果预测成真,能源成本将成为AI算力扩张中最棘手的变量之一。

08/14 23:43

Meta 发布开放权重模型 Glimmer,扎克伯格宣称 AI 应“为每个人服务”

本周 Meta 发布了开放权重模型 Glimmer,任何人都可以下载并在自己的硬件上运行,而更强大的 Muse Spark 仍被锁定在 Meta 自家 API 之后。随发布一同出现的还有扎克伯格主张 AI“为每个人服务”的公开信,TechCrunch 的 Equity 节目对这一表态的诚意提出了质疑。

08/14 18:25

太初元碁助力国家级“AI+教育”大赛 “AI+加速卡模型适配赛道”开启招募

由中国教育技术协会主办的“AI+教育”创新应用技能大赛正在进行中,战略合作伙伴太初元碁承办的大学生AI创新创业“AI+加速卡模型适配赛道”正式开启招募。该赛道以国产算力为底座,参赛队伍可免费使用太初AI加速卡云服务器资源完成模型适配优化,报名及代码提交截止至2026年10月15日。