AIDC
DC AI 热点

全部 AI 动态

9月25日2026-09-25
量子位✦ 精选AI 评分 68/10014:20

Kimi推出浏览器插件功能:支持将网页操作快速转化为Agent技能

在行业聚焦代码生成与编程能力的背景下,Kimi转向浏览器插件生态布局,推出可将网页操作直接转化为Agent“Skill”的交互功能,进一步拓展了AI智能体在实际网络环境中的操作边界。由于输入素材提供的信息较少,具体的产品技术实现方案、核心交互流程及上线细节等尚需后续进一步补充与观察。

阅读原文 ↗推荐理由:关注Kimi在浏览器操作与Agent技能转化上的新尝试,反映出智能体落地应用场景的演进方向。# Kimi# 智能体# 浏览器插件# 月之暗面
AITNT · AI头条(网页)✦ 精选AI 评分 78/10010:11

GLM-5.3-Flash融合Kimi与DeepSeek注意力架构,大模型设计走向混合组合

GLM-5.3-Flash在同一模型架构中融合了Kimi的KDA线性注意力与DeepSeek的KPool-DSA稀疏注意力机制。这一架构创新表明,大模型底层Attention机制正经历演进,从以往不同机构各自独立押注的竞争性技术路线,转变为可在单一模型内按需分工、协同组合的模块化设计选项,为长文本处理与高效推理提供了新的工程实践范式。

阅读原文 ↗推荐理由:体现了大模型底层注意力机制从单一路线竞争向异构融合设计演进的重要技术趋势。# GLM# DeepSeek# Kimi# 注意力机制# 模型架构
Cerebras 官方博客(网页)✦ 精选AI 评分 75/100收录 07:49

Cerebras运行Kimi K2.6实测:推理速度达Gemini Flash五倍

根据性能对比测试,在 Cerebras 算力平台上运行的开源模型 Kimi K2.6,在智能水平上可比肩 Google Gemini 3.5 Flash。依托 Cerebras 晶圆级硬件加速架构,Kimi K2.6 的推理输出生成速度达到了后者的 5 倍,且具备更低的访问延迟和开源权重模型的部署灵活性。

阅读原文 ↗推荐理由:展现了 Cerebras 专用算力芯片在大模型超高速推理场景下的显著加速与低延迟优势。# Cerebras# Kimi# Gemini# 芯片# 大模型
Cerebras 官方博客(网页)✦ 精选AI 评分 78/100收录 07:49

Cerebras为企业提供万亿参数推理支持,Kimi K2.6实测达981 token/秒

Cerebras宣布在其企业级测试中支持Kimi K2.6超大模型的极速推理,实测输出速度达到每秒981个Token。该方案旨在通过其专有算力芯片解决大模型推理的吞吐与延迟瓶颈,支持实时智能体编程及其他万亿参数级别的复杂AI工作负载,加速超大规模模型在企业级生产环境的高性能落地。

阅读原文 ↗推荐理由:Cerebras展现了其晶圆级芯片在超大参数模型上的极端推理吞吐表现,对低延迟企业级算力架构极具参考价值。# Cerebras# Kimi# 芯片# 大模型# 算力
9月24日2026-09-24
AITNT · AI头条(网页)✦ 精选AI 评分 75/10013:21

亚马逊云科技Bedrock托管Kimi K3,国产开源模型切入硅谷云生态

9月18日,亚马逊云科技宣布其大模型服务平台Bedrock正式托管国产开源模型Kimi K3。尽管国产模型上线海外云平台此前已有先例,但作为开源模型直接吸引美国主流云厂商采购付费尚属罕见。此举标志着中国开源大模型的技术实力与应用价值进一步获得硅谷云巨头的商业认可,也展现了海外云厂商围绕优质开源模型开展商业化合作的新动向。

阅读原文 ↗推荐理由:展现了国产开源大模型成功切入国际主流云服务商商业生态的标志性进展。# Kimi# 亚马逊云科技# Bedrock# 开源# 投融资