Google 发布 Gemini 4 Argon:跳过 3.5 Pro,百万 token 输出,但还用不上
Google 宣布 Gemini 4 Argon:DeepSWE 77.9% 超 GPT-6 Astra,输出 100 万 token,分阶段发布,暂无定价。
「模型推理」标签聚合的各栏目已发布内容,按本站发布日期从新到旧排列。
5 条
Google 宣布 Gemini 4 Argon:DeepSWE 77.9% 超 GPT-6 Astra,输出 100 万 token,分阶段发布,暂无定价。
DeepSeek 9 月 30 日开源六个昇腾基础组件,覆盖矩阵计算、通信与算子编译,称 V4 系列 NVIDIA 算子均有昇腾实现。
OpenAI 把托管式智能体运行在 AWS 上,ChatGPT 进入 Slack 与 Teams 无需单独许可证,500 美元 Pro 档同日公布。
据量子位报道,vLLM 原班人马创办的 Inferact 为谷歌 TPU 写了 megakernel 推理内核,配合 DeepSeek 的 DSpark 推测解码,在 16 块 TPU v7 上跑 Kimi K3 达到每秒 709 token,同等条件下 GB200 为 452 token,代码已开源。
提供开源高级推理大模型 DeepSeek R1 在线对话与 WebGPU 本地浏览器推理加速服务。