月之暗面正式开源 Kimi K3 完整权重:全球首个 3 万亿参数级开源大模型
月之暗面正式开源 Kimi K3 完整模型权重,为全球首个落地的 3 万亿参数级开源大模型。Kimi K3 于 7/16 发布、7/27 放出完整权重,上线即爆火;据 Artificial Analysis 数据,K3 在保持第一梯队性能的同时,每项任务平均成本大幅低于海外前沿模型。
查看原文月之暗面正式开源 Kimi K3 完整模型权重,为全球首个落地的 3 万亿参数级开源大模型。Kimi K3 于 7/16 发布、7/27 放出完整权重,上线即爆火;据 Artificial Analysis 数据,K3 在保持第一梯队性能的同时,每项任务平均成本大幅低于海外前沿模型。
查看原文7月31日,MiniMax 正式发布新一代多模态生成模型 MiniMax H3,并宣布近期将开源相关能力。H3 是国产大模型 7/31「集体亮相」的核心产品之一,主打全模态生成。
查看原文DeepSeek V4-Flash 新版本(0731)上线,主打「Frontier agent intelligence at Flash prices」——以极低成本提供前沿智能体能力,登上 Product Hunt 8/1 日榜第二。
查看原文截至 2026 年 8 月 3 日,Anthropic 的 Claude Mythos 5 以 82.9 分在 BenchLM 排行榜(BenchAlign v5 评分)登顶,紧随其后的是 Claude Fable 5。
查看原文8月7日消息,智谱新一代大模型即将发布,高盛同步上调其收入预期 35%。此前智谱 GLM-5.2 已在 SWE-bench Pro 编程基准中实现突破,代码能力跻身全球第一梯队;截至 7 月智谱 ARR 已突破 10 亿美元。
查看原文据 AI 内幕记者爆料,即使面临政府审查,约 10 万亿参数的 GPT-6(Astra)仍将于 8 月发布,参数规模约为 GPT-4 的五倍以上;年底还将推出代号 Doug 的模型。注:以上为爆料信息,尚未获 OpenAI 官方确认。
查看原文Claude Code 本月新增自托管环境、跨会话消息传递,以及新的插件与沙箱控制能力,同时改进了 Remote Control 与粘贴体验。
查看原文Coldtea 是一款 agentic IDE:编码智能体负责构建、视觉 QA 智能体捕捉回归、AI 监控盯守生产环境,让团队以智能体速度交付而不破坏稳定性。以 519 分登顶 8/7 日榜。
查看原文Soloop 为独立创始人提供 AI CEO(规划管理)、AI CTO(构建执行)与 AI CMO(获客销售),以「审批优先」方式保留创始人决策权,从想法直达营收。
查看原文截至 7 月 31 日,全球最大模型聚合平台 OpenRouter 公布的 2026 年 7 月月度大语言模型调用量排行榜显示,前六名全部是中国大模型,全球 AI 竞技场格局正发生深刻变化。
查看原文月之暗面 Kimi 已完成 F 轮融资,融资金额超 35 亿美元,投后估值涨至 350 亿美元。因超目标金额 3 倍多,本轮融资提前关闭,原定 8 月开始的 G 轮(Pre-IPO 轮)已提前启动。
查看原文字节跳动对飞书、火山引擎、豆包三大 AI 相关业务线进行组织架构调整,进一步聚焦 AI 产品矩阵协同。
查看原文Drone-Bench 将任务分解为 3D 地图重建、定位、导航、目标检测与跟随五个子任务,并通过软件复现快速评估。实验表明该任务链难度足以区分不同智能水平的模型,揭示 AI 在物理世界操控能力上的进步轨迹。
查看原文Apple 研究发现 LLM 在长程执行中少数「困难」步骤上的持续错误会变得不可逆转,提出 Lookahead-Enhanced Atomic Decomposition(LEAD),通过短程未来验证与聚合打破瓶颈,已在受控算法谜题上验证有效性。
查看原文智谱 GLM-5.2 在 SWE-bench Pro 编程基准测试中实现突破,代码能力跻身全球第一梯队;Kimi K3 的长文本处理和数据解析能力得到海外开发者广泛验证;阿里 Qwen3.8 系列持续加码——八周内国产大模型密集五连发,部分硅谷企业已开始悄悄更换模型底座。
查看原文2026 年 7 月 31 日,多家中国 AI 公司罕见地集体发布新产品(含 MiniMax H3 等),标志着国产大模型竞争从「模型能力」转向「交付能力」的新阶段。
查看原文Claude-thermos 通过本地反向代理监控 Claude Code 会话,主智能体空闲超 5 分钟时自动发送预热请求刷新提示缓存。实测约 185 次本地会话中,缓存过期导致的重新编码占账单约 22%。
查看原文GigaToken 在 AMD EPYC 9565 双路 144 核 CPU 上对 GPT-2 分词速度达 24.53 GB/s,比 HuggingFace Tokenizers 快约 989 倍、比 tiktoken 快约 681 倍,可无缝替代。
查看原文