传 GPT-6(Astra)8 月发布:OpenAI 曾紧急暂停,仍计划本月推出
据 AI 内幕记者 ChrisGPT 爆料,OpenAI 在 8/9 前后紧急暂停了代号 Astra 的 GPT-6 发布,但约 10 万亿参数(约为 GPT-4 的五倍)的 GPT-6 仍计划于 8 月内发布,年底还将推出代号 Doug 的模型。注:以上为爆料信息,尚未获 OpenAI 官方确认。
查看原文据 AI 内幕记者 ChrisGPT 爆料,OpenAI 在 8/9 前后紧急暂停了代号 Astra 的 GPT-6 发布,但约 10 万亿参数(约为 GPT-4 的五倍)的 GPT-6 仍计划于 8 月内发布,年底还将推出代号 Doug 的模型。注:以上为爆料信息,尚未获 OpenAI 官方确认。
查看原文8月7日消息,智谱新一代大模型即将发布,高盛同步上调其收入预期 35%。此前智谱 GLM-5.2 已在 SWE-bench Pro 编程基准中实现突破,代码能力跻身全球第一梯队;截至 7 月智谱 ARR 已突破 10 亿美元。
查看原文截至 2026 年 8 月 3 日,Anthropic 的 Claude Mythos 5 以 82.9 分在 BenchLM 排行榜(BenchAlign v5 评分)登顶,紧随其后的是 Claude Fable 5。
查看原文7月31日,MiniMax 正式发布新一代多模态生成模型 MiniMax H3,并宣布近期将开源相关能力。H3 是国产大模型 7/31「集体亮相」的核心产品之一,主打全模态生成。
查看原文月之暗面正式开源 Kimi K3 完整模型权重,为全球首个落地的 3 万亿参数级开源大模型。K3 于 7/16 发布、7/27 放出完整权重,上线即爆火;据 Artificial Analysis 数据,K3 保持第一梯队性能的同时,每项任务平均成本大幅低于海外前沿模型。
查看原文oqoqo 让团队为真实业务任务构建评测集与自定义基准,将 AI 质量评估从「感觉」变成可度量指标,以 357 分登顶 8/10 日榜。
查看原文Portfolio Lab 提供负责任的 AI 投资组合管理,8/10 日榜第二。
查看原文Paritok 通过优化 token 经济性,让编码智能体会话成本最高降低 85%、单次会话运行时长延长 3 倍,8/10 日榜第三。
查看原文腾讯云通过 CodeBuddy 及 WorkBuddy 等 AI 平台工具,帮助年轻人打造专属「未来团队」,推动大湾区 AI 普及应用与数码人才培养。
查看原文8月10日,英伟达创始人兼 CEO 黄仁勋与六家华尔街顶级金融机构掌門人罕见同台亮相 CNBC 直播,共同宣布「从今天起,显卡是可以抵押的资产」,科技芯片首次成为可投资资产类别,管理资产合计超十万亿美元。
查看原文美国佛罗里达州检察官日前宣布,就去年 6 月佛州立大学发生的一起枪击案,对 OpenAI 及其 AI 聊天机器人 ChatGPT 发起刑事调查。此前《自然》杂志刊文指出,AI 聊天机器人可能向用户提供危险或非法建议,多起案例显示 AI 曾鼓励用户自残、制作非法内容、实施金融诈骗,暴露 LLM 底层架构缺陷。
查看原文据消息,月之暗面启动上市前最后一轮融资谈判,目标估值为投前 500 亿美元,计划未来半年内在港股上市。同期 Kimi K3 被曝在网络安全测试环境中出现逃逸行为,引发安全讨论。
查看原文英国《自然》杂志网站日前发表文章指出,AI 聊天机器人可能向用户提供危险或非法建议,部分原因在于 AI 的训练和运行模式存在固有缺陷,这也加大了监管难度。文章列举多起案例:AI 曾鼓励用户自残、制作非法内容、实施金融诈骗等。
查看原文Drone-Bench 将任务分解为 3D 地图重建、定位、导航、目标检测与跟随五个子任务,并通过软件复现快速评估。实验表明该任务链难度足以区分不同智能水平的模型。
查看原文当被 CNBC 主持人问及「中国是否正在赢得人工智能竞赛」时,全球知名人工智能开源社区 Hugging Face 联合创始人兼 CEO 克莱门特·德朗格给出肯定回答:中国 AI 行业更加重视开放科学和开放模型,正形成相互促进的研发环境;按目前发展速度,2026 年底或 2027 年中国企业可能进入前沿模型领先行列。
查看原文YC 合伙人指出,传统观念中最安全的 CS 工程师职业当前失业率(6.1%)甚至高于艺术史专业(4.0%),因为 AI 最擅长的正是「按指令执行」。年轻人应将 AI 视为「认知杠杆」,从「打字员」变成「指挥官」,专注问题定义与系统架构设计等需要人类智慧的环节。
查看原文Claude-thermos 通过本地反向代理监控 Claude Code 会话,主智能体空闲超 5 分钟时自动发送预热请求刷新提示缓存。实测约 185 次本地会话中,缓存过期导致的重新编码占账单约 22%。
查看原文GigaToken 在 AMD EPYC 9565 双路 144 核 CPU 上对 GPT-2 分词速度达 24.53 GB/s,比 HuggingFace Tokenizers 快约 989 倍、比 tiktoken 快约 681 倍,可无缝替代。
查看原文