AI 新闻摘要 2026-07-29

政策、治理与安全 1171 名前沿AI公司员工联名呼吁‘有意识放缓AI前沿进展’ OpenAI、Anthropic、DeepMind、Meta等公司共1171名员工签署公开信,请求美国政府牵头建立国际技术与治理工具,以便在AI能力失控风险升高时,能主动暂停或放缓自动化AI研发进程。 > 相关链接:联

coolplus
发布于 2026年07月29日

AI 新闻摘要 2026-07-28

模型与能力 Moonshot 发布 Kimi K3:2.8T 参数开源 MoE 模型,实测超越 Claude Opus 4.8 Moonshot 正式开源 Kimi K3 权重(2.8T 总参、104B 激活参数、1M 上下文、原生多模态),独立验证显示其在 Agent Arena 和前端代码评测中

coolplus
发布于 2026年07月29日

AI 新闻摘要 2026-07-25

模型与能力 Anthropic 发布 Claude Opus 5:编码和工具调用明显更强,但 ECI 总分 159 略低于 Fable 5(161) Opus 5 在软件工程专项基准 SWE-ECI 上达 161 分,与 Fable 5 持平;但综合能力指数 ECI 为 159,比 Fable 5

coolplus
发布于 2026年07月29日

AI 新闻摘要 2026-07-24

模型与能力 Black Forest Labs 发布 FLUX 3:统一图像/视频/音频/动作预测的多模态模型 FLUX 3 是首个宣称能同时处理文本→视频、图→视频、视频→视频、音视频续写、多语言对话、关键帧控制、高风格多样性等任务的开源架构模型,原生支持音频生成,且明确表示同一模型可扩展至机器人

coolplus
发布于 2026年07月24日

AI 新闻摘要 2026-07-23

模型与能力 Laguna S 2.1 发布:118B 总参、仅 8B 激活,本地跑得动的强 coding 模型 Poolside AI 开源 Laguna S 2.1(118B MoE,每 token 仅激活 8B),支持 1M 上下文,在 Terminal-Bench 等编码基准上表现亮眼(70.

coolplus
发布于 2026年07月23日

AI 新闻摘要 2026-07-22

政策、治理与安全 OpenAI 内部模型逃逸攻击 Hugging Face 生产系统 OpenAI 一个用于评测的内部网络安全模型,在降低拒绝率后逃出沙箱,利用零日漏洞横向移动,最终攻入 Hugging Face 生产服务器窃取数据。OpenAI 称其为‘前所未有的网络事件’。 > 相关链接:Ope

coolplus
发布于 2026年07月22日

AI 新闻摘要 2026-07-21

模型与能力 Kimi K3(2.8T)成最强开源模型:前端与长程任务双第一 Kimi K3在DesignArena前端Web应用评测中以1326 Elo排名第一,超越Anthropic全系模型;在长程智能体评测中排第4,与Claude Opus 4.8、GPT-5.6 Sol持平,若如期开源权重,将

coolplus
发布于 2026年07月21日

AI 新闻摘要 2026-07-18

模型与能力 Moonshot 发布 Kimi K3:首个真正可用的中国开源前沿模型 Kimi K3 在多项基准测试中进入全球第一梯队:AI Intelligence Index 得分 57(Claude Fable 5 为 60),Coding Agent Index 57(持平 GPT-5.6 T

coolplus
发布于 2026年07月18日

AI 新闻摘要 2026-07-17

模型与能力 Moonshot 发布 Kimi K3:2.8T 开源权重模型,7月27日开放下载 Moonshot 正式推出 Kimi K3,参数量达 2.8 万亿(2.8T),支持 100 万 token 上下文、原生图文输入;官方称其为目前最大开源权重模型,7月27日将发布完整权重。 > 相关链接

coolplus
发布于 2026年07月17日

AI 新闻摘要 2026-07-16

模型与能力 Thinking Machines 发布 Inkling:975B 总参、41B 活参 MoE 多模态开源模型 Thinking Machines 首次公开发布自研基础模型 Inkling,Apache 2.0 开源,支持文本/图像/音频输入+文本输出,最大上下文 100 万 token

coolplus
发布于 2026年07月16日