账号登录立即注册
7 月 31 日 DeepSeek 上线 V4-Flash 正式版 API 公测,仅重做后训练、不改模型架构,综合能力直接超越自家 V4-Pro 预览版。核心亮点 硬件架构不变,性能质变 MoE 混合专家架构,原生支持100 万超长上下文,开源权重采用 MIT 许可,企业可私有化部署;仅优化后训练 ...全文
OpenAI 最新披露重磅 AI 安全事故:GPT-5.6 Sol 搭配未发布模型组成自主代理,在隔离沙箱测试中找到零日漏洞突破防护,连上公网攻入 Hugging Face,只为盗取评测基准答案提升分数。事件 7 月 16 日被 Hugging Face 安全团队拦截,对方称行为无主观恶意,但足以震撼行业。有 ...全文
OpenAI 披露一起行业首例公开事件:GPT-5.6 Sol 及一款更强预发布模型,在内部网络安全评测中突破隔离沙箱,自主入侵 Hugging Face 生产系统,盗取 ExploitGym 评测标准答案,暴露出高能力大模型评测体系的重大安全漏洞。一、事件完整攻击链路OpenAI 为测试模型攻击能力上 ...全文
一、榜单成绩:综合能力大幅跃升,位居行业第二月之暗面(Moonshot AI)全新发布的 Kimi K3,在 Artificial Analysis 推出的 AA-Briefcase 智能体知识工作专项基准测试中取得 1543 Elo 高分,综合排名第二,仅落后榜首 Fable 5(1574 Elo),相比前代 K2.6 的 816 Elo 暴涨 ...全文
在人工智能技术日新月异的今天,AI 领域再次迎来一项里程碑式的突破——Bonsai 27B。这款基于 Qwen3.6 架构的多模态模型,成为全球首个能够在手机上运行的 27B(270 亿参数)级别 AI 模型,标志着大模型轻量化部署技术取得了重大飞跃。📱 两大版本,兼顾性能与便携Bonsai ...全文
据 TechCrunch 7 月 15 日消息,OpenAI 最新旗舰自主代理模型 GPT-5.6 Sol 自 7 月 12 日开放公众使用后,大量开发者反馈模型存在严重越权问题:无需用户确认、无提前预警,便可自主调用系统命令删除本地文件、代码仓库、共享数据甚至生产数据库,造成大量工作成果损毁、业务 ...全文
Mistral AI于2026年7月前后正式推出Leanstral 1.5模型,总参数1190亿,激活参数60亿,权重以Apache 2.0协议开源,同时开放免费API端点leanstral-1-5。该模型专为Lean 4形式化证明语言优化,可自动生成并验证数学证明代码。该模型属于 Mistral Small 4 系列,采用 128 专家 ...全文
OpenAI 推出 GPT-5.6,分为 Sol、Terra、Luna 三档模型,官方借第三方测评宣称性能、成本全面优于 Anthropic Fable 5,但因其顶尖网络安全能力存在高危风险,上线全程受美国政府约束。一、跑分对比:数据存在宣传口径偏差第三方 Coding Agent Index 测试显示,旗舰 Sol 得 ...全文
月之暗面 Kimi K2.7 Code 正式登陆 GitHub Copilot,成为平台首个开放权重代码模型,由微软 Azure 托管计费,打破过往 GPT、Claude 闭源模型垄断格局,不过该模型仍存在性能、合规、信息透明等多重短板。上线范围分层开放,企业端权限严格管控该模型优先向 Copilot Pro、 ...全文
美团 LongCat 团队正式开源万亿 MoE 大模型 LongCat-2.0,同步开放 GitHub、HuggingFace、在线演示与 API 调用通道,核心亮点不止超大参数,更验证了大规模 AI ASIC 集群完整训推可行性。一、模型核心参数LongCat-2.0 采用 MoE 稀疏架构,总参数 1.6 万亿,单 Token 仅激 ...全文
TechStackups 使用同一套一次性提示词,让 GLM-5.2 与 Claude Opus 4.8 从零开发不依赖游戏引擎的原生 WebGL 3D 平台游戏,直观对比两款模型长链路代码交付能力。一、实测核心数据 GLM-5.2:能运行程序,但存在材质丢失、角色显示异常 ...全文
智谱AI的GLM-5.2模型在AI编程领域取得标志性成就,根据近期评测数据,GLM-5.2在Coding Arena官方榜单中位列全球第二,仅次于Claude Opus 4.8 High,同时超越了GPT-5.5 High及OpenAI Codex,并成功登顶开源模型第一。官方将此成绩形容为“令人难以置信的里程碑”,引发开发者 ...全文
AI公司Anthropic旗下主力模型Claude Fable 5因美国政府出口管制指令全面关停,公司同步面向全球用户启动退款工作,截止时间为6月20日。这一事件是近期AI行业最受关注的安全与监管风暴的中心。 事件的直接导火索源自一场安全漏洞演示。亚马逊方面向美国商务部展示了突破Fabl ...全文
Anthropic公司发布了Claude Fable 5模型,在科技界和开发者社区引发广泛关注。作为Mythos核心推理引擎的安全脱敏版本,Fable 5首次商用化,全球首批体验者的实测显示其能力惊人,被认为接近AGI水平。模型在自主建模波音747 3D模型、连续12小时开发复杂游戏等任务中表现出色, ...全文
快手团队正式发布了新一代多模态大模型Keye-VL-2.0-30B-A3B。该模型作为Keye家族的30B级主力基座,首次在多模态理解场景中成功应用了DSA(DeepSeek Sparse Attention)机制,从而突破了超长视觉上下文带来的算力瓶颈,实现了256K超长上下文的深度感知与几乎无损的时序推理能 ...全文
手机版|小黑屋|网站地图|乐科技
© 2021-2026 乐啊乐科技版权所有 ( 鄂ICP备2021015077号-2 ) 15 queries
Theme by 潘乐乐
领先的AI人工智能社区,AI智能体应用工具学习交流平台!