智谱AI正式发布GLM-5.3-Flash,上线首日登顶OpenRouter调用量榜单。该模型采用混合架构,融合DeepSeek稀疏注意力机制与Kimi线性注意力机制,叠加流形约束超连接技术,大幅降低推理成本。月之暗面研究员对比发现,两者底层代码排布高度重合,均采用KDA线性注意力,核心参数也相近,引发业界对线性注意力技术路线的广泛关注。
发现最好的AI工具
发现 2087+ 优质工具,助力你的下一个项目
最新发布
最近更新>>今日快讯
更多智谱正式上线并开源GLM-5.3-Flash,这是GLM-5系列首个原生多模态模型,总参数320B,能力超越前代,在AA综合智能指数中获57分,与Claude Opus 4.8持平。该模型采用极低成本架构,结合30T Token多模态预训练语料,以更少计算资源实现更强性能。商汤大装置通过国产异构混推技术提供大规模算力支持,打造国产算力规模化商用标杆。
商汤公布2026年上半年业绩,首次实现盈利6.2亿元,经常性收入与毛利率持续提升。公司构建的「一套模型、一座Token工厂、一套智能体管控系统」核心能力体系,通过统一多模态架构持续提升智能上限,以基础设施和优化能力降低Token成本。年内密集发布NEO-Unify架构、SenseNova U1等多款模型,覆盖原生多模态、视觉感知、可控生成、长程智能体等方向。
阿里8月26日发布并开源千问最新模型Qwen3.8-Flash,采用下一代架构,千亿总参数仅激活60亿即可获得超越Claude Opus4.6的前沿性能。训练成本较前代骤降近90%,推理成本大幅下降,每百万Tokens输入仅1元、输出3元,价格最低至DeepSeek-V4-Flash的三分之一。该模型为多模态混合专家模型,今晚将首发上线千问办公,开发者可通过千问AI平台获取API服务。
汤森路透基于阿里开源Qwen3.5开发自研大模型Thomson-1,用于表格分析、文档审核等专业工作,逐步承接部分Claude任务。此举旨在降低对闭源模型的依赖和长期成本,反映开源模型在企业级应用中的吸引力持续增强。
纽约大学阿布扎比分校与克利夫兰诊所团队在ACL 2026 Findings发表论文,构建首个医疗错误检测基准MedErrBench。研究发现通用模型在医疗任务上表现优于医疗专用模型,且英语训练模型处理英语医疗数据并非最优,为医疗AI落地提供新视角。
热门工具 🔥
更多猜你喜欢
最新文章
更多一个 Prompt,逆向拆解网页设计系统,让 AI 复刻不再翻车
AI复刻网页常因只还原像素层而失败。本文提供一条核心Prompt,引导AI逆向工作:先采集证据、建立页面地...
GLM 5.3 意外曝光:多模态视觉终于要来了,开发者苦等已久
智谱AI的GLM 5.3意外曝光,核心升级方向为多模态视觉能力,涵盖图片识别、表格解析、UI截图生成代码等。...
SkillHub 10.7 万技能找不到?这个隐藏的智能导航员才是真正入口
SkillHub拥有10.7万技能却难以查找?find-skills作为入口级技能,通过自然语言理解需求,从五层来源精准...
Qoder 自定义模型配置:解锁 Qwen Token Plan 全量能力
Qoder Token Plan模型无法使用多模态或上下文选项?问题出在本地SQLite数据库。本文教你修改aicoding.cu...
阿里与亚马逊,AI电商的两个差异化样本
阿里千问与淘宝全面打通,亚马逊推出Alexa for Shopping,两大巨头几乎同时加码AI购物,却走出截然不同...
