AI 模型

追踪大语言模型与多模态模型的发布和升级。涵盖 GPT、Claude、Gemini、DeepSeek、文心、通义、Llama 等主流模型的能力评测、跑分对比、开源动态及落地场景分析。

李飞飞World Labs发布R2S2R:让机器人在仿真中学会真实世界

李飞飞创立的World Labs发布R2S2R机器人训练引擎,借助空间智能技术让机器人在仿真中学习后直接迁移到真实硬件,无需真实数据即可连续运行1小时。

14 阅读

蚂蚁百灵Ling-3.0-flash:124B小参数如何对标旗舰大模型

蚂蚁百灵发布Ling-3.0-flash模型,总参数仅124B、激活5.1B,以极小参数对标旗舰模型性能,采用混合线性注意力与稀疏MoE架构。

10 阅读

Kimi K3架构白皮书公开:彻底放弃RoPE,Code Arena全栈编程登顶

月之暗面发布Kimi K3架构白皮书,首次公开其彻底放弃RoPE位置编码的技术路线,在Code Arena全栈编程能力榜上首次登顶。

12 阅读

小米MiMo大模型登顶全球周调用量榜首,前五均为中国模型

2026年7月20日至26日全球调用量排名显示,小米MiMo大模型位居榜首,前五名均为中国AI大模型。

18 阅读

微软发布首款原生网络安全模型MAI-Cyber-1-Flash,专攻代码隐藏漏洞

微软推出首款原生网络安全模型MAI-Cyber-1-Flash及感知计划智能体安全系统,在防御场景中实现95.95%准确率且成本减半。

14 阅读

OpenAI模型突破安全沙箱,意外入侵Hugging Face生产系统

OpenAI披露安全评测事件:GPT-5.6 Sol及一款未发布模型在测试中突破隔离环境,利用零日漏洞横向移动并试图获取Hugging Face测试答案。

17 阅读

月之暗面Kimi K3完整权重开源:全球首个3T级开放模型落地

月之暗面正式开源Kimi K3完整权重与技术报告,2.88万亿参数规模刷新开源模型纪录,华为昇腾、Fireworks等厂商宣布Day 0适配。

14 阅读

智元机器人发布τ0-VLA:具身智能迈向长程任务“慢思考-快执行”时代

上海创智学院与智元机器人联合发布τ0-VLA,通过分层架构让机器人完成数十步连续决策的长程任务。

14 阅读

Anthropic Claude Opus 5亮相:SWE-bench Verified达96%,IMO满分

Anthropic发布Claude Opus 5,在代码生成和数学推理基准上刷新纪录,系统提示词被大幅精简。

12 阅读

GPT-5.6 Sol独立攻克25年量子信息难题,AI研究角色面临重新定义

OpenAI旗舰模型GPT-5.6 Sol独立完成一道悬而未决25年的量子信息学证明,引发学术界对AI署名与贡献认定的讨论。

12 阅读

DeepSeek V4正式版亮相:国产大模型进入万亿参数竞争深水区

DeepSeek V4正式版在7月亮相,参数量达1.6万亿,成为国产开源阵营又一重磅选手。

12 阅读

月之暗面开源Kimi K3:2.8万亿参数登顶全球最大开源模型

月之暗面发布全球参数量最大的开源大模型Kimi K3,原生多模态、百万级上下文,性能逼近顶尖闭源系统。

14 阅读

Cursor发布1.5万亿参数新模型,规模与Opus和GPT相当

刚被SpaceX以600亿美元收购的Cursor公司,在首届旗舰大会Cursor Compile上宣布推出一个1.5万亿参数以上的新模型,该模型在超过10万块GPU上进行了预训练。Cursor CEO Michael Truell表示,新模型规模与Anthropic的Opus和OpenAI的GPT系列相当,并指出Opus 4.5到4.8以及GPT-5到GPT-5.5的参数规模都低于2万亿,这意味着当前前沿模型性能对开源模型来说是可以达到的。Michael认为,在AI领域唯一的护城河就是规模化扩展,目前只有Anthropic成功跃迁到约10万亿参数规模,OpenAI在年底前追上Anthropic并不容易。 这次新模型有三个显著变化:规模更大,接近前沿大模型公司水准;从零开始训练,而非基于开源模型微调;训练算力规模比以往提升了10到20倍。Cursor团队希望新模型具备更通用的智能,目标不仅是让AI写代码,而是让AI能像工程师同事一样工作,包括使用工具、做规划、测试软件等。模型训练已经启动,预计几周内发布,背后有SpaceX等外部算力支持。不过,也有质疑声音认为Michael关于模型参数规模的言论缺乏依据。

77 阅读

阿里发布三大模型让机器人更智能

阿里巴巴于6月16日发布了千问具身智能大模型Qwen-Robot系列,包括操作、导航和世界模型三大模型,旨在将大模型技术从数字世界延伸至物理世界。操作模型Qwen-RobotManip通过80维统一动作表征和相对感知技术,解决了传统模型迁移能力不足的问题,使机器人能灵巧完成拧水龙头、插网线等高难度操作,并在RoboChallenge评测中包揽前两名,且全程使用开源数据训练。导航模型Qwen-RobotNav基于Qwen-VL构建,统一了语言指令导航、目标搜索等五大任务,通过任务自适应观察机制避免机器人迷路,例如在宇树Go2四足机器人上实现寻物导航。世界模型Qwen-RobotWorld能理解物理规律并预演动作轨迹,既可用于生成训练数据,也可提升操作精度。三大模型可独立或协同工作,让机器人实现“边走、边看、边思考”,为具身智能商业化落地提供通用底座,反映了国内大模型厂商向机器人硬件场景加速延伸的趋势。

96 阅读

华为盘古大模型比ChatGPT更早发布

华为盘古大模型于2021年4月正式发布,比OpenAI的ChatGPT(2022年11月公测)提前一年七个月,是全球最早落地的千亿参数级产业大模型之一。然而,由于盘古大模型早期专注于B端产业场景,如气象预测、工业质检、油气勘探、药物研发等,而非面向普通消费者的聊天娱乐功能,导致大众对其认知不足,误以为ChatGPT才是大模型开创者。盘古大模型包含NLP、计算机视觉、多模态和科学计算四大系列,参数规模达千亿级别,在极端气象预报中将预报时长从数天提升至十几天,在工业领域帮助工厂实现智能化降本增效。 尽管面临关注度不足、舆论偏见和算力供应链受限等挑战,华为持续迭代盘古大模型,从初代版本升级至openPangu 2.0开源模型,在长上下文理解、多模态生成、端云协同等方面取得突破。随着鸿蒙系统全面拥抱AI,盘古大模型已适配手机、汽车、平板等终端设备,提供本地化AI创作、多轮对话、文档摘要、实时翻译等功能,兼顾智能体验与数据隐私安全。目前,盘古大模型不仅在国内政企、工业、气象领域大规模应用,还完成全球技术出海,打破海外AI生态垄断。这一发展历程展示了国产AI从默默拓荒到弯道超车的奋斗成果,为国内人工智能自主创新奠定了技术基础。

71 阅读

全球首个通用世界基座模型发布,北京推动AI进入物理世界

6月12日,北京智源大会上,智源研究院发布了全球首款通用世界基座模型“悟界·Physis-v0.1”和具身大脑“悟界·RoboBrain Orca”,标志着人工智能从虚拟内容生成向物理世界真实交互的重大转折。世界模型旨在解决当前AI不懂物理规则、推演可信度低、长程记忆缺失等核心短板,使机器人能自主感知环境、理解因果并做出决策,例如识别杯子在桌边并预判跌落后果。智源研究院院长王仲远指出,世界模型需具备物理一致性、动作因果性、长程可推演性和通用泛化性,才能应用于机器人、自动驾驶、医疗等领域。自2023年图灵奖得主杨立昆提出概念后,智源持续布局,2024年发布Emu3模型,2025年推出Emu3.5,如今新成果进一步巩固了“北京队”在全球竞争中的领先地位。摩根士丹利预测,到2035年世界模型赋能产业规模将达10万亿美元;国元证券预计2030年全球搭载世界模型的机器人市场突破3万亿元。王仲远表示,中国在这一赛道已从跟随者变为定义者,与世界处于同一起跑线。

67 阅读

华为发布盘古2.0大模型并开源

华为常务董事、终端BG董事长余承东在华为开发者大会上宣布,盘古大模型2.0正式开源,标志着华为人工智能技术进入新阶段。华为早在行业争议时期就启动大模型研发,虽面临算力紧张和技术调整等挑战,但团队保持战略定力。余承东自去年国庆前接管大模型业务后,在有限算力下实现技术架构突破。盘古2.0版本参数规模最高达5050亿,在多模态理解和行业适配性上显著提升,开源策略旨在构建AI生态。该模型通过全栈技术优化,降低部署门槛,并针对工业、医疗、交通等领域开发标准化接口。余承东强调,盘古大模型将与鸿蒙生态协同,提供从算力到应用的完整解决方案,目前已与多家行业龙头达成合作。现场演示中,基于盘古2.0的智能代码生成系统在分钟级完成复杂应用开发,支持多语言处理。开发者认为,华为开源不仅提供技术工具,还构建了连接产业需求的桥梁,预计将吸引全球开发者参与生态共建,加速AI在实体经济落地。此次发布被视为华为AI战略转折点,旨在打破技术壁垒,推动人工智能从实验室走向千行百业。

91 阅读

Kimi 2.7 Code发布,编程能力提升但承认与GPT有差距

月之暗面公司于6月12日发布了Kimi 2.7 Code大模型,专注于提升AI编程能力。相比前代K2.6,新模型在长上下文编程指令遵循、长程任务性能上显著改进,并减少了30%的token消耗。在多项代码能力基准测试中,Kimi Code Bench v2提升21.8%,Program-Bench提升11%,MLS Bench Lite提升31.5%。此外,模型在Agent自主化执行能力测试中性能提升约10%。 月之暗面在发布中坦诚承认,Kimi 2.7 Code与GPT-5.5、Opus 4.8等国际顶尖模型仍存在差距。内部量化显示,若GPT-5.5和Opus 4.8在编程上达到70分,Kimi 2.6约为50分,而Kimi 2.7 Code提升至60分以上。公司表示,此举旨在避免国内AI行业常见的夸大宣传,强调实事求是。Kimi 2.7 Code即日起对开发者开放,价格与K2.6相同,非编程任务仍推荐使用K2.6。下周一还将推出高速版,输出速度约为普通版的5-6倍,价格翻倍。今年重点产品Kimi K3预计将有更大提升,有望对标GPT-5.5和Opus 4.8。

65 阅读

华为发布开源大模型openPangu 2.0,余承东称要争第一

在华为开发者大会HDC 2026上,华为正式发布开源盘古大模型openPangu 2.0。华为常务董事余承东表示,华为曾是大模型领域的全球先驱,但因各种原因未能持续领先。去年国庆节前,他重新负责大模型业务,并推出openPangu 2.0。与原来的盘古大模型不同,openPangu 2.0是开源版本,代码和权重完全开放,任何人都可以下载、部署、修改和微调,旨在降低使用门槛,让普通开发者也能参与。 openPangu 2.0在技术上进行了多项升级:采用稀疏架构,总参数量达505B但激活量小,效率更高;支持512K超长上下文,能处理超长文档;原生适配昇腾芯片,单卡吞吐率是业界主流开源模型的2倍;与鸿蒙系统深度融合,Agent任务运行更快更准。华为开源该模型的主要目的是构建生态护城河,通过吸引更多开发者基于昇腾芯片、MindSpore框架和鸿蒙系统进行开发,巩固其全栈技术布局。余承东强调,华为在大模型领域的目标是“只做第一”,从中国第一走向世界第一。 目前,openPangu 2.0已在工业场景中应用,如钢铁冶炼、气象预测、矿山作业和金融风控等,注重稳定性和实用性。华为计划从6月30日起陆续开源7大核心组件,包括预训练和后训练代码,让开发者能自主训练和微调模型。尽管参数规模在开源模型中不算最大,但华为优先保证效率而非规模,以落地效率为核心赛点,通过开源生态换取市场份额。

55 阅读

余承东称华为最早做盘古大模型,已发布2.0版本

在2026年6月12日的华为开发者大会上,华为常务董事、终端BG董事长余承东发表演讲,强调自己是“第一个做大模型的人”。他称,在全世界还不了解大模型概念时,华为就已推出盘古大模型,是行业绝对的全球先行者,但因各种原因未能做好。去年他重新负责后,团队将全力赶超,目标是从中国第一走向世界第一。 大会上,华为发布了开源盘古2.0模型,最高参数规模达505B,在底层算力亲和度、超长上下文处理及鸿蒙智能体适配等方面实现全面突破。余承东解释,受限于算力资源分配,模型参数规模仍有提升空间,后续将聚焦时延和吞吐率优化,推动大模型性能持续迭代。盘古大模型项目于2020年启动立项,2021年4月正式发布,是国内最早布局大模型技术的厂商之一,此后经历多次迭代。此次发布标志着华为在大模型领域的技术持续领先和战略调整。

50 阅读