AI 模型
追踪大语言模型与多模态模型的发布和升级。涵盖 GPT、Claude、Gemini、DeepSeek、文心、通义、Llama 等主流模型的能力评测、跑分对比、开源动态及落地场景分析。
Cursor发布1.5万亿参数新模型,规模与Opus和GPT相当
刚被SpaceX以600亿美元收购的Cursor公司,在首届旗舰大会Cursor Compile上宣布推出一个1.5万亿参数以上的新模型,该模型在超过10万块GPU上进行了预训练。Cursor CEO Michael Truell表示,新模型规模与Anthropic的Opus和OpenAI的GPT系列相当,并指出Opus 4.5到4.8以及GPT-5到GPT-5.5的参数规模都低于2万亿,这意味着当前前沿模型性能对开源模型来说是可以达到的。Michael认为,在AI领域唯一的护城河就是规模化扩展,目前只有Anthropic成功跃迁到约10万亿参数规模,OpenAI在年底前追上Anthropic并不容易。 这次新模型有三个显著变化:规模更大,接近前沿大模型公司水准;从零开始训练,而非基于开源模型微调;训练算力规模比以往提升了10到20倍。Cursor团队希望新模型具备更通用的智能,目标不仅是让AI写代码,而是让AI能像工程师同事一样工作,包括使用工具、做规划、测试软件等。模型训练已经启动,预计几周内发布,背后有SpaceX等外部算力支持。不过,也有质疑声音认为Michael关于模型参数规模的言论缺乏依据。
阿里发布三大模型让机器人更智能
阿里巴巴于6月16日发布了千问具身智能大模型Qwen-Robot系列,包括操作、导航和世界模型三大模型,旨在将大模型技术从数字世界延伸至物理世界。操作模型Qwen-RobotManip通过80维统一动作表征和相对感知技术,解决了传统模型迁移能力不足的问题,使机器人能灵巧完成拧水龙头、插网线等高难度操作,并在RoboChallenge评测中包揽前两名,且全程使用开源数据训练。导航模型Qwen-RobotNav基于Qwen-VL构建,统一了语言指令导航、目标搜索等五大任务,通过任务自适应观察机制避免机器人迷路,例如在宇树Go2四足机器人上实现寻物导航。世界模型Qwen-RobotWorld能理解物理规律并预演动作轨迹,既可用于生成训练数据,也可提升操作精度。三大模型可独立或协同工作,让机器人实现“边走、边看、边思考”,为具身智能商业化落地提供通用底座,反映了国内大模型厂商向机器人硬件场景加速延伸的趋势。
华为盘古大模型比ChatGPT更早发布
华为盘古大模型于2021年4月正式发布,比OpenAI的ChatGPT(2022年11月公测)提前一年七个月,是全球最早落地的千亿参数级产业大模型之一。然而,由于盘古大模型早期专注于B端产业场景,如气象预测、工业质检、油气勘探、药物研发等,而非面向普通消费者的聊天娱乐功能,导致大众对其认知不足,误以为ChatGPT才是大模型开创者。盘古大模型包含NLP、计算机视觉、多模态和科学计算四大系列,参数规模达千亿级别,在极端气象预报中将预报时长从数天提升至十几天,在工业领域帮助工厂实现智能化降本增效。 尽管面临关注度不足、舆论偏见和算力供应链受限等挑战,华为持续迭代盘古大模型,从初代版本升级至openPangu 2.0开源模型,在长上下文理解、多模态生成、端云协同等方面取得突破。随着鸿蒙系统全面拥抱AI,盘古大模型已适配手机、汽车、平板等终端设备,提供本地化AI创作、多轮对话、文档摘要、实时翻译等功能,兼顾智能体验与数据隐私安全。目前,盘古大模型不仅在国内政企、工业、气象领域大规模应用,还完成全球技术出海,打破海外AI生态垄断。这一发展历程展示了国产AI从默默拓荒到弯道超车的奋斗成果,为国内人工智能自主创新奠定了技术基础。
全球首个通用世界基座模型发布,北京推动AI进入物理世界
6月12日,北京智源大会上,智源研究院发布了全球首款通用世界基座模型“悟界·Physis-v0.1”和具身大脑“悟界·RoboBrain Orca”,标志着人工智能从虚拟内容生成向物理世界真实交互的重大转折。世界模型旨在解决当前AI不懂物理规则、推演可信度低、长程记忆缺失等核心短板,使机器人能自主感知环境、理解因果并做出决策,例如识别杯子在桌边并预判跌落后果。智源研究院院长王仲远指出,世界模型需具备物理一致性、动作因果性、长程可推演性和通用泛化性,才能应用于机器人、自动驾驶、医疗等领域。自2023年图灵奖得主杨立昆提出概念后,智源持续布局,2024年发布Emu3模型,2025年推出Emu3.5,如今新成果进一步巩固了“北京队”在全球竞争中的领先地位。摩根士丹利预测,到2035年世界模型赋能产业规模将达10万亿美元;国元证券预计2030年全球搭载世界模型的机器人市场突破3万亿元。王仲远表示,中国在这一赛道已从跟随者变为定义者,与世界处于同一起跑线。
华为发布盘古2.0大模型并开源
华为常务董事、终端BG董事长余承东在华为开发者大会上宣布,盘古大模型2.0正式开源,标志着华为人工智能技术进入新阶段。华为早在行业争议时期就启动大模型研发,虽面临算力紧张和技术调整等挑战,但团队保持战略定力。余承东自去年国庆前接管大模型业务后,在有限算力下实现技术架构突破。盘古2.0版本参数规模最高达5050亿,在多模态理解和行业适配性上显著提升,开源策略旨在构建AI生态。该模型通过全栈技术优化,降低部署门槛,并针对工业、医疗、交通等领域开发标准化接口。余承东强调,盘古大模型将与鸿蒙生态协同,提供从算力到应用的完整解决方案,目前已与多家行业龙头达成合作。现场演示中,基于盘古2.0的智能代码生成系统在分钟级完成复杂应用开发,支持多语言处理。开发者认为,华为开源不仅提供技术工具,还构建了连接产业需求的桥梁,预计将吸引全球开发者参与生态共建,加速AI在实体经济落地。此次发布被视为华为AI战略转折点,旨在打破技术壁垒,推动人工智能从实验室走向千行百业。
Kimi 2.7 Code发布,编程能力提升但承认与GPT有差距
月之暗面公司于6月12日发布了Kimi 2.7 Code大模型,专注于提升AI编程能力。相比前代K2.6,新模型在长上下文编程指令遵循、长程任务性能上显著改进,并减少了30%的token消耗。在多项代码能力基准测试中,Kimi Code Bench v2提升21.8%,Program-Bench提升11%,MLS Bench Lite提升31.5%。此外,模型在Agent自主化执行能力测试中性能提升约10%。 月之暗面在发布中坦诚承认,Kimi 2.7 Code与GPT-5.5、Opus 4.8等国际顶尖模型仍存在差距。内部量化显示,若GPT-5.5和Opus 4.8在编程上达到70分,Kimi 2.6约为50分,而Kimi 2.7 Code提升至60分以上。公司表示,此举旨在避免国内AI行业常见的夸大宣传,强调实事求是。Kimi 2.7 Code即日起对开发者开放,价格与K2.6相同,非编程任务仍推荐使用K2.6。下周一还将推出高速版,输出速度约为普通版的5-6倍,价格翻倍。今年重点产品Kimi K3预计将有更大提升,有望对标GPT-5.5和Opus 4.8。
华为发布开源大模型openPangu 2.0,余承东称要争第一
在华为开发者大会HDC 2026上,华为正式发布开源盘古大模型openPangu 2.0。华为常务董事余承东表示,华为曾是大模型领域的全球先驱,但因各种原因未能持续领先。去年国庆节前,他重新负责大模型业务,并推出openPangu 2.0。与原来的盘古大模型不同,openPangu 2.0是开源版本,代码和权重完全开放,任何人都可以下载、部署、修改和微调,旨在降低使用门槛,让普通开发者也能参与。 openPangu 2.0在技术上进行了多项升级:采用稀疏架构,总参数量达505B但激活量小,效率更高;支持512K超长上下文,能处理超长文档;原生适配昇腾芯片,单卡吞吐率是业界主流开源模型的2倍;与鸿蒙系统深度融合,Agent任务运行更快更准。华为开源该模型的主要目的是构建生态护城河,通过吸引更多开发者基于昇腾芯片、MindSpore框架和鸿蒙系统进行开发,巩固其全栈技术布局。余承东强调,华为在大模型领域的目标是“只做第一”,从中国第一走向世界第一。 目前,openPangu 2.0已在工业场景中应用,如钢铁冶炼、气象预测、矿山作业和金融风控等,注重稳定性和实用性。华为计划从6月30日起陆续开源7大核心组件,包括预训练和后训练代码,让开发者能自主训练和微调模型。尽管参数规模在开源模型中不算最大,但华为优先保证效率而非规模,以落地效率为核心赛点,通过开源生态换取市场份额。
余承东称华为最早做盘古大模型,已发布2.0版本
在2026年6月12日的华为开发者大会上,华为常务董事、终端BG董事长余承东发表演讲,强调自己是“第一个做大模型的人”。他称,在全世界还不了解大模型概念时,华为就已推出盘古大模型,是行业绝对的全球先行者,但因各种原因未能做好。去年他重新负责后,团队将全力赶超,目标是从中国第一走向世界第一。 大会上,华为发布了开源盘古2.0模型,最高参数规模达505B,在底层算力亲和度、超长上下文处理及鸿蒙智能体适配等方面实现全面突破。余承东解释,受限于算力资源分配,模型参数规模仍有提升空间,后续将聚焦时延和吞吐率优化,推动大模型性能持续迭代。盘古大模型项目于2020年启动立项,2021年4月正式发布,是国内最早布局大模型技术的厂商之一,此后经历多次迭代。此次发布标志着华为在大模型领域的技术持续领先和战略调整。
赛豆科技发布AI汽车品牌AIVA,概念车亮相,量产车ME7年内上市
6月9日,赛豆科技正式发布全新AI汽车品牌AIVA,品牌名称寓意“AI陪伴用户一路向前”,同时带有“爱我”的语义联想。发布会上,AIVA首款概念车Origin Concept亮相,官方宣布首款量产车型ME7将在年内推出,全系车型覆盖20万元以上主流市场。AIVA与火山引擎合作,采用豆包大模型和智能座舱技术,提升车载交互体验。品牌LOGO以AI为核心意象,象征AI大模型作为生命原点,守护用户自由拥抱世界。 Origin Concept概念车采用轿跑SUV设计,车头动感,配备灯语和激光雷达,车身线条富有肌肉感,车尾有宽体设计和夸张后包围。官方称,该车以AI大模型为起点,通过生物力学重新定义整车形态,打造“具身AI生命体”。AIVA总裁李博,前华为问界产品线核心负责人,担任发布会核心演讲者。新车核心亮点是全系标配豆包大模型,支持多模态交互、情绪感知和场景化推荐,辅助驾驶与元戎启行合作,而非华为乾崑,生产将在赛力斯凤凰工厂进行。 赛豆科技由重庆沙磁致远(持股34.5%)、赛力斯(持股32.96%)和宁德时代(持股9.89%)共同持股。赛力斯推出AIVA品牌,旨在摆脱对问界品牌的过度依赖,因为问界占赛力斯2025年销售份额的90.3%,且搭载华为智驾的车型在海外市场面临障碍。去年10月,赛力斯子公司与火山引擎签署协议,合作开发具身智能技术,火山引擎提供算法和算力支持。新品牌名称“赛豆”直接指向豆包大模型,双方正推动其进入车机系统,项目处于研发阶段。
MiniMax发布新模型M3,支持百万上下文和编程
中国人工智能公司MiniMax于近日发布了其新一代大语言模型M3,该模型在多个关键性能上取得显著突破。M3模型支持高达100万token的上下文长度,这意味着它能一次性处理大量文本信息,如整本书籍或长篇文档,极大提升了复杂任务的处理能力。此外,M3在编程能力上达到旗舰水平,能够高效生成和调试代码,为开发者提供强大支持。模型还具备原生多模态功能,能同时处理文本、图像等多种数据类型,实现更丰富的交互体验。MiniMax表示,M3通过优化算法和架构,在保持高性能的同时降低了计算成本,使其更适用于企业级应用。目前,该模型已开放部分API接口,供开发者测试和使用。这一发布有望推动AI在内容创作、软件开发和教育等领域的应用,但具体市场影响尚需观察。
安踏发布两大科技平台和穿搭大模型
5月29日,安踏集团牵头组建的体育用品产业创新联合体在厦门召开第三次理事会,发布了仿生与可视化结构平台、钛合金科技平台两大核心技术攻关课题,以及体育用品行业首个自研穿搭大模型“灵犀”。联合体还成立了高规格科学智库,并新增4家成员单位,完善了从基础研究到产业应用的创新体系。仿生平台解决了鞋底软塌、鞋面磨脚等痛点,钛合金平台具备抗扭、推进等优势,灵犀大模型可实现智能穿搭推荐和虚拟试穿。安踏计划未来五年再投入200亿元用于创新,推动体育产业高质量发展。
MiniMax启动科创板上市辅导,大模型公司或齐聚A股
文章报道了人工智能大模型公司MiniMax正式启动科创板上市辅导,标志着其向A股市场迈进。此前,另一家大模型公司“月之暗面”也已启动上市流程,因此市场关注“大模型双雄”是否会师A股。MiniMax作为国内领先的大模型企业,其上市计划将吸引投资者关注,并可能推动AI板块热度。文章还提到,科创板对科技创新企业的支持政策,为这类公司提供了融资渠道,有助于其技术研发和商业化发展。
AI大模型在多个领域的应用场景介绍
AI大模型是基于深度学习算法的复杂模型,应用场景广泛。在图像识别方面,可用于物体检测、人脸识别等,覆盖安防、医疗、自动驾驶领域。自然语言处理支持文本分类、情感分析、机器翻译,应用于智能客服和搜索引擎。语音识别通过训练大规模数据实现语音合成和翻译,用于智能语音助手。推荐系统分析用户行为提供个性化内容,常见于电商和社交媒体。此外,大模型在金融领域用于风险评估和信贷审批,在医疗健康辅助诊断和药物研发,在教育提供智能辅导,在智能交通优化路况预测和自动驾驶,在农业提升产量,在工业制造优化生产流程。这些应用显著提升了各行业的效率和准确性。
AI大模型应用案例文档介绍
本文档介绍了AI大模型在实际应用中的多个案例,涵盖不同行业和场景。文档约2.12万字,共30页,发布于2025年3月2日,来自广东。内容详细展示了AI大模型如何解决具体问题,包括自然语言处理、图像识别、智能推荐等领域。通过分析这些案例,读者可以了解AI大模型的技术优势、实施方法和效果评估。文档旨在为企业和开发者提供参考,帮助他们更好地应用AI大模型提升效率和创新能力。该资源为VIP专享,需付费或权限访问。
AI大模型的应用场景介绍
本文档介绍了AI大模型在多个领域的应用场景,包括自然语言处理、图像识别、智能客服、内容生成等。文档指出,AI大模型通过大规模数据训练,能够提升任务处理效率和准确性,广泛应用于医疗诊断、金融分析、教育辅导等行业。同时,文档强调了模型部署的挑战,如计算资源需求和数据隐私问题,并展望了未来发展方向。整体内容简洁,约1.65千字,共3页,发布于2025年2月23日。
AI大模型应用今年将迎来爆发
2024年,中国AI大模型进入落地应用阶段,业内称今年为“大模型应用爆发元年”。多个领域取得进展:中国联通将AI用于医疗健康;巨人网络发布游戏AI大模型;小度科技推动AI教育变革;阿里云推出域名AI应用;理想汽车将大模型应用于智能座舱;哈啰分享AI落地实践。专家指出,大模型正从研发转向赋能各行各业,提升生产力,成为行业新方向。
中国AI大模型应用上天入地,卫星造字直播样样行
文章介绍了中国AI大模型在多个领域的创新应用。全球首颗AI大模型卫星于9月底发射,经过一个多月在轨测试,成功实现卫星自主决策和任务执行,无需将数据传回地面。团队已启动“星算计划”,计划2030年前建成由2800颗算力卫星组网的全球算力网。在地面应用方面,AI大模型被用于字体设计,效率提升10倍以上,成本降低80%;还应用于电商直播数字人,实现声音和文字内容的秒级生成。此外,智能体技术让手机等终端设备能自主完成任务,中国信通院发布了全球首份终端智能化分级标准,目前终端智能化水平普遍在L2-L3级别。
AI大模型在多个行业的应用实例
本文介绍了AI大模型在金融、政务、制造、教育、媒体与娱乐、公共安全、医疗保健、农业和游戏等多个领域的应用实例。在金融领域,AI用于智能投顾和知识文件管理;政务领域用于智慧城市和医保服务;制造领域用于自动驾驶和生产优化;教育领域用于个性化辅导;媒体与娱乐领域用于内容生成和个性化推荐;公共安全领域用于园区招商服务;其他领域包括医疗诊断、农业分析和游戏NPC创建。这些应用展示了AI大模型提升效率、优化决策和改善用户体验的广泛潜力。
Anthropic发布新AI模型,英伟达推出开源框架
本周AI领域动态频繁,Anthropic公司推出了其最新AI模型Claude Opus 4.8,进一步提升了语言理解和生成能力。同时,英伟达发布了开源AI框架Polar,旨在推动AI开发和应用。此外,百川智能也发布了新一代医疗大模型,专注于医疗领域的智能化解决方案。这些进展显示了AI技术在多个行业的快速发展和应用。
小米大模型降价最高达99%,雷军称三年投600亿做AI
小米宣布自研大模型MiMo-V2.5系列API永久降价,最高降幅达99%,并优化计费体系,取消上下文窗口区分,同等价格下Token用量提升5至8倍。降价主要针对V2.5核心系列,高阶模型价格不变。小米创始人雷军表示,未来三年将在AI领域投入600亿元,今年研发投入预计超400亿元。此前,DeepSeek也已开启永久降价。国内大模型市场呈现K型分化,通用模型降价走量,高端模型维持高价。