来源 :沐曦股份MetaX2026-09-20
9月X日,中国电信旗下星辰通用人工智能实验室正式开源TeleChat3-438B-A24B大模型。同日,凭借自研高性能通用GPU与MXMACA软件栈一体化协同的产品优势,沐曦股份率先完成对TeleChat3-438B-A24B的Day 0适配,实现“上线即适配”。
此次成功完成Day 0适配,充分验证了沐曦自研MXMACA 软件栈的卓越兼容性与深度优化能力。作为“自主 GPGPU 硬件+全栈软件体系”的核心枢纽,MXMACA软件栈承担着连接底层算力硬件与上层 AI 应用生态的关键纽带作用。它不仅全链路覆盖底层驱动、用户态接口、MXCC 编译器、算子深度适配、主流训练/推理框架对接及行业场景专项优化。目前,MXMACA软件栈已实现对主流AI生态的广泛覆盖:兼容支持40余种AI框架、1000多款模型,适配超6000个开源项目测试,全量支持PyTorch 2.8的2410个GPU算子。
“Agent+编程”双场景优化,聚焦工程化落地
TeleChat3-438B-A24B是面向工程落地的智能体与代码专用大模型。模型采用MoE(稀疏混合专家)架构,总参数量达4380亿,单次前向激活参数为240亿,激活比为5.5%,在保持高性能的同时实现高效推理。
同时,模型还支持256K超长上下文窗口,具备深度代码理解、多步骤Agent规划与复杂工具调用能力,专为真实软件开发与自动化工作流场景设计,为各类工程开发与智能体落地场景提供高性能、高效率的核心支撑。
作为一款面向工程落地的智能体与代码专用大模型,TeleChat3-438B-A24B模型针对代码生成、智能体工作流两大场景进行了深度专项优化。
在代码生成场景,模型突破单文件代码生成的局限,支持完整工程级编码任务。针对 TeleAgent、OpenCode、Claude Code 等主流编码 Agent 工作流进行专项优化,能够做到:
全栈代码生成:覆盖前端、后端、脚本、流水线配置,输出符合工程规范、可直接运行的代码,支持组件封装、接口设计与数据模型定义。
代码仓库理解与调试:支持读取完整项目代码库,完成多文件跨模块分析、Bug 定位、diff 修改方案输出、代码重构与性能优化;可完成代码迁移、格式转换与工程问题复现,输出完整分析报告。
环境感知编码:适配终端执行与代码沙箱场景,能够理解运行报错信息并迭代修复问题;兼容 Claude Code 工程协作范式,擅长多轮迭代调试,处理复杂的真实开发问题。
在智能体场景,模型擅长多步骤规划、工具调度与外部信息整合,针对 OpenClaw、Hermes-Agent 等开源 Agent 框架深度适配,能够做到:
复杂任务规划拆解:面对复合目标,能够自主拆解子任务、制定执行链路,支持多轮迭代执行,具备任务回溯、失败重试与方案调整能力。
强工具调用能力:稳定调用代码执行、搜索检索、文件读写、API 调用等各类工具;支持工具结果的解析、过滤与归纳,将外部返回信息融入推理,完成闭环任务。
搜索与信息融合:支持网页浏览与多源信息检索,能够筛选有效信息,结合已有知识完成复杂问答、资料整理与调研类任务。
国产底座全栈赋能,加速模型落地闭环
自2025年12月以来,沐曦股份已完成36个主流顶尖模型Day 0适配。范围涵盖智谱AI、阿里千问、MiniMax、DeepSeek、阶跃星辰、腾讯混元等头部厂商,适配速度、数量、生态广度均位居行业前列。以智谱为例,其推出的GLM-4.6V、GLM-OCR、GLM-5、GLM-5.1、GLM-5.2、GLM-5.3-Flash等全系列模型,沐曦股份均实现Day 0同步适配。
未来,沐曦股份将长期致力推动国产算力从“可用”走向“好用”“易用”,持续深化与国内顶尖AI团队的技术协同,构建自主可控、高效繁荣的国产AI生态。