每天听简报,了解最新科技、AI、软件资讯
人工智能团队近期正式发布新一代轻量推理模型,采用创新的非对称编码解码架构。模型总参数量达五千多亿,但在处理输入时仅激活八十亿参数,生成输出时仅激活一百六十亿参数,兼顾了强大性能与极低算力开销。官方技术评测显示,新模型在推理速度与总耗时上显著优于旧款旗舰,同时大幅压缩了上下文缓存对显存的占用。随着官方同步下调服务调用价格,这场主打高能效与极致性价比的技术升级,正迎来开发者社区的全面检验。
进度保存在本设备 · 登录同步