智谱Open-AutoGLM能在手机跑多快?实测10款机型推理延迟数据曝光

第一章:智谱Open-AutoGLM部署手机

将智谱AI推出的开源大模型AutoGLM部署至移动端设备,是实现本地化智能推理的重要实践。借助轻量化模型压缩与推理框架优化,可在现代智能手机上运行高性能语言模型。

环境准备

在开始前,确保手机已启用开发者选项并支持ADB调试。推荐使用搭载高通骁龙8系列或同等性能芯片的Android设备。
  • 安装Python 3.9+ 环境(可通过Termux应用)
  • 配置Android SDK 与 ADB 工具
  • 下载Open-AutoGLM的GGUF量化版本模型文件

部署步骤

通过以下命令在Termux中安装依赖:

# 安装基础工具
pkg install python git wget

# 安装 llama.cpp 运行时支持
git clone https://github.com/ggerganov/llama.cpp
cd llama.cpp && make -j4
将量化后的AutoGLM模型转换为GGUF格式,并推送到手机存储:

# 假设模型已转换完成
adb push autoglm-Q4_K.gguf /sdcard/models/
启动本地推理服务:

# 在llama.cpp目录下执行
./main -m /sdcard/models/autoglm-Q4_K.gguf -p "你好,请介绍一下你自己" -n 128

性能参考

设备型号CPU推理速度 (tok/s)内存占用
Xiaomi 14骁龙8 Gen3283.1 GB
OnePlus 12骁龙8 Gen3303.3 GB
graph TD A[下载GGUF模型] --> B[配置llama.cpp] B --> C[推送模型至手机] C --> D[运行推理命令] D --> E[获取本地响应输出]

第二章:Open-AutoGLM移动端适配原理

2.1 模型轻量化与算子优化理论

模型轻量化旨在降低深度学习模型的计算开销与存储需求,同时保持较高的推理精度。常见的技术路径包括剪枝、量化、知识蒸馏和低秩分解。
量化示例
将浮点权重从FP32压缩至INT8可显著减少模型体积与推理延迟:

import torch
# 将模型转换为量化版本
quantized_model = torch.quantization.quantize_dynamic(
    model, {torch.nn.Linear}, dtype=torch.qint8
)
该代码使用PyTorch动态量化,仅对线性层进行权重量化,运行时自动处理激活值的浮点到整数转换,降低内存带宽消耗。
算子融合优化
通过融合连续算子(如Conv+BN+ReLU)减少内核启动次数,提升GPU利用率。优化后算子在推理阶段表现为单一计算单元,显著降低调度开销。

2.2 ONNX Runtime在手机端的推理机制

ONNX Runtime 在移动端通过轻量级运行时实现高效推理,支持 Android 和 iOS 平台的原生调用。其核心依赖于模型解析、内存优化与硬件加速的协同。
执行流程概述
  • 加载 ONNX 模型并进行图优化
  • 绑定输入输出张量
  • 调用本地执行器完成推理
代码集成示例
// 初始化 OrtSession
OrtEnvironment env = OrtEnvironment.getEnvironment();
OrtSession.SessionOptions opts = new OrtSession.SessionOptions();
opts.addDelegate(OrtSession.SessionOptions.Delegate.CPU);
OrtSession session = env.createSession(modelPath, opts);
上述 Java 代码展示了在 Android 端加载 ONNX 模型的基本流程。OrtEnvironment 是全局运行环境,SessionOptions 可配置 CPU 或 GPU 委托,createSession 启动模型加载与图初始化。
性能对比
设备推理延迟(ms)内存占用(MB)
iPhone 134589
Pixel 66295

2.3 量化技术对推理速度的影响分析

量化技术通过降低模型权重和激活值的数值精度,显著提升推理速度并减少内存占用。常见的量化方式包括8位整型(INT8)和16位浮点(FP16),相比传统的FP32,在保持较高精度的同时大幅减少计算开销。
量化前后性能对比
精度类型计算延迟(ms)内存占用(MB)
FP32120520
FP1685260
INT860130
典型量化代码示例
import torch
model.quantize(torch.int8)  # 将模型量化为8位整型
该代码调用PyTorch内置量化接口,将浮点模型转换为INT8格式。量化后张量以低比特存储,利用SIMD指令加速矩阵运算,从而在CPU和边缘设备上实现更快推理。

2.4 多线程调度与CPU/GPU协同策略

在高性能计算场景中,多线程调度需充分协调CPU与GPU的计算资源。通过线程池管理CPU任务,并利用异步流(stream)机制将数据传输与核函数执行重叠,可显著提升并行效率。
任务划分与资源分配
合理划分计算密集型与I/O密集型任务,将矩阵运算等大规模并行任务交由GPU处理,而控制逻辑和任务调度保留在CPU端。

// CUDA异步执行示例
cudaStream_t stream;
cudaStreamCreate(&stream);
kernel_func<<grid, block, 0, stream>>(d_data);
cudaMemcpyAsync(h_result, d_data, size, cudaMemcpyDeviceToHost, stream);
上述代码创建独立流,实现核函数与内存拷贝的并发执行,减少空闲等待。
同步机制设计
使用事件(event)进行细粒度同步,避免全局阻塞:
  • cudaEventRecord标记关键时间点
  • cudaStreamWaitEvent实现跨流依赖控制

2.5 内存管理与模型加载延迟优化

在深度学习推理场景中,内存占用与模型加载速度直接影响服务响应性能。通过延迟加载(Lazy Loading)策略,仅在首次推理时加载模型参数,可显著降低初始化内存峰值。
内存池复用机制
采用预分配内存池减少频繁申请开销:
class MemoryPool {
public:
    void* allocate(size_t size) {
        // 从空闲块中查找合适内存
        for (auto it = free_list.begin(); it != free_list.end(); ++it) {
            if ((*it)->size >= size) {
                void* ptr = *it;
                free_list.erase(it);
                return ptr;
            }
        }
        return malloc(size); // 回退到系统分配
    }
};
该实现通过维护空闲块链表,避免重复调用系统 malloc,提升分配效率。
模型分块加载策略
  • 将大模型拆分为子模块独立加载
  • 利用 mmap 映射权重文件,实现按需读取
  • 结合 LRU 缓存淘汰非活跃模型

第三章:测试环境构建与基准设计

3.1 测试机型选择与硬件参数归一化

在性能测试中,测试机型的多样性可能导致结果偏差。为确保数据可比性,需选取具有代表性的设备,并对关键硬件参数进行归一化处理。
典型测试机型配置示例
  • 高端机:8核CPU、12GB RAM、UFS 3.1存储
  • 中端机:6核CPU、6GB RAM、UFS 2.2存储
  • 低端机:4核CPU、3GB RAM、eMMC 5.1存储
硬件参数归一化方法
通过线性映射将原始硬件指标转换为标准分值:

def normalize_cpu_cores(cores):
    return (cores - 4) / (8 - 4)  # 映射到 [0, 1]
    
def normalize_ram(ram_gb):
    return (ram_gb - 3) / (12 - 3)
上述函数将CPU核心数与内存容量分别归一化至[0,1]区间,便于跨设备横向对比性能表现。

3.2 推理延迟与功耗测量方法论

在评估边缘AI设备性能时,推理延迟与功耗是核心指标。精确测量需在真实负载场景下进行,确保数据代表性。
时间戳同步采样
使用硬件级时间戳记录推理开始与结束时刻,避免操作系统调度偏差:

// 读取CPU周期计数器
uint64_t start = __rdtsc();
model_inference(input);
uint64_t end = __rdtsc();
uint64_t cycles = end - start;
该方法捕获底层执行周期,结合主频可换算为实际时间延迟,精度达纳秒级。
功耗测量配置
通过外接功率分析仪(如Monsoon Power Monitor)采集运行期间的电流电压序列,计算平均与峰值功耗。典型测试流程包括:
  • 设定恒定输入帧率模拟持续负载
  • 同步采集推理时间与功耗数据
  • 多次运行取统计均值以消除波动
综合性能指标计算
指标公式
能效比TOPS/W = 峰值算力 / 实测功耗
延迟-功耗积Latency × Power

3.3 实验数据采集与误差控制方案

数据同步机制
为确保多节点实验数据的时间一致性,采用NTP(网络时间协议)进行时钟同步,并在采集端设置时间戳校验机制。所有传感器数据上传前需携带精确到毫秒的时间标记。
# 数据采集示例代码
import time
import ntplib

def get_precise_timestamp():
    client = ntplib.NTPClient()
    response = client.request('pool.ntp.org')
    return response.tx_time  # 获取高精度时间戳
该函数通过公共NTP服务器获取全局统一时间,有效降低因本地时钟漂移导致的数据错位问题,误差可控制在±10ms以内。
误差抑制策略
  • 对高频噪声采用滑动平均滤波算法
  • 设定合理采样频率避免混叠效应
  • 引入冗余传感器进行数据交叉验证

第四章:10款机型实测结果深度解析

4.1 高通平台机型推理性能对比

在主流高通骁龙平台中,不同机型的AI推理性能受NPU算力、内存带宽与软件优化共同影响。以骁龙8 Gen2与Gen3为例,其在典型端侧大模型推理任务中的表现差异显著。
推理延迟与吞吐量对比
平台型号NPU算力 (TOPS)7B模型推理延迟 (ms/token)INT8量化支持
骁龙8 Gen227145
骁龙8 Gen34589
代码执行示例
// 使用Qualcomm SNPE运行推理
snpe->setRuntime(SNPE_RUNTIME_DSP); // 优先使用DSP核心
snpe->input("input_ids", tokens);
snpe->execute();
float* output = snpe->output("logits");
上述代码通过SNPE框架将模型部署至DSP运行,Gen3因架构优化,在相同API调用下获得更高吞吐。

4.2 苹果A系列芯片表现分析

苹果A系列芯片自A4以来持续推动移动计算性能边界。基于台积电5nm工艺打造的A17 Pro,采用6核CPU架构,包含2个高性能核心与4个能效核心,显著提升多任务处理能力。
架构演进趋势
  • A14:首次采用5nm工艺,NPU算力达11TOPS
  • A16:内存带宽提升至50GB/s,支持更高帧率图形渲染
  • A17 Pro:引入硬件级光线追踪支持,GPU性能提升20%
神经网络引擎性能对比
芯片型号NPU算力 (TOPS)晶体管数量 (亿)
A1515.8150
A17 Pro35190
// 模拟A17 Pro NPU执行图像识别任务
void npu_image_inference() {
    load_model("vision_transformer.bin"); // 加载模型
    preprocess_input(image_buffer);       // 图像预处理
    execute_on_npu();                     // 在NPU上执行推理
    output_results();                     // 输出分类结果
}
该代码模拟了A17 Pro芯片上NPU运行视觉Transformer模型的过程,体现其对复杂AI任务的硬件优化支持。

4.3 中低端机型运行稳定性评估

在中低端设备上保障应用稳定运行,需重点关注内存管理与主线程负载控制。此类设备通常配备1GB~2GB RAM,且CPU主频较低,易因资源过载引发ANR或崩溃。
内存使用监控策略
通过Android Profiler可实时观测内存波动,建议结合Debug.getNativeHeapAllocatedSize()进行定期采样:

// 每5秒检测一次内存使用
Handler handler = new Handler();
Runnable memoryCheck = () -> {
    long allocated = Debug.getNativeHeapAllocatedSize() / 1048576;
    if (allocated > 800) { // 超过800MB告警
        Log.w("MemoryMonitor", "High memory usage: " + allocated + " MB");
    }
    handler.postDelayed(memoryCheck, 5000);
};
该机制有助于识别内存泄漏趋势,及时释放非必要资源。
帧率与卡顿统计
使用FPS监控工具评估界面流畅性,典型数据如下表所示:
设备型号平均FPSANR率
Redmi 9A522.3%
Honor 8X561.8%

4.4 温控降频对长时间推理影响

在持续高负载的AI推理任务中,芯片温度上升会触发温控(Thermal Throttling)机制,导致处理器自动降频以防止过热。这一机制虽保障了硬件安全,却显著影响推理性能的稳定性。
性能波动实测数据
工作时长(min)频率(GHz)推理延迟(ms)
0–103.245
30–402.578
系统级应对策略
  • 优化散热设计:采用均热板与高导热硅脂提升散热效率
  • 动态电压频率调节(DVFS):结合负载预测提前调整功耗模式
  • 推理任务调度:将长序列任务拆分为短周期批处理,避免持续高温
// 示例:读取CPU当前频率(Linux系统)
#include <stdio.h>
int main() {
    FILE *f = fopen("/proc/cpuinfo", "r");
    char line[256];
    while (fgets(line, sizeof(line), f)) {
        if (strstr(line, "cpu MHz")) {
            printf("Current CPU Frequency: %s", line);
        }
    }
    fclose(f);
    return 0;
}
该代码通过解析/proc/cpuinfo获取实时频率,可用于监控温控触发前后的频率变化,辅助性能分析。

第五章:结论与未来部署建议

持续集成与自动化部署的最佳实践
在现代云原生架构中,CI/CD 流水线的稳定性直接影响发布效率。建议使用 GitOps 模式管理 Kubernetes 部署,通过 ArgoCD 同步集群状态。以下是一个典型的 CI 阶段定义示例:

stages:
  - build
  - test
  - deploy-staging
  - security-scan
  - deploy-prod
每个阶段应包含自动化测试和安全扫描,确保只有通过验证的镜像才能进入生产环境。
监控与可观测性增强策略
为提升系统稳定性,建议部署完整的可观测性栈。以下组件构成核心监控体系:
  • Prometheus:采集指标数据
  • Grafana:可视化展示
  • Loki:日志聚合分析
  • OpenTelemetry:分布式追踪注入
在微服务中注入 OpenTelemetry SDK,可实现请求链路的端到端追踪。
资源优化与成本控制方案
云成本常因资源配置不当而失控。建议定期执行资源评估,参考以下 CPU/Memory 使用率基准调整 Pod 配置:
服务类型平均 CPU 使用率推荐 Request
API 网关35%500m
后台任务60%800m
结合 Vertical Pod Autoscaler 自动调整资源请求,避免过度分配。
已经博主授权,源码转载自 https://pan.quark.cn/s/a4b39357ea24 ### TDS 2014示波器使用手册知识点总结 #### 一、TDS 1000B 和 TDS 2000B 系列数字存储示波器概述 - **产品系列**: TDS 1000B 和 TDS 2000B 是由 Tektronix 公司所研发并推出的数字存储示波器产品线。 - **功能定位**: 主要致力于为电子工程师以及研发人员提供具备高性能与高精度的信号测量设备。 - **应用领域**: 此类设备被普遍应用于教育机构、研发实验室以及工业生产过程中的测试环节。 #### 二、TDS 2014示波器基本操作与使用 - **开机与基本设置**: - 在启动设备时,必须确保仪器已经正确接地。 - 在使用之前,需要根据观察需求设定合适的屏幕亮度、对比度等显示参数。 - **通道选择与配置**: - 可以通过触摸显示屏或设备前面板上的按钮来选定需要进行的测量通道。 - 可依据实际需求来调整垂直灵敏度、水平时间基准等设置项。 - **触发设置**: - 触发模式包括自动、常态、单次等种选择。 - 触发源与阈值设定涉及确定触发信号的具体来源及其电压阈值水平。 - **测量与分析功能**: - 提供种自动测量功能选项,涵盖电压峰峰值、频率等参数的测量。 - 支持对波形进行数学运算,例如执行两个波形的相加或相减操作。 #### 三、TDS 2014示波器高级特性 - **波形捕获率**: - 波形捕获率越高,意味着在检测偶发事件方面的能力越强。 - **波形存储与回放**: - 支持将波形数据存储到内部存储单元或外部存储设备中。 - 用户能够随时调取先前保存的波形数据,以进行深入分析。 - *...
内容概要:本文聚焦2026年高教社杯全国大学生数学建模竞赛B题“无线电干扰源的速自动定位与清除”,同时整合了个数学建模与工程技术仿真研究资源,涵盖SEM广告投放策略优化、无人机协同路径规划、电力系统无功优化、微电网调度、负荷预测、电动汽车响应率建模等个领域。其中重点详述了SEM广告投放策略的系统性建模,构建了从问题诊断、关键词分类、预算优化到不确定性环境下鲁棒决策的完整框架。提出基于成本—效益二维归一化的五类关键词划分方法(黄金词、重点词、潜力词、问题词、无效词),并建立了0-1整数规划与CVaR鲁棒优化模型,实现注册转化最大化与风险控制的平衡。文档还汇集了大量基于Matlab/Simulink的仿真资源,涉及智能优化算法、机器学习、信号处理、路径规划等方向,并配套提供代码与论文支持,形成跨学科的技术资源共享平台。; 适合人群:具备一定数据分析与建模基础,正在准备数学建模竞赛或从事科研工作的本科生、研究生及工程技术人员。; 使用场景及目标:①应用于数学建模竞赛备赛,学习目标优化、分类模型、鲁棒决策等建模范式;②开展广告投放、电力调度、路径规划等领域的科研项目时借鉴模型构建与算法实现方法;③通过提供的Matlab/Python代码速复现经典或前沿研究成果,提升科研效率与实践能力。; 阅读建议:此资源集合了个独立研究主题,建议读者根据自身研究方向选择性阅读,重点关注模型构建逻辑与算法实现细节,并结合所提供的Matlab/Python代码进行实践验证,以加深理解与应用能力。
打开链接下载源码: https://pan.quark.cn/s/a89f7876a37d 将硅片上的电路管脚通过导线引至外部连接点,目的是为了与其他设备建立连接。封装类型指的是用于固定半导体集成电路芯片的外壳结构。这种外壳不仅承担着固定、密封、保护芯片以及改善电热特性等重功能,同时通过芯片上的接触点利用导线连接至封装外壳的引脚,这些引脚再经由印刷电路板的线路与其他部件相连,从而完成芯片与外部电路的沟通。由于芯片必须与外界隔绝,以避免空气中杂质对电路造成腐蚀导致性能恶化,因此封装后的芯片也更为便于实施安装和运输。封装工艺的优劣直接关联到芯片自身特性和与之相接的PCB(衡量芯片封装技术水平的重要参照是芯片面积与封装面积的比例,这一比例越趋近于1则表示效果更佳。 【封装】在半导体产业中占据核心地位,其操作是将硅片上的电路端子借助导线连接至外部端口,以便与其他电子部件相接。封装的核心功能涵盖了固定、密封、保护芯片以及优化电热表现。封装外壳不仅作为芯片的物理防护层,更通过引脚将芯片与外部电路相连接,确保芯片功能的正常运作。封装的样式丰富样,常见的有DIP(双列直插式封装)、SOP(小型封装)、SMD(表面贴装封装)、TO(晶体管封装)等。其中,TO-92是一种较为古老的晶体管封装方式,用于小功率晶体管,其特征是在封装底部设有金属引脚,两侧各有两个引脚,外形类似字母“L”。 封装技术的革新直接影响芯片性能及其连接的PCB(印刷电路板)的工作效能。一个卓越的封装布局应尽可能减小芯片面积与封装面积的比率,从而提升封装的效率。除此之外,封装设计还需关注引脚的长度、间距、散热等要素,以减少信号传输的延迟,避免相互间的干扰,并确保良好的散热条件。封装技术的演进轨迹可从早期的TO封...
代码下载链接: https://pan.quark.cn/s/a4b39357ea24 依据所提供的文件资料,可以判断出这段代码与通过GPS数据计算电离层总电子含量(Total Electron Content, TEC)存在关联。尽管代码片段并不完整且包含了一些未完成的功能,但依然可以从现有资料中提取出一些关键性的知识点。 ### 1. 电离层总电子含量(TEC) **定义:** 电离层总电子含量(Total Electron Content, TEC)是指沿着信号传输路径单位面积上的电子总体数量,通常以TECU作为计量单位(1 TECU 等于 10^16 m^-2)。它作为研究电离层的重要指标之一,在卫星通信、导航系统以及遥感技术等领域具有关键性的应用意义。 **作用:** - **卫星通信与导航:** 掌握TEC数据有助于降低电离层对卫星信号的干扰,从而提升定位的精确度。 - **气象学与空间天气研究:** 通过监测TEC的动态变化,能够预测气象现象,特别是在太阳活动达到高峰的时期。 ### 2. GPS数据在TEC计算中的应用 **原理概述:** 电离层对GPS信号传播的主要影响表现为信号延迟现象。不同频率的GPS信号在穿过电离层时,由于受到不同电离层成分的作用会产生不同的延迟效果。因此,可以通过比较不同频率信号到达接收设备的时间差异来推算出电离层中的电子密度分布,进而得出TEC值。 **计算方法:** 一种常用的方法是通过双频观测数据来估算TEC。假设GPS接收设备接收到了两个不同频率的信号,比如L1和L2,它们分别位于1575.42 MHz和1227.6 MHz。通过分析这两个信号的相位差,可以消除大部分与接收设备相关的误差,从而精确地估算出电离层延...
内容概要:本文针对直流调速双闭环系统,深入研究了在考虑积分饱和退饱动态与负载扰动情况下的控制器参数鲁棒整定方法,并通过Simulink平台实现了完整的系统建模与仿真实验。文章系统阐述了电流环与转速环的控制结构设计,重点剖析了积分饱和现象对系统动态响应的不利影响,提出了有效的退饱和策略以抑制超调并加恢复过程。在此基础上,构建了包含非线性环节和外部负载扰动的完整双闭环仿真模型,通过工况对比仿真验证了所提出鲁棒参数整定方法的有效性,显著提升了系统在复杂工况下的稳定性、抗扰能力和动态品质。; 适合人群:具备自动控制原理、电机拖动及Simulink仿真基础的电气工程、自动化、机电一体化等领域的高校本科生、研究生、科研人员以及从事电机控制相关工作的工程技术人员。; 使用场景及目标:①应用于高校自动化类课程的教学实践与实验设计,深化学生对PID控制、双闭环调速系统工作机理及非线性问题处理方法的理解;②为工业领域直流驱动系统的控制器调试、参数优化与抗扰设计提供理论指导和技术验证手段;③支撑科研工作中对非线性补偿、鲁棒控制策略等先进控制理论的研究与应用拓展。; 阅读建议:建议读者结合提供的Simulink模型进行同步操作与参数调试,重点关注积分饱和的发生条件与退饱和模块的设计逻辑,通过设置不同的负载扰动场景开展对比仿真,深入理解参数变化对系统动态性能的影响规律,从而全面掌握高性能直流调速系统鲁棒设计的核心技术要点。
内容概要:本文围绕某互联网公司SEM广告投放优化问题,构建了从投放策略诊断、关键词分类、预算约束下的投放优化到不确定环境下的鲁棒决策的完整建模体系。首先基于2025年数据从广告设计质量与创意、关键词管理、出价策略与预算、投放时间四个维度分析投放策略的合理性,揭示投入产出比的工作日与周末差异及春节、国庆等假日效应;其次提出成本—效益二维归一化分类框架,结合中位数分割与K-means聚类将关键词划分为黄金词、重点词、潜力词、问题词和无效词五类;进而建立以预期注册量最大化为目标、日预算与总预算双重约束的0-1整数规划模型,并设计贪心选词与拉格朗日对偶定价相结合的两阶段算法求解最优投放策略;最后引入CVaR鲁棒优化框架应对竞价、展现量、点击量、转化率等重不确定性,给出兼顾效益与风险的鲁棒策略。研究结果实现了单位注册成本下降约20%,预算结构显著优化,投放策略更具稳健性。; 适合人群:具备数据分析与建模基础,从事数字营销、广告优化、运筹优化等相关工作的研究人员或从业者,以及工业工程、管理科学、计算机等相关专业的高年级本科生与研究生。; 使用场景及目标:①应用于搜索引擎营销(SEM)广告的关键词管理与投放优化;②为预算有限条件下的数字广告投放提供科学决策支持;③在不确定性环境中实现效益与风险的平衡优化;④作为教学案例展示数据驱动决策、分类模型、整数规划与鲁棒优化的实际应用。; 阅读建议:本文兼具理论深度与实践价值,建议读者结合附件数据与结果模板,复现模型求解过程,重点关注关键词分类逻辑、两阶段算法设计及CVaR鲁棒框架的实现细节,并尝试将其推广至其他平台或周期动态优化场景中进行拓展研究。
评论
成就一亿技术人!
拼手气红包6.0元
还能输入1000个字符  | 博主筛选后可见
 
 条评论被折叠 查看
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值