图片与语音

添加相册图片、使用相机与分享进入、通过设备语音识别口述,并了解平台限制。

移动端采集取决于模型与平台。本页会区分已经实现的控件和实际验证证据。

图片要求

发送图片前请选择标有视觉能力的模型。当前模型没有该能力时,Cordy 会在本地拦截请求并提供更换模型操作。输入框一次可放入一张待发送图片;若选错,可在发送前移除。

Android 会在图片到达服务商前执行以下明确限制:

边界已实现行为
源文件大小Android 能报告长度时,源文件超过 12 MiB 即拒绝
解码Android 无法解码为图片的内容会被拒绝
尺寸按 EXIF 方向校正,再把最长边缩到不超过 1,600 像素
存储/请求格式以质量 86 编码为 JPEG
编码后大小JPEG 超过 4 MiB 时拒绝

选择器接受 Android 能解码的内容;Cordy 不会仅凭文件扩展名承诺支持。选择被拒绝时会显示四种结果之一:图片过大该文件不是图片CordyAI 无法读取该图片无法附加该图片。请选择更小且可解码的图片、授予来源应用读取权限,或重新选择文件。导入失败时图片不会发往服务商。

Android 图片路径

点击附件控件并选择:

  • 照片库——使用 Android 照片选择器挑选图片。
  • 相机——在使用时授予相机权限,经 FileProvider 支持的相机路径拍摄 JPEG。
  • 分享进入 Cordy——在其他应用中把一个 image/* 项目分享给 Cordy;应用会打开对话并放入该图片。

Cordy 会在应用边界导入并压缩图片、显示预览、在发送后本地保存附件,并仅在构建服务商请求时读取其字节。相册选择与发送已有真机证据;相机与分享进入的人工检查在 v0.5.0 发布时仍未完成。

拒绝权限只影响对应采集路径。拒绝相机权限不会停用照片选择器。

Android 语音输入

点击麦克风。首次使用时,Cordy 会说明语音输入使用设备的语音识别服务;接受后再请求麦克风权限并调用 Android SpeechRecognizer

识别结果会作为可编辑草稿出现,请在发送前检查。Cordy 不持久保存录音,也可以取消监听而不发送。实现与伪运行时结果已有覆盖,但真实麦克风转写冒烟在 v0.5.0 发布时仍未完成。

语音服务由设备提供,其网络行为与隐私条款不受 Cordy 控制。

iOS 状态

当前 iOS 源码明确把图片选择、相机与语音能力设为 false,因此这些入口会被隐藏。仓库未记录完成的 iOS 二进制链接、执行或冒烟;请勿把存储或分享的源码实现当作运行证据。

无障碍状态

源码为采集控件提供了无障碍名称与最小触控尺寸。发布所需的 TalkBack 人工检查——附件、相机、麦克风、权限恢复和不支持模型的控件——仍未完成,也没有 VoiceOver 运行证据。