图片与语音
添加相册图片、使用相机与分享进入、通过设备语音识别口述,并了解平台限制。
移动端采集取决于模型与平台。本页会区分已经实现的控件和实际验证证据。
图片要求
发送图片前请选择标有视觉能力的模型。当前模型没有该能力时,Cordy 会在本地拦截请求并提供更换模型操作。输入框一次可放入一张待发送图片;若选错,可在发送前移除。
Android 会在图片到达服务商前执行以下明确限制:
| 边界 | 已实现行为 |
|---|---|
| 源文件大小 | Android 能报告长度时,源文件超过 12 MiB 即拒绝 |
| 解码 | Android 无法解码为图片的内容会被拒绝 |
| 尺寸 | 按 EXIF 方向校正,再把最长边缩到不超过 1,600 像素 |
| 存储/请求格式 | 以质量 86 编码为 JPEG |
| 编码后大小 | JPEG 超过 4 MiB 时拒绝 |
选择器接受 Android 能解码的内容;Cordy 不会仅凭文件扩展名承诺支持。选择被拒绝时会显示四种结果之一:图片过大、该文件不是图片、CordyAI 无法读取该图片或无法附加该图片。请选择更小且可解码的图片、授予来源应用读取权限,或重新选择文件。导入失败时图片不会发往服务商。
Android 图片路径
点击附件控件并选择:
- 照片库——使用 Android 照片选择器挑选图片。
- 相机——在使用时授予相机权限,经 FileProvider 支持的相机路径拍摄 JPEG。
- 分享进入 Cordy——在其他应用中把一个
image/*项目分享给 Cordy;应用会打开对话并放入该图片。
Cordy 会在应用边界导入并压缩图片、显示预览、在发送后本地保存附件,并仅在构建服务商请求时读取其字节。相册选择与发送已有真机证据;相机与分享进入的人工检查在 v0.5.0 发布时仍未完成。
拒绝权限只影响对应采集路径。拒绝相机权限不会停用照片选择器。
Android 语音输入
点击麦克风。首次使用时,Cordy 会说明语音输入使用设备的语音识别服务;接受后再请求麦克风权限并调用 Android SpeechRecognizer。
识别结果会作为可编辑草稿出现,请在发送前检查。Cordy 不持久保存录音,也可以取消监听而不发送。实现与伪运行时结果已有覆盖,但真实麦克风转写冒烟在 v0.5.0 发布时仍未完成。
语音服务由设备提供,其网络行为与隐私条款不受 Cordy 控制。
iOS 状态
当前 iOS 源码明确把图片选择、相机与语音能力设为 false,因此这些入口会被隐藏。仓库未记录完成的 iOS 二进制链接、执行或冒烟;请勿把存储或分享的源码实现当作运行证据。
无障碍状态
源码为采集控件提供了无障碍名称与最小触控尺寸。发布所需的 TalkBack 人工检查——附件、相机、麦克风、权限恢复和不支持模型的控件——仍未完成,也没有 VoiceOver 运行证据。