
应用与工具
新工具、新功能,以及它们能帮你完成什么。
剪映Hub连接视频生成与后期剪辑
据量子位9月20日现场报道,剪映在抖音创作者大会发布剪映Hub等新功能。PC端面向较复杂的视频制作,将脚本、分镜、素材生成接入同一环境,生成的视频可通过“更多剪辑”进入多轨道剪辑界面,继续延长片段或修改局部画面。
报道展示的Hub入口位于剪映首页;剪映助手可在剪辑界面接受文字要求,处理口播、字幕改误和批量成片等任务。手机端“AI创作”中的“随拍成片”支持提交素材与要求生成视频,助手也支持语音修改。通过剪映账号登录即梦、小云雀生成的素材,可一键导入。
对反复修改视频的创作者,值得关注的是生成素材能否顺畅进入剪辑工程,以及局部修改能否保住已有画面。
智达AI输入法支持藏语方言与三语混合输入
据IT之家转述科技日报报道,9月20日,藏语智能全国重点实验室研发的智达AI输入法在青海师范大学发布,面向藏语及多语言输入需求,覆盖手机、电脑,支持通过统一账号同步词库与输入习惯。
文本输入遵循国家标准藏语键盘布局,并支持藏文拉丁转写;语音输入覆盖卫藏、安多、康巴三大方言,支持汉、藏、英混合语音。OCR即从图片中识别文字,可处理照片或截图中的三语混合文本,用于文献数字化、教学材料整理与办公。配套藏文字体集同步发布。
技术与开发
模型、API、开源与工程实践,关注能力和使用边界。
Qwen-Image-2.1开源,统一透明图像生成与编辑
千问官方9月20日宣布开源Qwen-Image-2.1,将文生图和图像编辑整合进同一模型。其视觉生成部分为7B,即70亿参数;支持生成和编辑带透明背景的图像,也能从照片中提取主体,输出带透明通道的图层。
模型最多接收10张参考图,支持圈选、涂抹以及原图配合独立掩码指定修改区域。推理侧采用混合粒度注意力,并通过KV Cache缓存复用输入图像与编辑指令的计算结果,以减少重复计算和显存开销。官方提供GitHub、Hugging Face和ModelScope入口。
设计与电商团队可重点验证透明边缘、商品文字和多图主体一致性。官方展示的效果与效率优势,仍需在自己的素材和部署环境中核验。
智谱预告数据不留存功能,须申请并确认适用范围
据IT之家9月20日报道,智谱MaaS模型服务平台宣布近期将上线数据内容不留存功能。任何用户均可通过控制台申请,具体生效时间和适用范围以平台确认为准。生效后,覆盖范围内的输入输出不作静态存储,仅用于完成当次调用。
该机制有明确例外:需要持久化保存任务或文件的Batch API、File API不在覆盖范围内;法律法规要求留存,或核查涉嫌违规、滥用行为时,相关数据可能留存30天及以上。
企业评估时应逐一确认所用接口是否覆盖,并以平台确认的生效范围作为数据处理依据。
AFTER READING
读完之后
本期关注视频创作、多语言输入、图像模型与调用数据保护。
评论
最多 6 张图片,每张不超过 5 MB。点击图片查看大图,拖拽图片调整顺序,也可聚焦图片后使用方向键排序。