
应用与工具
新工具、新功能,以及它们能帮你完成什么。
商汤 U1 Pro 上线,生成与多轮修改分入口提供
据量子位9月22日报道,商汤 SenseNova U1 Pro 正式版上线,可用于复杂图片生成,并面向企业客户提供多轮修改能力。创作者可在商汤小浣熊输入框下方选择“一图读懂”,再选择 U1 Pro。
使用入口存在区别:小浣熊目前仅支持复杂图片生成;企业客户可通过 API 或 SenseNova Studio 体验多轮修改。量子位通过申请邀请码在 Studio 中展示了局部改色、多图合成及连续修改等案例。
需要反复修改海报或商品图的用户,应先按入口选择功能;媒体展示的编辑案例不能保证每次生成都能保持其他细节不变。
技术与开发
模型、API、开源与工程实践,关注能力和使用边界。
OpenAI 发布 GPT-6 Sol、Luna,并介绍缓存改进
OpenAI 9月22日介绍 GPT-6 Sol 和 Luna,两款模型面向日常工作,提供不同的能力与成本平衡。
同日,OpenAI 介绍 GPT-6 的提示词缓存改进。提示词缓存用于复用已处理的输入计算;此次更新包括更高的缓存命中率、新诊断功能、显式断点及控制选项,官方将降低延迟和成本列为其用途。
选型时可分别考察模型能力与成本、重复输入的缓存收益;仅凭发布摘要,还不能量化具体任务能节省多少费用。
Copilot 逐步接入 Claude Opus 5.5
GitHub 9月22日宣布,Claude Opus 5.5 开始在 Copilot 中逐步开放,面向 Pro+、Max、Business 和 Enterprise 用户,可用于智能体编程、长时间任务与知识工作。入口包括 VS Code、JetBrains、Copilot CLI 等。
该模型按用量计费,采用提供商标价;企业与商业套餐管理员可通过模型策略管理访问。GitHub 称,早期测试中,其任务解决表现与 Opus 5 相当,同时使用更少步骤和词元,但这一描述不代表所有任务的表现。
团队试用前应先检查套餐和管理员策略,再用实际任务比较总用量;更少步骤不直接等于固定比例的账单下降。
Transformers 接入 GGUF,先支持苹果芯片本地推理
Hugging Face 9月22日宣布,Transformers 支持高效运行 GGUF 模型。GGUF 是常用于本地推理的模型文件格式,量化版本通过降低权重精度缩小体积。开发者可用 from_pretrained 加载,再沿用常规生成接口,也可通过 transformers serve 提供兼容 OpenAI 的 API。
初期重点是 Apple Silicon Mac 与 Qwen3.5 架构,需要 Transformers 主分支、兼容的 kernels 库及受内核构建支持的 PyTorch 版本。缺少兼容量化内核时,会回退到反量化加载,增加内存占用。
官方性能比较使用 M2 Max、32GB 统一内存的 MacBook Pro;Transformers 测量包含输入处理,llama.cpp 的对应结果仅统计输出生成,二者测试口径并不完全一致。
这项更新方便已有 Transformers 项目接入本地量化模型。部署时应确认量化内核成功加载,避免因回退路径低估内存需求。
AFTER READING
读完之后
本期可关注的实际变化是图像编辑入口、模型接入条件,以及本地推理所需的软件与硬件适配。
评论