--digest

POCHE DIGEST

OpenAI 预览 GPT-5.6 Sol Ultrafast 模式:推理速度提升至 14 倍

OpenAI 宣布在 API 中推出全新服务层 Ultrafast 预览版,依托与 Cerebras 的合作,将旗舰模型 GPT-5.6 Sol 的输出速度提升至最高每秒 750 个 Token,处理速度达到标准模式的 14 倍。该技术突破旨在解决高智力模型在实时高时效场景中的性能瓶颈,使前沿 AI 能够直接嵌入对响应延迟要求极高的核心业务流程。

该模式重点面向系统故障响应、金融市场分析、实时语音客服及高频研究实验等场景。OpenAI 内部团队已将其用于日志分析与实时修复,并将传统需隔夜运行的研究实验缩短为单日内的多轮交互。服务目前已面向部分企业客户开放测试,后续将逐步扩大接入范围。

Zed 团队推出 AI 协作编程平台 Delta:保留上下文的实时代码审查

Zed 团队正式推出了名为 Delta 的多玩家 AI 协作编程环境,旨在解决 AI 代理生成代码速度远超人工团队审查效率的痛点。Delta 在代码变更背后完整保留了提示词、推理逻辑、文件搜索及测试指令等全流程上下文,使开发者能够基于完整的决策脉络开展代码审查,而非面对孤立的代码 Diff。

该平台支持多名团队成员加入同一对话线程,与 AI 代理进行实时协作、提问与调整。性能测试显示,其采用的结构化缓存机制将百万级节点的树结构随机查找速度提升了 12 倍,确保在处理大型代码库时依然保持流畅体验。

密码学学者解析大模型“加密思维链”机制:API 隐式推理的数据保护与传输

密码学学者 Matthew Green 发文剖析了 OpenAI 与 Anthropic 大模型 API 中隐式推理(Chain-of-Thought)数据的加密传输机制。在 Responses 及 Messages API 中,服务商将未经删减的原始思维链封装为 Base64 编码的加密数据块返回给客户端,并在后续对话轮次中原样接收并解密,以此在无状态 API 架构下实现连续推理。

文章指出,这些数据块采用了 Fernet 或 GCM/ChaCha 等认证加密方案,防止客户端读取或篡改模型的内部逻辑。虽然篡改加密数据会触发 API 拒绝响应,但该机制展现了模型服务商在保持无状态会话灵活性与保障内部推理安全性之间的工程权衡。

X 开源“为您推荐”算法重大更新:补充权重配置、过滤系统与 Phoenix 训练代码

X 官方更新了推荐算法开源仓库 x-algorithm,公布了决定“为您推荐”信息流内容排序的核心代码与关键配置参数。本次更新首次公开了用于将多种预测行为融合为综合推荐分数的权重配置,并完整补充了控制内容屏蔽与展示逻辑的可见性过滤系统。

此外,仓库还集成了账号信用评估模型、多媒体内容审查模型以及安全标签系统,并将先前的 Phoenix 演示模型替换为实际训练 Phoenix 模型所需的代码及合成数据生成工具,允许开发者开展训练流程的概念验证。

Colossus 深度专访 Joshua Kushner:Thrive Capital 的投资哲学与进化路径

Colossus 刊发深度长文《The New World》,记录了 Thrive Capital 创始人 Joshua Kushner 的创业历程与投资思考。从 2010 年首期 500 万美元基金起步,到最新一期 33 亿美元基金,Thrive Capital 在 Stripe、OpenAI、Instagram 及 Spotify 等项目上的高集中度重仓布局,使其成长为科技投资领域的代表性机构。

文章探讨了 Kushner 在面对家族政治风波与外界怀疑时的心理调适,以及他对于依靠“无法言明的直觉”进行决策的坦诚思考。Thrive 坚持高度集中、跨阶段以及深耕被投企业运营支持的独特模式,深刻影响了当代风险投资行业的运作形态。

荣耀发布 Robot Phone:内置 4 自由度钛合金云台机械臂与 ARRI 电影色彩

荣耀官方推出创新形态手机 Honor Robot Phone,在手机内部集成了掌上 4 自由度钛合金机械臂云台。该云台具备 360°/s 的旋转转速与三轴机械防抖能力,支持 AI 主角跟随、双击锁定、九宫格预构图以及星空自动轨迹追踪等复杂拍摄动作。

在影像与硬件方面,该机首发搭载 ARRI 电影级色彩科学与 LogC3 录制格式,配备自研驭光 H1 影像芯片与双 2 亿像素主摄长焦组合;同时搭载第五代骁龙 8 至尊版移动平台及 7060mAh 青海湖电池,并通过 YOYO 机器人模式实现基于动作与语音的拟人化交互。

Google 发布 Gemini 3.7 Flash:推理能力升级且 API 价格降低 50%

Google 官方宣布推出 Gemini 3.7 Flash 模型,在保持 Flash 系列高响应速度的同时,通过算法改进提升了模型的综合智力表现。该模型已在 API、AI Studio 及 Antigravity 等平台同步上线,旨在更好地满足日常实际工作流的需求。

官方表示,Gemini 3.7 Flash 的 API 使用价格较 3.6 Flash 降低了 50%(优惠持续至年底)。本次发布展示了 Google DeepMind 在短时间内对轻量级高效率模型性能的快速迭代与成本优化。

Instagram 推出十年来首次重大品牌更新:全新手写标识与弹性视觉系统

Instagram 联合设计团队揭晓了该平台十余年来首次重大品牌形象更新,推出了全新的手写体 Wordmark 品牌标识与更加灵活的视觉系统。本次更新反映了 Instagram 从单纯的照片分享应用演变为涵盖多元表达、严肃对话与模因创作的全球社交平台的过程。

新视觉系统在保留相机图标与日落渐变色等核心资产的同时,强调鼓励日常创作与接受不完美感,通过类似草稿本式的弹性结构,为不同情境下的社区内容提供更广阔的表达空间。

AI 视频协作平台 Preview 亮相:整合脚本拆解、运镜控制与生成溯源

AI 视频生产平台 Preview 正式上线,为工作室与创作团队提供从分镜设计、AI 模型调用到最终剪辑的全流程协作环境。平台通过无限画布呈现参考图与镜头列表,可将脚本自动解析为场次与镜头清单,并支持多款前沿图像及视频生成模型并排运行与对比。

Preview 引入了智能 Agent 辅助概念发散与提示词拟定,并具备可记录模型参数与创作者信息的生成溯源(Provenance)机制,同时提供零数据留存与 SOC 2 Type II 等企业级安全保障。

macOS 工具 Notomo 发布:为 Apple Notes 赋予 Markdown 与上下文 AI 增强

桌面应用 Notomo 正式上线,旨在提升 macOS 原生 Apple Notes 的使用体验。该工具在保持原版应用界面不变的前提下,为其增加了实时 Markdown 语法转换、Slash 命令菜单、模版插入以及全局 Quick Open 搜索功能,并内置了 CJK 快捷输入别名。此外,Notomo 支持将本地“Skills”文件夹转化为提示词库,用户可接入 ChatGPT、xAI 或自定义 API 密钥,在不离开备忘录窗口的情况下基于笔记上下文开展修改、润色及提取行动项等 AI 辅助工作。

And—Now 为牛津中国政策实验室打造全新品牌形象与研究发布网站

设计工作室 And—Now 为牛津中国政策实验室(Oxford China Policy Lab, OCPL)设计了全新的品牌标识与研究发布网站。OCPL 致力于中美关系与人工智能交叉领域的风险研究,新品牌形象旨在兼顾学术机构的权威感与前沿地缘科技团队的活力。品牌系统以“子午线”(Meridian lines)为核心视觉概念,将经纬线的定位寓意融入 Logo 与网格结构中;网站采用浅层级、无干扰的排版布局,确保研究成果能够在桌面与移动端顺畅呈现。

设计师 Jeff Broderick 展示智能矢量绘图概念:引入 CAD 几何约束规则

设计师 Jeff Broderick 展示了一项智能化矢量绘图系统的概念演示,探讨将类似 CAD 软件中的几何约束规则引入常规平面设计的可能性。演示展示了在绘制路径与节点时应用切线等规则,使几何图形能够根据设定的约束条件实现智能形变与动态响应,为未来矢量设计工具的自动化与精确控制提供了新视角。