--digest

POCHE DIGEST

OpenAI 在 API 中推出全双工语音模型 GPT-Live-1

OpenAI 宣布在 API 中开放语音模型 GPT-Live-1。该模型此前已在 ChatGPT 中推出,支持同时进行听与说,摆脱了传统“语音识别-大模型推理-语音合成”的串联级联架构,能够在单一模型内直接处理双向音频流,从而大幅降低交互延迟与轮替失误。

新 API 支持将复杂推理与工具调用委托给 GPT-6 Astra 等后端文本模型,并在系统提示词中调节语气、节奏与交流风格。在基准评测中,官方称其全双工测试性能相较 GPT-Realtime-2.1 提高 30 个百分点,且原生适配背景噪声过滤、静默管理与电话网络集成。

PlanetScale 推出 Postgres 分片方案 Neki

PlanetScale 发布针对 PostgreSQL 的水平分片解决方案 Neki,现已进入平台预览阶段。该方案旨在解决单机 PostgreSQL 在数据量激增后遇到的真空清理停滞、备份耗时过长与连接数瓶颈等扩展难题。

Neki 的每个分片均运行未经修改的标准 PostgreSQL 实例,保留原生的扩展、SQL 支持与存储引擎行为。应用通过 Neki 路由层经由标准 Postgres 协议接入,用户可通过 JSON 数据拓扑定义分片键,并直接在集群在线状态下执行分片迁移、版本升级与故障转移工作流。

立入禁止推出设计服务协议指南,呼吁行业建立过程付费共识

在经历一起耗时近一年、产出多套方案却遭遇客户全额索退预付款并提起诉讼的纠纷后,设计工作室立入禁止联合 Design360 公布了《设计服务协议指南与合同模板》。该文件参照美国专业设计协会(AIGA)框架并结合本土实践,针对修改上限、阶段验收、版权归属与诉讼管辖权等常见争议点制定了规范化条款。

访谈指出,国内商业设计长期存在以结果衡量一切、忽视过程试错与知识劳动价值的问题。立入禁止希望通过开源该模板,为议价能力较弱的中小型团队和年轻从业者提供法律参考标准,推动行业逐步从单纯“为结果付费”转向“为过程付费”。

Afra Wang 谈 AI 时代的内容生成与心智贫困

作家 Afra Wang 在 NOEMA 发表文章,反思大语言模型训练机制对人类阅读体验的侵蚀。文章回顾了简中互联网早期依靠奖惩机制运转的生态,指出当下利用 LLM 生成的模式化内容正在制造一种新型的创造力贫困。

作者认为,人类对文学与他人内心经验的追寻源自演化过程中对真实心智的渴望。而面对充斥着固定词汇和陈词滥调的生成式文本,读者正普遍承受着辨别机器伪装的心理负担,进而引发对无实质思想内容的反感与信任崩塌。

TanStack 发布轻量 Markdown 解析与渲染库 TanStack Markdown

开源前端工具团队 TanStack 发布 TanStack Markdown,专门面向技术博客与文档等受控内容场景。该库解析器体积压缩后仅 5 KB,HTML 渲染器约为 6.8 KB,且具备零运行时依赖和可序列化 AST 的特性。

该库并不追求完整覆盖 CommonMark 或 MDX 规范,而是侧重于确定性输出、容错能力与轻量体积。其提供 React 与 Octane 适配层,并支持 AI 流式输出模式和外部语法高亮扩展。

China Unhurried 为海外赴华游客提供英文出行指引

China Unhurried 是一家新上线的独立英文旅行指南平台,专为计划前往中国的海外访客提供实操建议。网站重点梳理了免签入境、移动支付设置、境内网络连接与高铁出行等前期准备流程,并推荐了以慢节奏探索主要城市的路线建议与社区交流活动。

Imbue 阐述“诚实软件”理念并展示开发工具套件

AI 研发机构 Imbue 提出“打造服务于用户而非厂商的诚实软件”主张。其主页展示了用于过滤社媒信息流的本地模型 Bouncer、并行代码代理调度工具 mngr,以及面向开发者的工作空间 Sculptor,同时公布了有关 AI 代码审查与深度学习理论的最新研究方向。