--digest

POCHE DIGEST

DeepSeek 推出多模态实验模型 V4-Flash-Vision-Exp 与 Files API

DeepSeek 宣布在 API 平台上线实验性多模态模型 DeepSeek-V4-Flash-Vision-Exp。官方表示,该模型在推理、通用知识和智能体等纯文本能力上保持了 V4-Flash 的基准水平,并在多模态智能体评测中大幅提升,表现接近 Opus-4.8。

该模型支持图文混合输入,单张图片按最多 384 个 Token 计费。同时上线的 Files API 允许用户免费上传并跨请求复用图片文件,降低传输带宽消耗;配套的 DeepSeek Harness 0.1.1 也已同步提供支持。

Omacom 基金会成立,获 800 万美元初始资金支持开源桌面生态

Omarchy 宣布成立非营利组织 Omacom 基金会,致力于推动桌面 Linux 生态与新型计算环境的发展。基金会获得了 800 万美元的初始启动资金,由 8 位创始赞助人各出资 100 万美元,赞助者包括 Shopify 的 Tobi Lütke、Stripe 的 Patrick Collison、Dell Technologies 的 Michael Dell、Block 的 Jack Dorsey、Cloudflare 的 Matthew Prince、Sesame 与 Oculus 联合创始人 Brendan Iribe 以及 37signals 的 Jason Fried。

该基金会将持有相关商标、资助基础设施运营并支持 Omarchy 所依赖的开源项目与开发者。

Superwhisper 开源 0.6B 语音识别文本规整模型 S1-mini

Superwhisper 发布了专用于语音转文字后处理的轻量语言模型 S1-mini。该模型基于 Qwen3-0.6B 微调,总参数量约 5.96 亿,核心功能是将原始 ASR 转录稿中的语气词、口误、自我修正等口语特征转化为规范的书面文本,同时处理标点、大小写及日期数字格式。

在 7,519 条英文测试集上,S1-mini 取得了 94.8% 的 Token 准确率。量化后的 GGUF 文件大小约为 462 MiB,可在笔记本 CPU 上离线运行。模型通过首行控制语句支持 Casual、Semi-formal 等四种语域风格及列表、邮件等输出格式。

Vercel 推出网站 AI Agent 就绪度评测工具 Is Agentic

Vercel 发布了 Is Agentic 工具,用于检测和评估公开网站对 AI Agent 的可发现性与易用性。扫描由 Ora 驱动,核心评分关注服务端渲染、HTTP 行为、文档结构清晰度与错误恢复能力等基础要求,同时针对检测到 API、OAuth 或 MCP 服务的网站执行推荐检查。

报告除提供网页端视图外,还支持通过公共 JSON API 与只读 MCP Server 供外部 Agent 直接读取,便于开发者诊断自动化访问中的阻碍环节。

Runway 发布视频 HDR 转换模型 Runway Ruby

Runway 推出新模型 Runway Ruby,可将标准动态范围(SDR)视频转换为最高 16 位的 HDR 画面。该模型支持最长 30 秒的视频,支持输出 ProRes 和 EXR 序列帧,适用于上传的原素材及平台生成的视频资产升级。

ChatGPT 桌面端推出 Apple Messages 插件

OpenAI 宣布在 Mac 版 ChatGPT Work 和 Codex 中上线 Apple Messages 插件。安装后,用户可在 ChatGPT 中直接检索信息、跟进未读对话,并结合日程等上下文生成或发送短信回复。

crt.name 上线被动式子域名检索索引与 MCP 接口

crt.name 是一个被动子域名检索服务,通过实时解析 Chrome 和 Apple 认可的证书透明度(CT)日志,并结合历史归档、Common Crawl 及 DNS 数据集构建域名库。服务提供免认证的免费 API 与 MCP Server,单个 IP 每日限额 1,000 次请求。

Claude Code 增加简洁输出模式配置

Anthropic 旗下的 Claude Code 命令行工具新增 Concise 输出模式。开启后,模型将优先直接输出执行结果并精简回复内容,用户可通过 `/config` 命令或在配置文件中设定启用。

Ora 发布网站 AI Agent 友好度评估工具与排行榜

Ora 推出面向 AI Agent 的网站体验评估工具与排行榜(Agent Experience Ranking v2),支持通过输入域名或 MCP 服务器 URL 检测网站对智能体的可发现性与可用性。

根据其平台数据,在已扫描的 16,297 个网站中,平均得分仅为 33 分,只有 2% 达到 B 级或以上评级。榜单涵盖开发者工具、基础设施、金融支付和 CRM 等多个领域,旨在衡量各平台适应自动化智能体交互的准备程度。