OpenAI 随 GPT-6 推出 Intelligent UI,ChatGPT 界面转向可视化交互
OpenAI 推出名为 Intelligent UI 的新界面,随新 GPT-6 模型于周三开始推送,在对话中大量加入可交互的视觉元素,如可点击按钮、针对特定任务定制的计算器、交互式图表和可编辑图形。
OpenAI 推出名为 Intelligent UI 的新界面,随新 GPT-6 模型于周三开始推送,在对话中大量加入可交互的视觉元素,如可点击按钮、针对特定任务定制的计算器、交互式图表和可编辑图形。
Meta 周三宣布其 Muse 助手推出独立 iPad 应用,距 9 月 8 日在 iOS 和 Android 上线仅一个月。据 Sensor Tower 估算,Muse 上线以来安装量已超过 660 万次。
微软在旧金山 Tech Week 活动上公布 Surface Laptop Ultra 的规格与价格,两个基础型号分别 2600 美元和 3700 美元起,选配更高内存和存储后最高 5900 美元,微软称最高配机型已售罄。
Google 发布会议记录应用 Google AI Edge Foresight,对标 Granola 等 AI 笔记工具,Mac 版可完全离线运行,使用 7.4 亿参数的端侧 EmbeddingGemma 2 模型跨应用记录会议内容。
Goodfire 发布一类新型 AI 监控器,通过读取模型内部激活信号而非重读输出,来发现失控的 AI 智能体,目前已向 Baseten 客户开放。在 Kimi K3 测试中,监控约 100 万次交互成本约 185 美元,而用较便宜的 AI 模型逐步检查需 5420 美元,顶级模型则约 20 万美元。
AI 与硬件初创公司 Natura 发布 99 美元智能戒指 Interface,按下手指即可让 AI 智能体完成任务、记录想法,无需掏出手机。
OpenAI 在 ChatGPT 中推出 Intelligent UI 功能,让回答可以结合图表、表单、可点击按钮等交互式视觉内容。OpenAI 表示训练了 GPT-6 判断何时生成交互视觉而非纯文本,以及如何在回答中排版,示例包括七速自行车结构图、麻将教学图和退休储蓄计算器等内联工具。
Simon Willison 的 token 计数 CLI 工具 ttok 发布 0.4 版,修复了 Click 警告、更新了 CI,并新增 --list-models 命令用于列出可用模型。该工具基于 OpenAI 开源的 tiktoken 库,可通过 uvx 直接运行,例如 cat file.txt | uvx ttok 即可统计 token 数。
Anthropic 推出名为 OSS Scanner 的免费服务,为选择加入的开源项目提供由自家最强模型(包括 Claude Mythos)生成的周期性安全漏洞扫描报告。
Extend 工程师 Bo Lau 搭建了一个模拟 Elizabeth Holmes 办公桌的网站,用户可打开她的 MacBook、翻看 iPhone,并运行 Theranos Edison 机器,其中的短信、邮件、幻灯片和文档均来自 United States v. Holmes 刑事庭审公开证物。
Anthropic 为 Claude 推出两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源。
AWS 介绍 Amazon Bedrock AgentCore payments 已正式可用,为 AI 智能体提供按需付费的托管能力,由基础设施层而非模型执行支出限额。
Google 在 Google Cloud 活动上宣布为 Gemini 引入统一智能体,可回答问题并代为完成任务,初期面向企业客户,之后再推向消费者。该智能体可接收目标而非仅指令,自行规划工作、调用自定义技能与工具,并连接 Google Workspace、Microsoft 365、Slack、Jira、Git 等内部系统,也支持通过 MCP 服务器安全接入。
Oracle 在招聘、工程和运营场景中,用 ChatGPT Work 和 Codex 把专家知识转化为快速、可复用的工作流,将原本需要数天的工作缩短到几分钟。
Google 发布实验性笔记应用 Google AI Edge Foresight,可完全离线转写会议和音频文件,免费使用,在 macOS 上基于其端侧模型 EmbeddingGemma 2 运行。
Google 在 Gemini at Work 活动上发布通用 Gemini AI 智能体,可在后台跨应用和设备工作,入口是 Gemini Enterprise 应用,用户能在单一界面里对话并派发任务。
Pollo AI 借助 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5,帮助创作者把创意转化为精细图像和电影级视频广告。
LegalOn 将 Codex 每日预估成本降低 65%,同时保持开发速度。其做法是按任务匹配 Astra、Sol 和 Luna,并对预算进行策略性管理。
Nvidia 正大力押注物理 AI,推出面向物理 AI 的全栈安全解决方案,目标指向更安全的 robotaxi 和人形机器人。该方案已被多家机器人公司采用。
Artcraft 品牌从可控 AI 图像视频编辑转向一套七款开源应用,复刻 Adobe 的 Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 和 Acrobat Pro 的界面与工具。
GitHub 发布与 Microsoft Applied Sciences 联合微调的 ModernBERT 分类器,用代码上下文识别无固定格式的密钥,可在 2 毫秒内评估一批候选密钥,据称能把可拦截的密钥数量提升一倍以上。
推荐理由:GitHub 用九个季度数据说明密钥泄露与开发速度的失衡,并给出把检测前移到 push 环节的模型方案。
微软研究院开源 Agent Lightning v1.0,这是一个约 3500 行代码的轻量级智能体 RL 框架,提出 Harnessed Agentic RL 训练范式,让部署时使用的同一套 agent harness 直接参与强化学习,无需在训练框架内重新实现智能体。
推荐理由:微软研究院开源 Agent Lightning v1.0,用约 3500 行代码把真实 harness 直接接入 RL 训练,并给出可复现的编码智能体训练结果。
Latent Space 采访了 Kubernetes 创始人 Craig McLuckie 和 Joe Beda,他们创办的 Stacklok 已从软件供应链安全转向基于 Kubernetes 的智能体方案,核心产品是 6 月起在 GitHub 开源的云原生 harness Mecatl。
Google 宣布其 SynthID 检测器现已支持所有合作方的水印,并在新网站 SynthID.com 上向所有人开放。此前非 Google 信任测试者只能通过询问 Gemini 来检测 SynthID,且旧检测器只识别 Google 自家的水印,ChatGPT 等带有 SynthID 的图像不会被标记。
OpenAI 为 ChatGPT for Teens 推出 College Planner,帮助学生管理大学申请,同时上线新的 flashcards 和 quizzes 功能。OpenAI 还宣布成立青少年 AI 委员会(teen AI council)。
微软研究院发布 Quine,一个面向生物学复杂性的 AI 研究系统,由跨序列、结构、功能、细胞状态和成像等多模态数据联合训练的生物学世界模型,以及连接模型、科学工具、文献和实验人员的交互式 harness 组成。
推荐理由:微软研究院公开 Quine 的生物世界模型与实验闭环设计,并给出胰腺癌化合物筛选的湿实验验证结果。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,智能体就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做定级并生成漏洞报告。
推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃定级交给 LLM 智能体,读者可了解其任务流分层与安全边界。
Google DeepMind 发布 AlphaGenome Atlas,一个包含人类基因组 90 亿个单核苷酸变异效应预测的平台,规模达 1PB,是 AlphaFold Database 的 30 多倍,已通过免费网站门户向学术研究开放。
推荐理由:AlphaGenome Atlas 把 90 亿个单碱基变异的预测结果做成可检索资源,读者可了解基因组解读的规模化路径。