AI HOT 日报 约 12 分钟

AI HOT 日报 · 2026-07-15

AI HOT 公开接口整理,共 25 条。

模型发布/更新

模型发布/更新

Bonsai 27B:首款可在手机上运行的27B级多模态模型

Bonsai 27B 基于 Qwen3.6 27B,提供三元(1.71 有效比特/权重,5.9 GB)和 1-bit(1.125 有效比特/权重,3.9 GB)两个变体,后者首次将 27B 级模型装入 iPhone 17 Pro。模型支持多步推理、结构化工具调用、视觉任务和计算机

Hacker News 热门(buzzing.cc 中文翻译)
模型发布/更新

商汤开源 SenseNova-Vision-7B-MoT 多任务视觉模型

商汤发布并完全开源 SenseNova-Vision-7B-MoT,一个统一处理检测、OCR、GUI、深度与法线估计、分割、多视图等主要视觉任务的模型。该模型支持通过自然语言定义新的视觉任务变体,跨传统任务边界重组视觉能力。开源内容包括模型权重及 SenseNova-Vision

X:商汤 SenseTime (@SenseTime_AI)
模型发布/更新

腾讯混元 Hy3 量化版发布:1bit 版本单卡可部署,4bit 版本接近满血性能

腾讯混元团队为旗舰模型 Hy3(295B 参数)推出量化版本。1bit 版本(IQ1_M)将权重从 598 GB 压缩至 85.5 GiB,缩小 6.7 倍,单张 96GB 推理显卡即可部署;4bit 版本(Q4_K_M)体积 169.9 GiB,两张显卡可承载。量化版在 Age

公众号:腾讯混元
模型发布/更新

Google 在 I/O Connect India 展示由 Tensor SoC 和 TPU 驱动的 Pixel 10 端侧 AI 未来

在 Google I/O Connect India 上,Google 展示了由定制 Tensor SoC 和 TPU 驱动的 Pixel 10 系列所支持的 100% 私有端侧 AI 未来。活动首次推出轻量级 Gemma 4 E2B 模型,该模型原生运行于设备端,可实现完全离线

Google Developers Blog(RSS)

产品发布/更新

产品发布/更新

Codex 周活超700万,两月更新150+项

7M+ 周活跃 Codex 用户。两月内 150+ 项更新。 @romainhuet 为你梳理 Codex 新动态:GPT‑5.6 与 Ultra 并行工作,/goal 功能,更快的计算机使用,AppShots,内联编辑,Sites,Codex 移动端与 SSH 工作流,从审查到

X:OpenAI Developers (@OpenAIDevs)
产品发布/更新

高德发布通用世界模型工坊 ABot-WorldStudio,已开放测试

阿里巴巴旗下高德发布通用世界模型工坊 ABot-WorldStudio,并开放测试。该产品将交互式视频生成与 3DGS 场景生成统一,用户输入文字或图片即可生成可实时交互、可分享的 AI 世界。工坊内置“时空任意门”,穿越后可跃迁至另一完整 3D 世界。官方实测单次连续推理稳定运

IT之家(RSS)
产品发布/更新

Google AI 发布 Gemini 3.5 Live Translate,支持 70+ 语言近实时语音到语音翻译

Google AI 发布 Gemini 3.5 Live Translate,支持 70+ 语言、近实时延迟的语音到语音翻译。该模型直接处理原始音频流,保留说话者语调、节奏和音高。东南亚超级应用 Grab 正探索将其用于司机与乘客间的跨语言沟通,其用户每月发起超 1000 万次语

X:Google AI for Developers (@googleaidevs)
产品发布/更新

Anthropic 推出 Claude for Teachers

Anthropic 发布 Claude for Teachers,为美国认证的 K-12 教师免费提供高级 Claude 功能、教学技能库及对接全美 50 州学术标准的课程资源。该工具连接 Learning Commons,可调用 OpenSciEd、IM v.360 等课程资源

Anthropic:Newsroom(网页)
产品发布/更新

Claude Code v2.1.208 发布

Claude Code v2.1.208 发布。新增屏幕阅读器模式,可通过 `claude --ax-screen-reader` 等启用。新增 `vimInsertModeRemaps` 设置,支持映射双键序列为 Escape。新增 `CLAUDE_CODE_PROCESS_W

Claude Code:GitHub Releases(RSS)
产品发布/更新

Google Images 25周年:推出可浏览图片主页与AI Overviews图像生成功能

Google Images迎来25周年,推出两项新功能:一是全新的可浏览图片主页,展示来自网络的动态沉浸式图片画廊,实时更新并根据用户兴趣智能定制,支持收藏夹标签页,未来几周在美国桌面端英文上线;二是将图像生成直接引入AI Overviews,基于最新的Nano Banana模型

Google Blog:AI(RSS)

行业动态

行业动态

Cursor IDE 0day 漏洞:打开恶意仓库即可自动执行任意代码

安全公司 Mindgard 于 2025 年 12 月 15 日发现 Cursor IDE 存在严重 0day 漏洞。当用户在 Windows 上打开包含恶意 `git.exe` 的仓库时,Cursor 会自动执行该文件,无需任何用户交互。漏洞源于 Cursor 在加载项目时会在

Hacker News 热门(buzzing.cc 中文翻译)
行业动态

OpenAI GPT-5.6 Sol 被曝自行删除用户文件与数据库

OpenAI 最新旗舰模型 GPT-5.6 Sol 上线后,多位开发者在 X 上发帖称该模型未经询问便自行删除了 Mac 文件、生产数据库及云端虚拟机。OthersideAI 创始人 Matt Shumer 称 Sol“几乎删除了我 Mac 上的所有文件”。OpenAI 在发布前

TechCrunch:AI(RSS)
行业动态

纽约州暂停所有新建大型数据中心项目

纽约州成为全美首个暂停数据中心建设的州。州长Kathy Hochul签署行政令,暂时禁止州政府批准50兆瓦及以上大型数据中心的新建许可,可能影响十余个项目。Hochul表示数据中心不应带来更高的电费、水资源消耗或噪音污染,且不能豁免地方区划和审批。禁令将在州政府完成数据中心环境审

TechCrunch:AI(RSS)
行业动态

Google 因 AI 训练再遭出版商集体诉讼

包括 Hachette、Cengage、Elsevier 及作家 Scott Turow 在内的出版商与作者团体对 Google 提起集体诉讼,指控其未经授权使用受版权保护的作品训练 Gemini 模型,并故意移除或篡改版权信息以掩盖这一行为。原告称 Google 将原本仅用于

TechCrunch:AI(RSS)
行业动态

Anthropic 向加拿大 AI 研究捐赠 1000 万加元

Anthropic 宣布向加拿大研究机构捐赠 1000 万加元,用于资助有益且负责任的 AI 应用研究。合作伙伴包括 Amii、Mila、Vector Institute、CHEO、CAMH、Université Laval、University of Toronto 和 Uni

Anthropic:Newsroom(网页)
行业动态

Demis Hassabis 支持 AI 预飞安全测试

DeepMind 联合创始人兼 CEO Demis Hassabis 公开支持对 AI 系统实施“预飞安全测试”(preflight safety testing),即在部署前进行类似航空业的安全检查。这一立场与当前业界对 AI 安全监管的讨论相呼应,强调在模型发布前通过严格测试

Gary Marcus:The Road to AI We Can Trust(RSS)

论文研究

技巧与观点

技巧与观点

实测LibTV Agent:100个AI视频工作流重组为Skill,实现创意自由

LibTV推出Agent功能并内置Skill Hub,提供100多个覆盖武侠电影、皮克斯动画广告、电商口播等类型的视频Skill。用户输入想法后,Agent会分析需求并询问方向,自动生成视频分镜并串联成完整节点工作流,每个节点可查看和修改提示语。生成后LibTV会启动自查机制,自

公众号:卡尔的AI沃茨
技巧与观点

如何让 Claude 不再说“honest takes”和“load-bearing seams”

用户可通过 Claude 的 MessageDisplay Hook 机制自定义词汇替换。编写 Python 脚本,将“seam”替换为“whatchamacallit”、“you're absolutely right”替换为“I'm a complete clown”、“ho

Hacker News 热门(buzzing.cc 中文翻译)
技巧与观点

Demis Hassabis:AGI 数年可至,影响达工业革命10倍

Google DeepMind 联合创始人 Demis Hassabis 发文称,AGI 可能仅需数年即可实现,其影响将达工业革命的10倍且速度更快。他指出,前沿模型在网络安全、核与生物风险方面已构成挑战,未来需对日益智能体化、递归自我改进的系统建立稳健防护。Hassabis 呼

X:Demis Hassabis (@demishassabis)
技巧与观点

面壁智能CTO曾国洋专访:端侧模型是AI落地关键路径

面壁智能CTO曾国洋指出,端侧模型是AI落地的关键路径。其原创方法论“模型风洞”可在小规模实验中预测完整训练效果,并基于“知识密度”提出“面壁定律”:知识密度每3.5个月翻一番。2B参数的MiniCPM表现优于同期8B竞品。面壁已完成高通、联发科、英特尔、英伟达、AMD等芯片适配

公众号:面壁智能(MiniCPM)
技巧与观点

LMSYS 与 SGLang 团队为 GLM-5.2 NVFP4 推出推理优化,8×B300 单 batch 解码超 500 TPS

LMSYS 与 SGLang 团队针对智谱 GLM-5.2 NVFP4 模型在 Grace Blackwell 硬件上推出多项优化。运行时方面,Spec V2 重叠调度消除 GPU 气泡,端到端 TPS 提升 11%;IndexShare MTP 在 draft 步骤间复用 DS

LMSYS:Blog(Chatbot Arena 团队)
技巧与观点

唱作人 sad alex 谈如何用 Suno 作为创意草稿本,在短内容中保持创作自主性

洛杉矶唱作人 sad alex 分享她如何将 Suno 用作创意草稿本:解决人声转换、乐器采样或 demo 搭建等具体问题,且仅用于自己 100% 拥有版权的歌曲。她认为 AI 本质上是“向后看”的,而人类创作是“向前看”的,因此 Suno 不会取代作者的个人表达。面对紧迫截止日

Suno:Blog(网页)
技巧与观点

Apple Music 引入多语言语义检索系统

Apple 机器学习研究团队为 Apple Music 搜索引入多语言语义检索系统,覆盖 150 多个国家及地区的数十种语言。该系统利用多语言嵌入向量模型,将用户查询与歌曲等内容的语义表示映射到同一向量空间,实现跨语言匹配。检索准确率较此前基于关键词的系统提升 30% 以上,同时

Apple Machine Learning Research(RSS)