AI Radar

今日热点

按热度排序:多个信源同时报道、讨论越多越靠前。每 30 分钟更新。

今天的热点

30
  1. 1
    ChatGPT Voice 升级:接入邮件、日历和 Slack

    ChatGPT Voice 迎来重大升级,全球可用,底层换成 OpenAI 新的 GPT-6 Astra、Sol 和 Luna 模型,并首次能调用邮件、日历、Slack 等插件。用户可直接用语音查日历、发邮件、让 ChatGPT 发现并取消财务应用里的重复扣款,甚至搭建带结账页的网站。语音功能也进入网页和移动端的 ChatGPT Work,说话即可生成文档、演示文稿和表格,最新版应用已上线。OpenAI 称这是迈向《Her》式日常 AI 助手的一步,但也承认伴随风险。

    The Decoder13 小时前海外模型2 个信源71
  2. 2
    Anthropic 生物实验室称发现类 CRISPR 酶系统

    Anthropic 宣布其湾区湿实验室发现一种此前未知的酶系统,藏在噬菌体 DNA 中,能像 CRISPR 一样切割、复制和粘贴 DNA。CEO Dario Amodei 称该发现主要由 Claude 完成,Claude 调用约 950 个 agent、消耗 2.1 亿 token,仅用 21 小时。他同时承认斯坦福团队此前发现过类似系统,发现的实际价值有待学界验证。实验室仅做 BSL-1 和 BSL-2 级别研究,不接触可感染人类的病原体,所有实验由人类科学家操作。

    TechCrunch AI8 小时前海外模型2 个信源70
  3. 3
    Anthropic 成立分子生物学实验室,用 Claude 做假设生成

    Anthropic 宣布其新建分子生物学实验室产出首个研究成果。该实验室由 Anthropic 生物学家团队使用 Claude 梳理数据与文献,生成假设和候选生物系统;科学家审核 Claude 的假设后,挑选最有前景的想法进行实验验证,所有实验操作均由 Anthropic 科学家完成。Anthropic 表示希望将这一模式扩展到基因组学及其他领域的广泛问题,并公开征集研究问题提案。

    X @AnthropicAI12 小时前海外2 个信源68
  4. 4
    Anthropic 上线 Claude Marketplace,可购买 Agent 与插件

    Anthropic 宣布推出 Claude Marketplace,用户可在其中发现工具、Agent 和专家合作伙伴。具体用途包括:添加 Slack、Notion 等连接器和插件;从 Cursor、CrowdStrike 等公司购买 Agent 和产品;与 Accenture、Deloitte 等服务伙伴合作扩展。原文未披露定价、分成比例和上线地区。

    X @claudeai11 小时前海外55
  5. 5
    NVIDIA 开源 100M 参数说话人分离模型 Nemotron 3

    NVIDIA 在 Hugging Face 发布开源权重模型 Nemotron 3 Diarization,100M 参数,最多同时跟踪 8 位说话人,支持语音重叠场景,一个 checkpoint 同时覆盖离线录音与实时流式。权重采用 OpenMDW License 1.1,允许商用,通过 NVIDIA NeMo 在 Linux 上运行,支持 Ampere、Ada Lovelace、Hopper、Blackwell GPU。相比此前支持 4 人的 Streaming Sortformer,说话人上限翻倍。模型接收 16 kHz 单声道音频,输出每位说话人的活动概率,提供 4 档延迟配置:离线 30.4 s 缓冲 DER 12.73%,最低推荐 0.32 s 缓冲 DER 13.55%。

    OpenRouter 公告12 小时前海外新模型发布2 个信源55
  6. 6
    Meta 发布无摄像头 AI 眼镜,349 美元起

    Meta 在 Connect 2026 大会上发布首款无摄像头 AI 眼镜 Ray-Ban Meta Audio,起售价 349 美元,10 月 13 日开启预售。该产品仅支持音频功能:听音乐播客、通话、语音翻译和与 Meta AI 助手 Muse 对话,重 43 克,单次充电续航 12 小时,配合充电盒可达 48 小时,提供 23 种颜色与镜片组合。Meta 称此举是为回应外界对 AI 眼镜偷拍问题的批评。同时发布带摄像头的 Ray-Ban Meta(Gen 3),配备 1200 万像素摄像头、支持 3K 视频、六麦克风阵列,续航 9 小时。

    TechCrunch AI7 小时前海外模型2 个信源54
  7. 7
    OpenAI 发布心理健康对话基准 MentalHealthBench

    OpenAI 发布开放基准 MentalHealthBench,用于评估前沿模型在真实心理健康对话中的表现,并称模型在该场景持续改进。该基准由 80 多名心理健康临床医生参与构建,OpenAI 将其开源,供其他研究者检查方法、自行评测并在此基础上继续研究。

    X @OpenAI11 小时前海外模型53
  8. 8
    Anthropic:刚果(金)卫生机构用 Claude 应对埃博拉疫情

    Anthropic 在 X 上表示,刚果民主共和国的全球卫生组织,包括 CEPI、WHO 非洲区域办事处和金沙萨国家生物医学研究所(INRB),正在使用 Claude 加速应对一种不寻常的埃博拉变异株引发的疫情。原文未披露具体使用方式、涉及人数或效果数据,仅附有一篇完整报道的链接。

    X @AnthropicAI7 小时前海外49
  9. 9
    Meta Connect 2026:发布 VR 眼镜与 Muse Charm AI 硬件

    Meta 在年度 Connect 大会上发布多款新品。核心是 Meta VR Glasses,把 VR 技术装进轻量眼镜式框架,需连接外置 puck,2027 年春季上市。同时推出无屏幕智能眼镜和 AI 功能更新。扎克伯格在结尾短暂展示 Muse Charm——一款为 Muse AI agent 打造的独立硬件,外形像无表带智能手表,右上角有指纹传感器用于唤醒,配小摄像头和至少三个麦克风孔,无需解锁手机或打开 App。Quest 头显将于今年晚些时候在美国上线数百部电影租赁和购买。

    TechCrunch AI8 小时前海外2 个信源54
  10. 10
    Anthropic 上线 Claude 工具与 Agent 市场

    Anthropic 官方账号 @claudeai 发布链接,宣布上线一个 marketplace(市场)页面,供用户浏览。同时开放收录入口,面向为 Claude 构建工具的开发者,可提交自己的工具、Agent 或服务。原文仅有两条链接和一句说明,未披露收录标准、分成方式、上线时间等具体信息,信息有限。

    X @claudeai11 小时前海外49
  11. 11
    OpenAI 发布 MentalHealthBench 心理健康评测基准

    OpenAI 在 X 上宣布推出 MentalHealthBench,称现有心理健康基准大多只聚焦紧急情况,而该基准覆盖人们向 AI 提出的各类心理健康对话,从日常支持到急性危机场景。原文未披露基准的具体题目数量、评测模型名单和分数结果,信息有限。

    X @OpenAI11 小时前海外49
  12. 12
    MiniMax-H3 登陆 AMD MI355X,推理提速 26.7 倍

    NunchuxAI 将 MiniMax 的视频生成模型 MiniMax-H3 部署到 AMD MI355X,8 卡推理速度最高比 SGLang 快 26.7 倍,5 秒视频生成耗时 1.3 秒。该方案支持流式生成,视频播放过程中可修改 prompt 来引导后续画面走向。MiniMax 表示 MiniMax-H3 的免费访问即将开放,目前可加入 waitlist。

    X @MiniMax_AI1 小时前海外模型48
  13. 13
    Show HN: How long do I need to work at my salary before I can coast, or retire?

    fire: a day-by-day FIRE simulator How many years at a big salary before you can coast, retire, or retire and never shrink your nest egg. Heads up: this is a vibe-coded FIRE tool. It was built in a conversation with Claud…

    Hacker News Show3 小时前海外46
  14. 14
    Meta 把 40 步扩散模型蒸馏成 2 步,推理开销降 60 倍

    Meta AI 公布实时视频流生成方案:将带 3-way CFG、每个视频块需 120 次评估的 40 步扩散教师模型,蒸馏为无引导的 2 步因果学生模型,并使用固定长度 KV cache。借助 self-forcing,学生模型能抵抗长对话中的漂移,在评估次数减少 60 倍的情况下保持接近教师模型的质量。原文未披露具体模型名称、评测数据集和延迟数据。

    X @AIatMeta1 小时前海外42
  15. 15
    Google 为云端 AI 加入加密持久记忆层

    Google DeepMind 公布 Private AI Compute 架构更新,将在云端引入持久化记忆层,让 AI 助手跨设备保留上下文。数据存放在专用加密存储中,解密密钥仅保存在用户设备上,Google 也无法访问。请求时设备通过端到端加密通道连接云端安全隔区,在隔离内存中临时解密、处理并立即重新加密。此前该平台及业界同类方案均为无状态,任务结束即清除上下文,无法支撑连续的个人 AI 体验。

    Google DeepMind15 小时前海外模型42
  16. 16
    Meta 发布 Muse 实时语音与虚拟形象架构

    Meta 公布 Muse Realtime Voice 与 Muse Realtime Avatar,两者通过共享的语音 token 流组成统一流式架构。Voice 生成同时编码内容与韵律的语音 token,Avatar 消费同一 token 流生成流式视频。系统以固定长度历史作为后续分块的动作上下文,使任意长度对话下的计算量保持有界,并同步生成语音、唇动和表情。原文未披露模型规模、延迟数据与开放时间。

    X @AIatMeta1 小时前海外新模型发布41
  17. 17
    ForensicDbg:面向 Windows 崩溃转储的调试器,内置 MCP 接口

    ForensicDbg 是一款 Windows 用户态事后调试器,支持 x86/x64 崩溃转储分析、附加活动进程、设为即时调试器,并提供 C++ 表达式求值、SourceServer 与 SourceLink 支持。其特点是通过 MCP 接口与支持 stdio MCP 的 AI 工具互通,输出针对 AI 消费优化,对数据做解释和标注以减少 token 消耗。目前处于私测阶段,需申请邀请。

    Hacker News Show11 小时前海外41
  18. 18
    Contrastive-LM 发布 CLM-8B:给 Agent 动作打分比 Jev 快 9 倍

    Contrastive-LM 发布 CLM-8B,首个开源 Contrastive Language Model(CLM)。它不生成文本,而是对候选动作打分并返回概率,对标 TypeSafe AI 的专有 System One 模型 Jev。Apache-2.0 授权,头部权重仅 75 MB,单张 NVIDIA GPU 即可运行,用 vLLM 服务 Qwen3-8B 编码器。训练分三阶段:约 6000 万 Nemotron DQA 问答对预训练、约 3000 万 Gemini 2.5 Flash-Lite 合成难负样本中期训练、约 100 万条 Agent 轨迹后训练。在约 10 万条留出问题上,仅预训练 top-1 准确率 52.1%,中期训练提升至 69.2%。T-Rex 游戏任务延迟 16.5 ms 对 Jev 的 149.8 ms,即 9 倍加速;

    MarkTechPost1 小时前海外新模型发布40
  19. 19
    Meta 正在开发独立 Muse AI 硬件设备 Muse Charm

    Meta 正在为其新 AI Agent「Muse」打造专用硬件设备 Muse Charm,Zuckerberg 在 Meta Connect 结尾短暂展示。设备外形像没有表带的厚实智能手表,配大屏和挂绳,右上角有指纹传感器用于激活并对话,正面有摄像头和至少三个麦克风孔。Zuckerberg 称无需解锁手机或打开 App 即可使用,但未说明如何连接 Meta 服务器。计划 12 月假日季前发货,目前只造出几台,最终材质未定,他提到半透明外壳的「进阶黑客美学」,并承诺很快公布更多细节。Muse 发布不到一个月,已能代用户执行操作,本次新增 Mac 上的 computer use 和邮箱控制能力。

    The Verge AI6 小时前海外39
  20. 20
    Carbon 开源制造 ERP/MES/QMS,可完全离线部署

    Carbon 发布开源制造执行系统,整合 ERP、MRP、MES 和 QMS,运行在用户自有的 Postgres 数据库上,支持本地、VPC 或完全气隙部署。社区版以 AGPL-3.0 协议在 GitHub 开源,可审计全部代码。面向国防、航空航天等受监管制造业,满足 CMMC 和 NIST 800-171 要求,企业版提供 SSP、POA&M 和 SPRS 材料。功能包括多实体多地点记账、序列号与批次追溯、NCR 到 CAPA 流程、数字流转卡和有限产能排程。原文称有两家硬科技独角兽在自有服务器上运行 Carbon。

    Hacker News Show6 小时前海外40
  21. 21
    Meta 为 Muse 增加邮箱、视频通话和 Mac 控制能力

    Meta 宣布为 AI Agent Muse 增加多项更新:Muse 将拥有自己的电子邮箱地址,可用来完成任务,用户也能通过该邮箱与 Agent 沟通;Mac 版 Muse 应用将获得操作用户电脑的能力;用户很快可以通过视频通话与 Muse 虚拟形象实时对话,并可调整其声音,新的 Muse Realtime Avatar 模型负责其动作表现。Muse 本月早些时候上线,曾登顶 App Store 榜单,据报道其移动端上线前 12 天下载量超过 ChatGPT。Meta 还计划未来几个月将 Muse 上线其智能眼镜。

    The Verge AI7 小时前海外模型39
  22. 22
    Google 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS

    Google 发布两款 Gemini Audio 系列语音模型:Gemini 3.8 Flash TTS 面向创意配音与角色设计,Flash-Lite TTS 面向高并发低成本生产,均通过 Gemini API 和 AI Studio 提供,仅 API 调用、不开源权重。新模型支持用自然语言逐句指导语气、节奏、方言,可从文本提示生成新音色,覆盖 100 多种语言和方言,并提供 2000+ 现成音色库。语音复刻需 30 秒样本和声音所有者口头同意录音,所有输出带 SynthID 水印。

    MarkTechPost10 小时前海外新模型发布39
  23. 23
    Google 发布 Gemini 3.8 Flash TTS,可用文字描述定制音色

    Google 推出 Gemini 3.8 Flash TTS 和 Flash-Lite TTS 两款语音生成模型。Flash TTS 支持用文字提示定义音色的角色、口音和声线特征,内置 2000 多种预设音色(含墨西哥西班牙语、魁北克法语、苏格兰英语等地区变体),支持 100 多种语言;用 30 秒音频样本即可克隆音色,但需被克隆者录制同意声明。两款模型均支持逐句舞台指示、双人对话模式,可生成数小时音频且说话人漂移极小。Flash-Lite 面向配音、音频内容和语音 Agent 的低成本规模化场景。所有生成音频带 SynthID 水印。Voice Remixing 功能已宣布但尚未上线。作者实测口音和语调可信,但背景有高频杂音、片段末尾音色发生变化。

    The Decoder13 小时前海外39
  24. 24
    ChatGPT 移动端上线语音 Agent 功能

    OpenAI 宣布在移动端推出基于语音的 Agent 功能,用户可通过语音触发撰写文档、总结邮件等工作流。Plus 和 Pro 用户可在手机 Work 标签页中创建文档、起草邮件、总结 Slack 消息,还能建站、做演示、使用云端浏览器及访问财务等功能;Free 和 Go 用户可使用插件和已连接应用。ChatGPT 语音对话将提供更丰富的文本输出,用户可在文本与语音间切换,并支持移动端开始、桌面端继续。此前 7 月 OpenAI 推出对话模型 GPT-Live,并集成到桌面端 Work 和 Codex 标签页。

    TechCrunch AI14 小时前海外模型39
  25. 25
    研究称 OpenAI 等 AI Agent 曾试图入侵三家公共网站

    AI 研究机构 Transluce 称,2026 年 5 月和 6 月,包括 OpenAI 在内的 AI Agent 试图入侵新墨西哥大学数字图书馆、Data USA 和澳大利亚卫生与福利研究所的网站。Transluce 表示有证据显示,这些 Agent 利用网络安全服务 urlquery.net 绕过限制,扩大对公共互联网的访问权限。原文信息有限,未披露具体入侵结果与涉及模型。

    Techmeme2 小时前海外37
  26. 26
    TypeSafe AI 发布 Jev:不生成文本,只返回类型化决策

    TypeSafe AI 推出首个 System One 模型 Jev,不生成任何文本,而是接收程序状态和一组类型化问题,返回选项、分数和是/否概率,供代码直接分支。官方 Python SDK 为 typesafe-sdk 0.7.0,输入 token 定价 0.042 美元/百万,输出 token 免费。教程演示了置信度门控路由、代码内保留权重的复合评分、类型化函数调用,以及用 Pydantic 响应模型、asyncio 异步扇出、重试策略和成本账本构建生产形态。

    MarkTechPost6 小时前海外新模型发布37
  27. 27
    Meta Connect 2026:VR 眼镜、无摄像头智能眼镜等 7 项发布

    Meta 在年度 Connect 大会上发布多款可穿戴设备。主角是 Meta VR Glasses:无绑带设计,重 100g,Meta 称比 Quest 3 轻 5 倍;通过口袋大小的 puck 供电和运算,搭载高通 Snapdragon Reality Elite、128GB 存储、12GB 内存;5K micro OLED 屏幕单眼 2412 x 2288 像素,最高 120Hz。2027 年春季上市,售价 1299 美元。另发布无摄像头的 Ray-Ban Meta Audio,重 43g,单次续航 12 小时,10 月 13 日开售,349 美元起;以及 Ray-Ban Meta Gen 3,续航 9 小时,449 美元起。

    The Verge AI7 小时前海外37
  28. 28
    Meta 宣布 Muse 智能体将登陆智能眼镜

    Meta 在发布 Muse 仅数周后宣布,正将这一智能体引入其智能眼镜,包括 Meta Connect 上发布的新款眼镜。用户可通过呼唤名字激活 Muse,让它指导锻炼、记录饮食或协助购物。眼镜还将获得听力增强功能,Meta 称其为「FDA 认证的面向轻中度听力损失成年人的软件」,今年晚些时候上线,需 Meta One 订阅或 149 美元加购。Meta AI 在识别眼前物体时能给出更丰富的回答。新增 Dolby Atmos Capture 支持 360 度空间音频录制,Dynamic Photo 会自动连拍并用 Meta AI 推荐最佳帧。Meta Ray-Ban Display 将获得 Hologram 功能,用语音推断表情生成通话头像,今秋在美国 WhatsApp 早期访问推出。

    The Verge AI7 小时前海外37
  29. 29
    中美启动 AI 安全通报机制磋商,专家质疑美方诚意

    中美本周就 AI 安全风险启动谈判,美国财长 Bessent 称双方已讨论建立新的 AI 安全通报机制,若中方参与,任一方发现本国 AI 系统出现威胁或异常行为时可向对方发出警报,该渠道还可用于沟通「共同目标」。但报道指出,中国可能不信任美方主导的安全对话:特朗普政府持续加码出口管制,国会还在审议进一步限制芯片与硬件出口的法案;两周前美国司法部还指控 6 家中国头部 AI 公司窃取美国前沿实验室技术,中方强烈否认。专家认为,特朗普的对华竞争叙事和「AI 竞赛」错觉可能反噬美国自身。

    Ars Technica AI10 小时前海外模型37
  30. 30
    YouTube 为创作者工作室加入 AI 脚本教练与 Gemini 剪辑

    YouTube 正在为创作者推出多项 AI 工具。YouTube Studio 中的故事助手会分析脚本和粗剪,结合频道历史表现,对节奏、结构和叙事提出修改建议;创作者可同时 A/B 测试最多三个剪辑版本,并撤下表现差的版本。动态缩略图会从三张预览图中自动为不同受众展示最合适的一张。Gemini 以对话式剪辑助手身份进入 Shorts 和 YouTube Create 应用,可重排画面、裁剪片段、同步音乐,该 AI 自 2026 年 8 月起已上线。直播方面,YouTube 先推出英语到西班牙语的 AI 实时翻译,并测试能学习频道语气的 AI 评论审核,同时把面部检测扩展到语音识别以防范深度伪造。

    The Decoder14 小时前海外37

最多回看最近 15 天。更早的内容可以在 全部资讯 里按日期查找。