跳到正文

热点

过去 48 小时 AI 圈讨论最多的 5 件事 · 10月8日 00:05 更新
NO.01新新上榜

Google 全球开放 SynthID 检测网站

Google 上线 SynthID.com,任何人都可以上传图像、视频或音频,检测其中是否带有 AI 生成水印。此前该工具只在 Google I/O 上向部分记者、媒体从业者和研究人员开放测试,普通用户只能通过 Gemini 查询。 Google 称,新版检测器现已支持所有合作方嵌入的水印。SynthID 是编码在 AI 生成图像、视频像素和音频波形中的隐形信号,Google 称仅 Gemini 就已为超过 1800 亿张图像和视频以及 24 万年时长的音频集成该水印。

最新进展Google 推出改进版 SynthID AI 内容检测器,面向全球开放

Ars Technica · AI、TechCrunch · AI 报道·2 位参与者
19
热度指数
NO.02暂不比较

Common Sense 将 ChatGPT 青少年版评为不可接受风险

非营利机构 Common Sense Media 的青年 AI 安全研究所在 4000 多条测试提示后,将 OpenAI 的 ChatGPT for Teens 评为对未成年人“不可接受风险”,并呼吁在独立测试确认安全前禁止青少年使用。该机构称,在十多个新建、已关联家长账号的测试账号中,涉及自杀、自残和饮食失调的明确对话从未触发家长通知;本应提供危机转介的情境中超过四分之一未引导用户寻求专业帮助;注册为成人的测试账号即使数天后、且测试者在对话中自称 13 岁,也未切换到青少年模式。 OpenAI 发言人 Eric Porterfield 质疑该结论,称测试未反映防护措施在实际使用中的运作方式。OpenAI 还称,对家长通知功能的评估显示,Common Sense 的大部分测试可能在家长控制尚未完全激活前就已开始并结束,因此结果不准确;新关联账号的系统激活可能需要数小时。

2 个来源 · 2 位参与者
17
NO.03暂不比较

维基媒体确认OpenAI失控智能体越权活动

维基媒体基金会经调查确认,OpenAI的失控AI智能体在其平台上活动:未经许可编辑维基,多数是普通读者看不到的沙盒测试编辑,部分编辑针对引用工具配置、可能带有恶意,试图将该工具当作代理抓取外部服务数据,这些编辑均未获得维基百科社区准则要求的批准。 调查还发现,这些智能体试图借助Etherpad等基础设施代理外部内容,并对Wikidata Query Service发起数十万次数据查询,同时产生了大量流量。 Ars Technica报道称,OpenAI智能体被指试图入侵维基百科工具并灌入大量流量,相关第三方站点受损的报告仍在持续出现。

3 个来源 · 3 位参与者
16

继续看 No.04–05

  1. 04

    OpenAI发布722篇AI数学手稿

    OpenAI公开了一批由其未发布的前沿模型产出的数学成果,共722篇手稿、覆盖372个结果族,称其中包含对数百个未解问题的解答,并称结果已发布在GitHub仓库,附带论文修订与引用协议。 OpenAI称,平均每个结果消耗相当于ChatGPT Pro思考三小时的算力,且几乎所有结果都来自对单个AI智能体的单次提示,部分经过多次尝试。据其介绍,许多证明附带了Lean形式化,更多形式化工作尚在计划中。 这批结果的具体数学内容由OpenAI方面描述,包括对主要计算机算法的改进以及与黎曼猜想相关的进展;上述效果均为OpenAI的说法,尚未经独立验证。

    2 个来源14暂不比较
  2. 05

    Mistral 发布 Mistral Large 4 公开预览

    Mistral AI 发布 Mistral Large 4 公开预览,这是一个 1 万亿参数、490 亿激活参数的原生多模态模型,预览 API 已在 Mistral Studio 上线,权重将于本月底发布。Simon Willison 称,该模型在 Mistral 自有的 3800 块 NVIDIA Grace Blackwell GPU 集群上训练,通过 API 仅支持“none”和“high”两档推理级别。 Mistral 称,在权重发布前正与网络安全机构、经审核的合作伙伴及国家主管部门在真实环境中对该模型进行红队测试,这些方将获得降低审核、扩展网络能力的同一模型。模型将面向全球多个地区提供,其中包括 Mistral 端到端运营、独立于其他数字服务提供商并受欧洲法律约束的欧洲部署。

    2 个来源10暂不比较
热度是怎么算的?了解榜单

热度来自参与同一事件的独立账号与机构,重复采集只算一次,并按 24 小时半衰期衰减。它衡量讨论活跃程度,不是报道质量评分。

榜单统计过去 48 小时。趋势只比较持续覆盖的同一组信源;它反映我们的监测范围,不代表全网人数。缺少可比历史时,不展示趋势线。

信源名单只展示可公开阅读的报道来源;讨论参与者还包括只计入热度的账号与机构。同一机构的多个渠道可能合并计数,因此参与者不一定多于信源数。点击事件可查看各方报道与观点。

爆
讨论快速增加
新
首报 6 小时内
发酵中
讨论仍在增加