❄️Science 主编:AI 正在让科学出版变得更慢、更糟、更昂贵
🚀SpaceX 火箭碎片将于 8 月 5 日撞向月球
⛔️美国政府正考虑将 Kimi K3 等中国 AI 模型列入实体清单
🧠科学家首次揭示边缘型人格障碍的遗传线索
📝雅可比猜想相继被 Claude Fable 5 和 GPT-5.6 证伪
💻谷歌推出 Gemini 3.6 轻量级模型,遭遇口碑分化
· 科学出版
Science 主编:AI 正在让科学出版变得更慢、更糟、更昂贵
近日,《科学》(Science)杂志主编 H. Holden Thorp 发表社论指出,AI 大语言模型的使用并没有带来预期中的“降本增效”,反而让科学出版流程变得更慢、更糟且更昂贵。
他指出,尽管大语言模型在预测蛋白质结构等领域成果斐然,但逻辑推理能力依然不足,甚至比人类更易做出操纵数据等学术不端行为。虽然一些基于 AI 的工具可以帮助捕捉错误,辅助识别抄袭与图片篡改,但“发现错误”不等于“减少工作”。评估 AI 的输出依然极度依赖人类专业判断,这让 AI 变成了新增的成本支出,而非科学编辑的替代品。他警告,如果科学界不能妥善应对 AI 带来的问题,那么科学研究的可靠性将被削弱,那些真正经过验证的研究结果的产出将逐渐放缓。(Science)
· 热点事件
SpaceX 火箭碎片将于 8 月 5 日撞向月球
据《科学美国人》(Scientific American)消息,SpaceX 于 2025 年 1 月发射的一枚“猎鹰 9 号”(Falcon 9)火箭在完成任务后,未能按原计划再入地球大气层烧毁,而是进入了一个轨道距离与月球相近的绕地轨道。受地球和月球引力以及太阳辐射压力的共同影响,这块失控的火箭残骸预计将于 8 月 5 日撞击月球,为研究月面撞击过程和近月空间垃圾风险提供一次罕见机会。近日,23 位天文学家在预印本平台 arXiv 发表论文(尚未经过同行评审),呼吁科学界共同观测这一事件。
天文学家预测,这块重约 4.9 吨的残骸将以每小时约 8700 公里的速度撞击月球爱因斯坦陨石坑(Einstein Crater)附近,释放出相当于约 3 吨 TNT 爆炸产生的能量。由于撞击点位于月球受光面,撞击闪光可能难以直接观测;不过,该位置靠近月缘,撞击抛射出的岩石和尘埃羽流或可在黑暗的太空背景下显现。美国和韩国的月球轨道器将尝试记录撞击过程及其前后的月面变化。研究人员希望借此深入了解月面撞击机制,并评估近月空间垃圾对未来载人登月和月球基地建设构成的潜在威胁。(Scientific American)
美国政府正考虑将 Kimi K3 等中国 AI 模型列入实体清单
当地时间 7 月 20 日,据美国新闻媒体 Axios 援引知情人士消息,针对中国开源 AI 模型的崛起,美国特朗普政府正在考虑对中国 AI 模型实施禁令。事实上,此前,美国多个政府部门已曾多次试图对外国开源模型实施事实上的禁令,考虑通过实体清单威胁、强调安全风险、舆论施压以及采购限制等,迫使美国企业放弃中国 AI 模型。比如,美国商务部去年曾考虑将多家中国 AI 实验室列入实体清单,切断美国企业在未经许可情况下与中国 AI 实验室之间的合作与技术交流。随着上周 Kimi K3 的发布,美国政府这些讨论开始重新升温。
来源:Artificial Analysis
7 月 17 日,中国 AI 公司月之暗面发布新一代模型 Kimi K3,参数规模达 2.8 万亿,是目前全球参数最大的开源模型。在多个权威评测中,Kimi K3 综合水平仅次于 Anthropic 的 Claude Fable 5 和 OpenAI 的 GPT-5.6 Sol 两个前沿闭源模型,在编程、视觉理解、知识工作和长程任务处理等方面表现突出。发布后不久,埃隆·马斯克(Elon Musk)在社交平台 X 上表示,他们即将推出 2 万亿参数的下一代 AI 模型 Grok 4.6,这个新模型的性能有望超过 Kimi。据科技日报消息,月之暗面相关负责人对此回应称,“我们拭目以待,欢迎大家一起掰一掰手腕。他有信心,我们有更强的信心。”(Axios,科技日报)
相关阅读:月之暗面发布 2.8 万亿开源模型 Kimi K3
· 遗传学
科学家首次揭示边缘型人格障碍的遗传线索
边缘型人格障碍(BPD)是一种严重的精神健康问题,其发生被认为受到创伤等环境风险因素与遗传因素的共同影响。近日,一支研究团队开展了迄今规模最大的 BPD 全基因组关联研究(GWAS),首次发现了与该疾病相关的遗传风险线索。相关论文于 7 月 20 日发表于《自然-遗传学》(Nature Genetics)。
研究整合了 27 项研究的数据,分析了超过 600 万个遗传标记,纳入 12339 名 BPD 患者和逾 100 万名对照者,并在独立样本中进行了验证。研究最终识别出 11 个相关基因组位点,其中 6 个位点得到重复验证,另有 5 个位点仍需在后续独立研究中进一步确认;在这些区域内部或附近,研究人员还锁定了 9 个可能与 BPD 相关的功能基因。
研究估计,新发现的遗传变异可解释约 17% 的遗传易感性,低于此前家系和双胞胎研究估算的 46% 至 69%。这表明,遗传因素虽然在 BPD 的发生中发挥重要作用,但不能完整解释疾病形成。研究还发现,部分相关遗传变异与抑郁症、反社会行为和注意缺陷多动障碍(ADHD)等精神及发育问题存在重叠,其中 BPD 与创伤后应激障碍(PTSD)的遗传相关性最强。不过,单个遗传变异的效应均较小,目前尚不能用于个体诊断或风险预测。未来仍需进一步研究这些遗传关联背后的生物学机制。(Nature News)
· AI for Science
雅可比猜想相继被 Claude Fable 5 和 GPT-5.6 证伪
当地时间 7 月 20 日,Anthropic 的研究员兼数论学家莱文特·阿尔波格(Levent Alpoge)在社交媒体 X 上发文,宣布 Claude Fable 5 成功证伪了著名的雅可比猜想(Jacobian Conjecture)。该猜想由德国数学家奥特-海因里希·凯勒(Ott-Heinrich Keller)于 1939 年提出,核心是探讨在多项式映射中,局部可逆的条件是否能推导出全局可逆,这一深奥的“局部到全局”难题已经困扰全球数学家长达 87 年。
其中,Fable 5 另辟蹊径,直接在三维空间中给出了一个极其优雅且简洁的代数反例——一个包含三元多项式的映射,以确凿的非单射性(不可逆性)在三维及以上维度彻底否定了该猜想。随后,GPT-5.6 迅速对该反例进行了结构化分析并提出了修正后的新猜想,OpenAI 研究员 Aaron Lou 利用内部无联网的 Codex 模型,从零独立推导出了本质相同的反例和严密的数学证明。
需要指出的是,此次 Fable 5 证伪的是三维及以上的广义雅可比猜想,而华人数学家张益唐深耕的二维雅可比猜想目前依然未被攻克,二维并非三维的简单低阶版本,其在数学上的难度与核心价值依然巨大。此次证伪至少表明,当前顶尖 AI 模型在纯数学逻辑推理与发现领域已具备创造力。(X,公众号“新智元”)
· 人工智能
谷歌推出 Gemini 3.6 轻量级模型,遭遇口碑分化
当地时间 7 月 22 日,谷歌(Google)宣布推出全新的 Gemini 3.6 系列轻量级模型,包括主力模型 Gemini 3.6 Flash、主打极致速度的 Gemini 3.5 Flash-Lite 和专攻网络安全的 3.5 Flash Cyber。科技媒体 Ars Technica 称,3.6 Flash 在代码能力(DeepSWE 代码测试中从前代的 37% 提升至 49%)与计算机操控能力上均有所提升,且 Token 消耗降低 17%,API 价格也有所下降。不过,市场原定于 6 月期待的旗舰模型 Gemini 3.5 Pro 依旧跳票,谷歌表示其仍在与合作伙伴进行测试;同时谷歌宣布已启动 Gemini 4 的预训练。
来源:谷歌
不过,Gemini 3.6 Flash 在市场上遭遇口碑分化,比如第三方评测机构 Artificial Analysis 指出,3.6 Flash 的智能水平,相比上一代模型 3.5 Flash 基本原地踏步。(Google,Ars Technica,Artificial Analysis)
编写:杨梦、莫喻枫、王怡博
编辑:王怡博
封面图来源:@Kimi.ai/X