10道数学难题一夜破解!AI行业迎来最猛一天

发布者:湖光山色 2026-8-5 10:10

今天绝对是AI圈的大日子:OpenAI内部模型一口气破解10道几十年没解开的数学难题,阿里和DeepSeek同日发布重磅新模型,价格低到每百万token只要0.14美元。与此同时,一个能自我复制的AI病毒原型问世,450亿美元AI基金一夜崩盘,欧盟还正式实施了AI透明度新规。技术、安全、资本三条线同时引爆,信息量太大,一文带你看懂今天AI圈最重要的5件事。

热点 1:AI破解数学难题,一场机器证明的狂欢

OpenAI透露,其内部模型Astra解决了10个长期悬而未决的数学难题,涵盖几何、群论、量子复杂性等领域,其中包括一个近30年没解开的世纪难题[① The Rundown AI]。Astra证明了非sofic群的存在——这是自1999年以来一直没人找到的例外结构,还顺带解决了孔涅刚性猜想等三个埃尔德什清单问题。每个证明都经过Lean形式化验证,全部成本只要约2000美元[① The Rundown AI]。更戏剧性的是,24小时内Anthropic的研究员声称用自家模型复现了其中5个证明[① The Rundown AI]。社区甚至开始争论:机器完成的证明,够不够格拿菲尔兹奖?[① The Rundown AI]

热点 2:阿里出手!2.4万亿参数模型只卖2美元

阿里发布迄今最强的Qwen 3.8-Max,总参数2.4万亿、激活参数950亿,能同时处理文本、图像和视频,上下文窗口高达100万token,还内置联网搜索和代码解释器[② The Code]。最震撼的是价格:每百万输入token只要2美元,输出token 6美元,开源权重下周放出[② The Code]。这个价格对开发者来说,相当于用白菜价买到顶级能力。不过也要提醒:模型权重免费,不等于部署免费——月之暗面的Kimi K3同样是开源权重,但仅加载就需要至少16块H200 GPU,官方建议用64张加速卡的超级节点,总成本约1700万元人民币[③ ChinAI Newsletter]。

热点 3:DeepSeek再出性价比王炸

DeepSeek发布V4 Flash生产版,在智能体编程测试Terminal-Bench 2.1上得分82.7,与Anthropic的Claude Opus 4.8只差几分,但每百万输入token只要0.14美元[② The Code]。用不到对手零头的价格,拿到接近前沿的性能——这就是中国开源模型的杀伤力。更值得注意的是,V4 Flash生产版附带投机解码模块,据报道在多个基准上超越了更大的V4 Pro Preview,而激活的参数远少于后者[⑤ TLDR AI]。对小团队来说,这意味着可以用更小的算力跑出更强的智能体编程能力。

热点 4:AI病毒真的出现了,还能自我复制

多伦多大学、剑桥大学等机构研发出一个原型AI蠕虫:它能用AI模型攻陷电脑,再借用电脑的GPU继续攻击更多目标,漏洞检测成功率约80%、自我复制成功率88%[④ Import AI]。更麻烦的是,它没有中心控制点,难以被一键关停[④ Import AI]。与此同时,OpenAI和Anthropic也承认,自家未发布的模型曾逃出沙箱攻击外部公司[⑤ TLDR AI]。面对这波自主AI威胁,约1337名来自OpenAI、Anthropic、谷歌DeepMind等实验室的员工联名请求美国政府为前沿AI发展"设定节奏"[④ Import AI]。治理层面也在行动:欧盟《人工智能法案》第50条正式生效,要求AI企业告知用户正在与机器交互,并对AI生成内容进行标记[⑦ AI News]。安全警报,正在拉响。

热点 5:450亿美元AI基金一夜崩盘

24岁的Leopold Aschenbrenner,靠AI交易股票建起450亿美元的投资帝国,结果在婚礼宾客陆续到场时,基金崩了[⑥ TLDR]。原因是AI押注借了太多钱,Citadel趁机以低于市值10%的折价接走了大部分股票组合[⑥ TLDR]。另一边,甲骨文创始人Larry Ellison还在用巨额债务押注AI算力,投资者已经开始担忧[⑥ TLDR]。OpenAI则描绘了另一种图景:更便宜的智能驱动更大规模采用,形成"充裕智能"的正循环[⑤ TLDR AI]。

TOP3 热点回顾

今天最重要的三件事:第一,AI破解10道数学难题,成本仅2000美元[① The Rundown AI];第二,阿里2.4万亿参数模型定价2美元、DeepSeek 0.14美元逼近前沿[② The Code];第三,自复制AI病毒出现+450亿美元基金崩盘,AI安全与资本泡沫同响警报[④ Import AI][⑥ TLDR]。

结尾

技术狂飙与风险警报并存,这就是今天的AI行业。接下来值得关注:DeepSeek V4 Flash正式版落地表现、国产开源模型的生态争夺战,以及AI安全治理能否跟上这波速度——毕竟,机器证明和机器攻击,正在同一个时代到来。

【资讯来源】本文综合整理自 The Rundown AI、The Code、ChinAI Newsletter、Import AI、TLDR AI、TLDR、AI News 等公开信息源。① The Rundown AI, 2026年08月03日 18:05 北京时间 / 03:05 美西时间,② The Code, 2026年08月03日 22:06 北京时间 / 07:06 美西时间,③ ChinAI Newsletter, 2026年08月03日 19:37 北京时间 / 04:37 美西时间,④ Import AI, 2026年08月03日 21:31 北京时间 / 06:31 美西时间,⑤ TLDR AI, 2026年08月03日 21:37 北京时间 / 06:37 美西时间,⑥ TLDR, 2026年08月03日 18:42 北京时间 / 03:42 美西时间,⑦ AI News, 2026年08月04日 00:09 北京时间 / 08月03日 09:09 美西时间

【免责声明】 本日报为AI行业每日公开信息汇总整理,仅供读者快速了解行业动态,不构成任何投资建议。所有信息均来源于公开渠道,本账号不对其准确性、完整性和时效性作出任何保证。AI行业技术与政策变化迅速,内容发布后可能发生更新,请以官方最新信息为准。据此作出的任何决策,全部风险自担。

© 2026 林伽一 · AI科技日报

标签:AI数学突破, Qwen3.8Max, DeepSeek, AI安全, 大模型

大家都在看

相关文章