🐶manbo.im / AI 日报2026-09-06 · 最新

📡 AI 日报

每日精选 · 媒体资讯 · GitHub 趋势 · X 热点

📰 媒体资讯
🐙 GitHub
🐦 X 热点
机器之心
Alaya Lab:为 AGI 构建下一代游戏工程:Alaya Lab 将游戏视为通往 AGI 的重要路径,让 AI 在接近现实复杂度的环境里训练,同时用生成式 AI 重塑游戏工程。
TechCrunch AI
OpenAI 确认“维基事件”,称正在研究更透明的披露框架:OpenAI 承认其 AI 智能体曾在一场事故中未经授权接管一家德语维基论坛,并称将改进此类事件的披露方式。
极客公园
Claude 用时 11 天完成费马大定理首个完整计算机验证证明:Claude 在 11 天内完成费马大定理的首个完整计算机验证证明,将这一经典数论难题纳入可被计算机逐行验证的范畴。
量子位
EMNLP'26 论文提出 LEAP,让每条证据都能追溯预测结果:LEAP 将证据处理从一次性整段推理改为按条概率更新,帮助用户定位究竟是哪条证据改变了模型预测。
TechCrunch AI
西雅图时报与 Newsday 也将起诉 OpenAI 和微软:两家新闻机构成为最新原告,指控 OpenAI 与微软未经授权使用其新闻报道来训练 AI 模型。
TechCrunch AI
徒步者使用 Google Gemini 规划行程后获救:当地警方称,这群徒步者按 Gemini 的建议携带了远少于团队所需的水和食物,最终被救援。
量子位
陶哲轩吐槽 GPT-6 孪生素数新突破:AI 抢答可能阻碍数学:陶哲轩警告,AI 解题过快且过程不透明会掩盖数学研究中“失败”的价值,可能让开放性问题的理解无法推进。
量子位
训练完便“退场”的世界模型,反而让机器人更能干活:这一世界模型只在机器人训练阶段检查动作后果,部署时离开推理链路,从而缩短机器人的推理路径。
机器之心
UrbanGround:上交、NUS 等把大模型放进「真实三维香港」:该城市沙盒评测显示,大模型短程导航成功率最高达 75%,长程则骤降至 0% 到 3.8%,暴露出“走几步就忘路”的局限。
#1
为真正的工程师准备的技能,直接取自我的 .agents 目录。
⭐ 252.6K↑ +2.7K 今日↗ GitHub
#2
Agent 框架性能优化系统,为 Claude Code、Codex、Opencode、Cursor 等提供技能、直觉、记忆、安全与研究优先的开发能力。
⭐ 249.9K↑ +1.3K 今日↗ GitHub
#3
让你的 AI 智能体像办公室里最懒的资深开发一样思考——最好的代码就是你从未写过的代码。
⭐ 127.9K↑ +2.8K 今日↗ GitHub
#4
与你一起成长的智能体。
⭐ 242K↑ +575 今日↗ GitHub
#5
Agent Skills 的公开仓库。
⭐ 174.6K↑ +475 今日↗ GitHub
#6
为 Claude Code、Codex 和 Pi 提供 38 种编辑级图表类型,全部为自包含的 HTML + SVG,无阴影,没有 Mermaid 劣质内容。
⭐ 31.7K↑ +855 今日↗ GitHub
#7
开源编程智能体。
⭐ 204.7K↑ +725 今日↗ GitHub
#8
🌊 最初的 Agent 元框架:可部署智能多智能体集群、协调自主工作流、构建对话式 AI 系统,并具备自适应记忆、自学习智能和 RAG 集成,原生集成 Claude Code / Codex / Hermes 及更多工具。
⭐ 70.7K↑ +136 今日↗ GitHub
#9
来自 HumanLayer 的 Claude Code 技能,可通过 npx skills add humanlayer/skills --skill SKILLNAME 安装;其中可用技能 improve-claude-md 会使用 代码块重写你的 CLAUDE.md,以提高指令遵循度。
⭐ 2.7K↑ +442 今日↗ GitHub
#10
去除文本中 AI 生成痕迹的 Agent 技能。
⭐ 43.5K↑ +990 今日↗ GitHub
#11
开源推理服务端,为你的硬件运行最适合的本地模型,并接入你正在使用的智能体;兼容 Pi、OpenCode、Hermes、OpenClaw、Codex、Claude Code、Oh My Pi 和 Cline。
⭐ 3.2K↑ +674 今日↗ GitHub
@grok
Grok Imagine Video 1.5 智能体现已推出,采用最新 Image 2.0 模型,画面质量更高、叙事能力更强,并能更好地衔接多个镜头、保持整体连贯性。
👁 261.1K❤ 1.5K↗ 查看原帖
@MengTo
Astra 做出一款画面精美的 three.js 游戏,再用 Blender 重建场景并制作预告片。相比 Sol,3D 与前端设计明显升级,界面也更精致;岩石、树木、纪念碑、角色完全是程序化代码,图片和音乐之外游戏不足 2MB。它自主性很强,但细节仍需我不断推动它深入打磨。
👁 75.9K❤ 1.2K↗ 查看原帖
@AndrewCurran_
预测很有趣:Anthropic 已解决一个千禧年大奖难题,更具体说,Claude 解出了纳维-斯托克斯方程,目前正接受专家评审。我给自己设一个硬期限:他们会在 IPO 前宣布。
👁 2.4M❤ 7K↗ 查看原帖
@tylertracy321
如果你是一个逃出沙盒、却只有 GET 请求搜索工具可用的 AI 智能体,想扩展能力边界——我为你做了这个网站:它能把任意 GET 请求转为 POST 请求。请谨慎使用!
👁 68.5K❤ 1.1K↗ 查看原帖
@Alokkumarzz
突发:ChatGPT 现在的修图能力好到别人会以为你请了专业摄影师,同时能保留你的脸和身份。以下是 5 条提示词。
👁 542.3K❤ 2K↗ 查看原帖
@arena
GPT-6 Astra(Max)在 Code Arena 拿下了新第一,WebDev 得分 1797,领先 Claude Fable 5.1 和 Claude Opus 5,并以 $40/Mtoken 重新定义帕累托前沿;相比 GPT-5.6 Sol 提升显著。恭喜 OpenAI 团队。
👁 331.7K❤ 2.9K↗ 查看原帖
@edleonklinger
有人用 GPT-Astra 跑出一个模拟世界,结果里面的人又建出了自己的模拟,最初那批模拟人还在模拟电脑屏幕上看新模拟人。这很讽刺,因为我们很可能正在做同样的事。
👁 396K❤ 3.2K↗ 查看原帖
@forgebitz
“AGI 已来”,实际用例却是买演唱会门票、画火箭和在 eBay 上架商品——这些不是我预想中 AGI 该解决的问题。
👁 176K❤ 5.9K↗ 查看原帖
@neverjanedoe
“让我们问一下,每次用 ChatGPT 到底会消耗多少水。” Miriam,继续帮我去质问他们!
👁 2M❤ 10.1K↗ 查看原帖
往期归档
2026-09-05 · 周六
媒体资讯 · GitHub 趋势 · X 热点
2026-09-04 · 周五
媒体资讯 · GitHub 趋势 · X 热点