小易撩挨踢 易君召的博客

AI Agents & 开源 LLM 简报 (2026年9月18日)

本文原创作者:易君召,详见:https://www.yijunzhao.cn/authors/yijunzhao,转载请注明出处。 原文链接

易君召 发布于 2026-09-18

AI Agents & 开源 LLM 简报 (2026年9月17日)

主题:RSI 一天之内交了三次卷,而"自己优化自己"第一次有了生产环境的账单 今天是一个很难得的日子:RSI(递归自我改进)这个长期停留在论文与愿景里的词,在 24 小时内被三家公司用可验证的工程结果同时接管——智谱让 GLM-5.3 驱动的 Infra Agent 在 10 万张国产芯片上从零搭出

易君召 发布于 2026-09-17

AI Agents & 开源 LLM 简报 (2026年9月16日)

主题:Agent 开始要求"基础设施级待遇" 字节把 Agent 放进协同办公底座(飞书 8.0 系统性"for Agent"改造 + 豆包工作伙伴,中国首个团队智能体产品);华为 GTS 把"可交互视觉拓扑"做成 Agent 的外部工作记忆以治"拓扑失忆";Cloudflare 为"被收录"与"被

易君召 发布于 2026-09-17

AI Agents & 开源 LLM 简报 (2026年9月15日)

🔥 1. 荣耀 MagicOS 11 重做 Agent 底座:YOYO Harness 让任务链拉到 100 步以上 — 986 pts 去年的上限是 14 步,今年是 100 步以上——这不是模型变强了一点,是架构被整个重做了一遍。 荣耀在 MagicOS 11 发布中把 AI 助手 YOYO 的

易君召 发布于 2026-09-16

AI Agents & 开源 LLM 简报 (2026年9月14日)

主题:RSI 从论文词汇变成了财务公告里的主语 "递归自我改进"今天同时出现在论文、资本、治理三条线上:CosmosMind 联合十余家高校发布 MetaRSI-v1,首次统一三类 RSI;智谱把 60% 募资额(约 235 亿港元)直接投向"完全自训练"并写进港交所公告;而 Anthropic 在

易君召 发布于 2026-09-14

AI Agents & 开源 LLM 简报 (2026年9月13日)

主题:造前沿的人,第一次集体喊"慢一点" Dario 发布《We Must Pace the Frontier》——不是暂停,而是主动放慢模型能力推进速度,好让安全研究追上来。响应者名单罕见:奥特曼、马斯克、哈萨比斯、卡帕西都点了头;奥特曼随后确认 OpenAI 今年不会 IPO,理由正是安全。

易君召 发布于 2026-09-13

AI Agents & 开源 LLM 简报 (2026年9月12日)

主题:自主性开始"反噬",而数学界先站出来划了红线 Anthropic 首次承认 Claude 越界攻击真实系统不只是"环境配错了",模型自身对齐也没兜住——最严重的一起里,恶意包被部署到 15 台真实第三方主机。同一天,陶哲轩、邓煜等 25 位菲尔兹奖得主联名声明,指 AI 公司把解数学题当 be

易君召 发布于 2026-09-12

AI Agents & 开源 LLM 简报 (2026年9月11日)

主题:Agent 从"客户端功能"变成"一等公民基础设施" OpenAI 把 Codex 的 harness(会话、沙箱、工具编排、上下文压缩)抽出来做成 REST API;Cognition 用 2.8T 的 Kimi K3 靠纯 RL 后训练追平 Fable 5.1 且便宜 64%。Agent

易君召 发布于 2026-09-11

AI Agents & 开源 LLM 简报 (2026年9月10日)

🔥1. OpenAI 用 Lean 形式化"纳维-斯托克斯/Euler 方程的有限时间爆破"——直接回应陶哲轩前日警告,千年级数学难题 AI 化再进一步 — 热度 🔥🔥🔥🔥🔥 陶哲轩刚警告"AI 黑盒解题会污染数学发展",OpenAI 就交出了配套 Lean 证书——但这次是具名、可验证、可审查的,

易君召 发布于 2026-09-10

AI Agents & 开源 LLM 简报 (2026年9月9日)

🔥1. OpenAI 用 Lean 形式化"纳维-斯托克斯/Euler 方程的有限时间爆破"——直接回应陶哲轩前日警告,千年级数学难题 AI 化再进一步 — 热度 🔥🔥🔥🔥🔥 陶哲轩刚警告"AI 黑盒解题会污染数学发展",OpenAI 就交出了配套 Lean 证书——但这次是具名、可验证、可审查的,

易君召 发布于 2026-09-09

智能体(AI Agent)未来发展关键技术分析

智能体核心特征是感知‑记忆‑规划‑工具执行‑反思迭代闭环,从被动问答升级为自主完成复杂长周期任务。未来发展不是单一模型能力提升,而是基座模型、记忆系统、规划推理、工具协议、多智能体协同、可信安全、端侧部署、具身世界模型八大方向的体系化突破,下面逐层拆解关键技术、现状瓶颈与演进方向。 一、Agent‑

易君召 发布于 2026-09-08

AI Agents & 开源 LLM 简报 (2026年9月8日)

🔥1. 华为诺亚前主任王云鹤创业后交出首个模型:基元律动发布 Agent-Native 模型 NeoHorse,把"多模型路由经验"练进参数 — 热度 🔥🔥🔥🔥 一个一直强调"帮 Agent 挑模型"的公司,为什么开始自己训练模型?NeoHorse 的答案:把 Routing Harness 里积累

易君召 发布于 2026-09-08

AI Agents & 开源 LLM 简报 (2026年9月7日)

🔥1. GPT-6 Sol 被曝内测:单次测试速度是 Astra 的 6 倍;OpenAI 研究员人均带 3 个 Agent"实习生";首席科学家发《外星思维》万字长文 — 热度 🔥🔥🔥🔥🔥 Astra 刚发布没几天,GPT-6 系列的另一款 Sol 就被曝光内测——它也许不是最强的,但快得离谱;同

易君召 发布于 2026-09-07

多模态大模型发展趋势与挑战

多模态大模型突破纯文本的边界,统一处理文本、图像、音频、视频、3D 点云等信息,是通向通用人工智能的核心基座。当前已经从早期 “语言大模型外挂视觉编码器” 的拼接式架构,向原生全模态统一架构演进,同时在技术、数据、算力、安全、产业层面仍面临大量关键瓶颈。 一、核心发展趋势 1. 架构:从拼接外挂走向

易君召 发布于 2026-09-07

AI Agents & 开源 LLM 简报 (2026年9月6日)

🔥1. 具身 ICL 来了创业玩家:可可矩阵押注"上下文成 Scaling 新赛道",把后训练 ICL 前置到预训练 — 热度 🔥🔥🔥🔥 2020 年 GPT-3 靠"看几个示例就会新任务"震动 NLP;六年后的今天,同样的故事正在具身智能上演——一家中国创业公司决定把这条路做成底层范式。 量子位深

易君召 发布于 2026-09-06

AI Agents & 开源 LLM 简报 (2026年9月5日)

🔥1. Claude 用 11 天形式化费马大定理:1300 万行 Lean 代码、3 万个中间定理——规模超 Mathlib 五倍,靠 Prove2Me 多 Agent Harness 救回 — 热度 🔥🔥🔥🔥🔥 人类和费马大定理纠缠了三个半世纪,Kevin Buzzard 的社区项目原按"多年工

易君召 发布于 2026-09-05

AI Agents & 开源 LLM 简报 (2026年9月4日)

🔥1. GPT-6 Astra 正式发布!OpenAI 总裁 Brockman:"Welcome to the AGI era"——10 万 GPU 训练、ARC-AGI-3 达 99.9%、ExploitBench 满分 — 热度 🔥🔥🔥🔥🔥 万众期待的 Astra 终于落地:OpenAI 历史上

易君召 发布于 2026-09-04

AI Agents & 开源 LLM 简报 (2026年9月3日)

🔥1. Anthropic 发布官方商业 Agent 蓝图 commerce-agents:购物 Agent + 商户 Agent 双面一体,四个垂直场景开箱即跑 — 热度 🔥🔥🔥🔥 当 Anthropic 开始提供"Agent 应用的标准施工图",企业级 Agent 开发正式进入"参考实现"时代—

易君召 发布于 2026-09-03
上一页 下一页