2026年07月25日

Loop engineering 研究人员让AI模型用彩色铅笔临摹《蒙娜丽莎》,结果却越画越差 Antonia Davison

Loop engineering 研究人员让AI模型用彩色铅笔临摹《蒙娜丽莎》,结果却越画越差 Antonia Davison | 大语言模型 AI破解了猜想,人类运筹帷幄。 Aili McConnon | OpenAI全新语音模式登陆ChatGPT桌面端
分类筛选:

01 Loop engineering 研究人员让AI模型用彩色铅笔临摹《蒙娜丽莎》,结果却越画越差 Antonia Davison

TryAI发布GPT5.6测试数据过度修改导致画作质量下降

初创公司TryAI发布了一项针对4款前沿大模型的绘画能力测试。研究人员测试了GPT-5.6 Sol等模型在无辅助工具下的图像复制表现。

测试引入结构相似性(Structural Similarity)指标进行评分。Gemini 3.6 Flash修改22次,第5次达最佳后质量持续下滑。Claude Fable 5修改27次,第5次后评分基本持平。

研究表明,大模型在自我修正(Self-Correction)中存在过度修改。这表明更多的审查和修改步骤并不等同于最终质量的提升。大模型未来仍需优化其迭代策略。

过度自我修正导致输出质量下降 增加审查次数无法持续提升表现 大模型迭代策略仍需进一步优化
来源

查看原文 →

02 大语言模型 AI破解了猜想,人类运筹帷幄。 Aili McConnon

Anthropic模型Fable5证伪1939年雅可比猜想

Anthropic研究员使用Claude Fable 5模型。该模型成功证伪了1939年提出的数学难题雅可比猜想(Jacobian conjecture)。这是继今年五月OpenAI解决数学难题后的又一重大突破。

IBM专家指出,此类突破并不意味着AI具备了人类的灵感。其本质在于AI能够快速探索人类难以穷尽的海量可能性。这种超强搜索能力可推广至芯片设计、医药研发和网络安全。

AI已成为推动科学和工程领域发展的强大科研伙伴。它能协助理论学家攻克更具挑战性的多维空间难题。这表明人机协作将成为未来科学探索和技术创新的新常态。

AI搜索能力加速基础科学突破 人机协作将重塑未来科研范式 智能模型成为多学科研究伙伴
来源

查看原文 →

03 OpenAI全新语音模式登陆ChatGPT桌面端

OpenAI升级ChatGPT桌面端语音支持单指令控制电脑

OpenAI更新ChatGPT桌面端,引入全新语音功能。该功能基于本月发布的ChatGPT-Live语音模型。用户可通过语音控制AI智能体,直接操作电脑。

该功能全面支持ChatGPT Work和Codex服务。在macOS系统上,它能通过Appshots读取屏幕。桌面端支持跨步骤指令,可单条命令执行多项任务。

AI语音助手正从简单对话向系统级控制方向演进。竞争对手Anthropic也升级了Claude语音模式。其模型已支持在Gmail和Slack等应用中执行任务。

ChatGPT桌面端支持语音控制电脑 单条语音指令可执行多步复杂任务 语音助手向系统级控制方向演进
来源

查看原文 →