aifollow.news

全部 AI 动态

10月9日 昨天 10月9日 周五

星期五 · 7 条
Rohan Paul (@rohanpaul_ai) AI 辅助摘要
编辑优先级 54/100
微软论文提出用软件使用日志改进智能体技能

TeleTune 从使用日志中推测每段会话的目标,让模型借助文本技能库预测用户的下一步操作;只有能提高留出日志预测准确率的技能修改才会保留。材料称,旧日志上的下一步预测准确率与实际环境中的成功率变化一致,但未给出具体实验数字。

量子位 AI 报道 AI 辅助摘要
编辑优先级 54/100
Google 与 BIDMC 研究人员在98名患者就诊前测试诊断AI AMIE

研究中,98名患者在就诊前使用了研究级诊断AI聊天机器人AMIE,监督医生实时监控全部交互,按预设安全标准没有对话需要中断。临床医生反馈,AI摘要在75%的场景下帮助他们提前准备接诊;研究仍需更大规模临床试验,才能评估面向患者的表现。

量子位 AI 报道 AI 辅助摘要
编辑优先级 54/100
MirroS发布AgentGarten,让智能体在可交互世界中反复试错

MirroS团队发布AgentGarten,将代码控制的物理环境与实时神经渲染器连接,让智能体根据画面行动,并把每轮经验写入手册供下一轮使用。在一对一捉迷藏实验中,躲藏者第4轮学会搭掩体,搜寻者第10轮学会借坡道翻墙;团队还报告了另外四类任务在四轮演练中的进展。

10月8日 10月8日 周四

星期四 · 7 条
Rohan Paul (@rohanpaul_ai) AI 辅助摘要
编辑优先级 54/100
新论文指出:AI 将错误数学证明转成 Lean 后仍可能通过检验

一篇新论文指出,聊天机器人可能在把错误的数学证明转写为 Lean 证明时,悄悄修正错误,使结果通过检验,却无法证明原始自然语言证明正确。相关介绍还称,判断一个陈述能否被忠实翻译,比停机问题更难,因此不存在总能做到这一点的 AI 翻译器。

量子位 AI 报道 AI 辅助摘要
编辑优先级 54/100
何恺明团队提出纯视觉ARC解题方法NAT-ARC

NAT-ARC先用ImageNet自然图像预训练视觉编码器,再针对ARC格子题训练,并在测试时对每道题单独微调。报道给出的ARC-1成绩为:最佳单模型pass@2达63.4±0.7%,集成模型达70.2±0.6%;集成结果包含不同预训练策略的模型。

IT之家 科技新闻 AI 辅助摘要 精选
编辑优先级 68/100
天津大学团队研制高填充量碳捕集膜,模拟烟气测试显示高渗透率

天津大学姜忠义、何光伟团队将单晶 COF 嵌入聚合物膜,填充量达到 75.5% 的体积分数。在模拟烟气混合气测试中,该膜的二氧化碳渗透率达到 74,800 Barrer,二氧化碳/氮气选择性约为 20;初步技术经济分析估算,在设定流程与成本条件下,碳捕集成本约为每吨二氧化碳 38 美元。


推荐理由:模拟烟气测试给出了渗透率和选择性的具体数据,初步成本估算也标明了适用条件,便于读者判断这项碳捕集材料研究的进展与局限。

10月7日 10月7日 周三

星期三 · 6 条
Rohan Paul (@rohanpaul_ai) AI 辅助摘要
编辑优先级 54/100
Virginia Tech 论文提出压缩循环语言模型的旧词元缓存

循环语言模型会让每个词元多次经过同一组网络层,增加缓存占用。论文提出保留最近 128 个词元的完整缓存,将更早的词元压缩为可供各轮直接读取的小向量。在 Ouro 模型的 16K 词元测试中,吞吐量最高提升 7.4 倍,数学、知识和推理任务的准确率保持在原模型的 97% 以上。

量子位 AI 报道 AI 辅助摘要 同事件
编辑优先级 67/100
OpenAI公开722篇AI生成的数学手稿,证明仍待同行核验

OpenAI公开了由尚未发布的内部模型产出的722篇数学手稿,归为372组结果,并上传论文、源码和部分Lean证明。手稿涉及黎曼ζ函数无零点区域及霍奇猜想的特定情形等问题;仓库称各项结果核验进度不同,部分尚无Lean形式化证明。独立顾问组表示,参与提供建议不代表认可这些结果。


推荐理由:一次公开722篇、涵盖多个重大数学问题的手稿,但核验尚未完成;这批成果能否成立取决于后续同行检查。
同一事件,精选展示《OpenAI公布未发布模型生成的数学研究成果》
Rohan Paul (@rohanpaul_ai) AI 辅助摘要 同事件
编辑优先级 54/100
OpenAI 发布722份AI生成的数学证明

一则帖子称,OpenAI 发布了722份AI生成的数学证明,相关论文涉及372项数学成果。其中一项矩阵乘法结果将两个 n×n 矩阵相乘的已证明复杂度上界从约 n^2.371177 降至约 n^2.25,并附有 Lean 形式化证明;这仍是理论界限,尚不能直接用于加速实际 GPU 工作负载。

同一事件,精选展示《OpenAI公布未发布模型生成的数学研究成果》
IT之家 科技新闻 AI 辅助摘要 同事件
编辑优先级 67/100
OpenAI公布未发布模型的数学研究文稿,涉及数百道未解题

这批文件包含722份手稿,涵盖372个结果家族;咨询小组AGMAI称,其中有对“数百个”未解决问题的解答。发布资料还包括部分推理摘要和算力消耗估算,但数学家仍需评估这些成果,完整影响尚不明确。


推荐理由:未发布模型产出的大规模数学研究材料已公开,数百道未解题的解答主张将接受数学界评估。
同一事件,精选展示《OpenAI公布未发布模型生成的数学研究成果》
继续加载